@Xplore-LAB
📮 情报局周报 · 第 36 周 · 08-29 ~ 09-04 · llm-tracker
📡 前沿动态(近 7 天 44 条)
另有 34 条,见 Agent 前线
🧬 新模型与榜单
近 7 天新发布 4 个:
- Muse-Spark-1.3(Meta)· 09-02 — Muse Spark 1.3 is a multimodal reasonin…
- Gemini-3.8-Flash(Google)· 09-02 — Gemini 3.8 Flash is Google's most intel…
- Claude-Fable-5.1(Anthropic)· 09-01 — Claude Fable 5.1 improves on Claude Fab…
- Hy4(Tencent)· 08-28 — Tencent: Hy4 preview is a mixture-of-ex…
AA Intelligence Index Top 5(能力口径)
| # |
模型 |
厂商 |
AA |
| 1 |
Claude Opus 5 |
Anthropic |
63 |
| 2 |
Claude Fable 5 |
Anthropic |
62 |
| 3 |
GPT-5.6 Sol |
OpenAI |
61 |
| 4 |
Grok 4.6 |
xAI |
61 |
| 5 |
Kimi K3 |
Moonshot |
60 |
Arena Elo Top 3(人类偏好口径)
| # |
模型 |
Elo |
| 1 |
Claude Fable 5 |
1507 |
| 2 |
Muse Spark 1.2 |
1498 |
| 3 |
Claude Opus 5 |
1492 |
双榜口径不同不可互相换算;完整 50 模型见 排行榜,模型时序见 模型页
📚 本周学习主题 · ⚡ 核心架构与效率
工业界如何让 Transformer 跑得更快、更长、更省。位置编码、注意力加速、KV Cache 优化、MoE 稀疏化——这是阅读现代模型技术报告前必须补齐的四块拼图。
七阶段按周轮换;顺路逛 LLM 博物馆,动手见 实验室
事件由每日 Agent 管线自动合入(置信度 ≥ 0.85);每周五 18:00 由 GitHub Actions 自动发布本 Issue,@提及 即触发 GitHub 官方邮件提醒。
@Xplore-LAB
📡 前沿动态(近 7 天 44 条)
另有 34 条,见 Agent 前线
🧬 新模型与榜单
近 7 天新发布 4 个:
AA Intelligence Index Top 5(能力口径)
Arena Elo Top 3(人类偏好口径)
📚 本周学习主题 · ⚡ 核心架构与效率
工业界如何让 Transformer 跑得更快、更长、更省。位置编码、注意力加速、KV Cache 优化、MoE 稀疏化——这是阅读现代模型技术报告前必须补齐的四块拼图。
七阶段按周轮换;顺路逛 LLM 博物馆,动手见 实验室
事件由每日 Agent 管线自动合入(置信度 ≥ 0.85);每周五 18:00 由 GitHub Actions 自动发布本 Issue,@提及 即触发 GitHub 官方邮件提醒。