小米开源全模态模型MiMo-V2.6 Pro · 0924-678期
多智能体协作与开源模型成为本周最密集的突破方向:Microsoft Research 证明 k 个通信智能体可媲美 4k 个独立智能体 [2],Stanford 与 Together AI 的 SAT 框架在五项基准上平均准确率达 66.7% [7];与此同时,小米开源全模态模型 MiMo-V2.6 Pro 在 Agent 基准上对标 Claude Opus 5 与 GPT-5.6 Sol [5]...
## 🔍 核心洞察
**多智能体协作**与**开源模型**成为本周最密集的突破方向:Microsoft Research 证明 k 个通信智能体可媲美 4k 个独立智能体 [2],Stanford 与 Together AI 的 SAT 框架在五项基准上平均准确率达 **66.7%** [7];与此同时,**小米**开源全模态模型 **MiMo-V2.6 Pro** 在 Agent 基准上对标 **Claude Opus 5** 与 **GPT-5.6 Sol** [5],并官宣 **MiMo-V3** 将采用全新 **HySparse 2** 架构 [12]。
## 🚀 重点动态
- **腾讯 WorkBuddy 实测:办公 Agent 做成"赛博乐高"** [0]:通过专家广场、安全中心与团队空间,将个人经验转化为组织可复用资产。
- **Microsoft Research:k 个通信智能体媲美 4k 个独立智能体** [2]:在 ARC-AGI-3 与 polyomino packing 上超越 best@k 及已知最优成绩。
- **Google 发布 Gemini 3.8 Flash TTS 系列语音模型** [3][4]:支持 100+ 语言自定义声音与 2,000+ 现成语音,可生成数小时无毛刺音频。
- **小米开源 MiMo-V2.6 Pro/Flash 全模态模型** [5]:Pro 在 Artificial Analysis 智能指数得分 46,为开源模型最高。
- **Stanford 与 Together AI 提出 SAT 自组织智能体团队** [7]:o3-mini、Claude Sonnet 4 与 DeepSeek-V3 组队学习协作策略,平均准确率 66.7%。
- **罗福莉官宣小米 MiMo-V3 采用 HySparse 2 架构** [12]:1M Token 下预填充计算量降低 5.02 倍,KV 缓存缩小 4.5 倍。
- **Meta AI 智能体 Muse 一周吸引 50 万用户** [19]:日活超 25 万,累计输入超 200 万条提示词,登顶 App Store,同时被指借鉴 OpenClaw。
- **Anthropic 工程师解释 Claude 写作质量下降原因** [9]:新模型针对数学与代码优化,学会写给 AI 看的技术性表达,产生"Claudeish"文风。
## 🔗 Sources
[0] WorkBuddy 把办公 Agent,做成了人人可搭的「赛博乐高」 — https://www.bestblogs.dev/article/5e0c711e05?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item
[2] Microsoft Research 论文研究测试时通信:k 个智能体团队媲美 4k 独立智能体 — https://aihot.news/items/cmue9rxdt0siwrogh7vkadlwl
[3] Google 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 语音模型 — https://aihot.news/items/cmuea0fus0styroghsv6n2nc1
[4] Google DeepMind 发布
多智能体协作与开源模型成为本周最密集的突破方向:Microsoft Research 证明 k 个通信智能体可媲美 4k 个独立智能体 [2],Stanford 与 Together AI 的 SAT 框架在五项基准上平均准确率达 66.7% [7];与此同时,小米开源全模态模型 MiMo-V2.6 Pro 在 Agent 基准上对标 Claude Opus 5 与 GPT-5.6 Sol [5],并官宣 MiMo-V3 将采用全新 HySparse 2 架构 [12]。
🚀 重点动态
- 腾讯 WorkBuddy 实测:办公 Agent 做成"赛博乐高" [0]:通过专家广场、安全中心与团队空间,将个人经验转化为组织可复用资产。
- Microsoft Research:k 个通信智能体媲美 4k 个独立智能体 [2]:在 ARC-AGI-3 与 polyomino packing 上超越 best@k 及已知最优成绩。
- Google 发布 Gemini 3.8 Flash TTS 系列语音模型 [3][4]:支持 100+ 语言自定义声音与 2,000+ 现成语音,可生成数小时无毛刺音频。
- 小米开源 MiMo-V2.6 Pro/Flash 全模态模型 [5]:Pro 在 Artificial Analysis 智能指数得分 46,为开源模型最高。
- Stanford 与 Together AI 提出 SAT 自组织智能体团队 [7]:o3-mini、Claude Sonnet 4 与 DeepSeek-V3 组队学习协作策略,平均准确率 66.7%。
- 罗福莉官宣小米 MiMo-V3 采用 HySparse 2 架构 [12]:1M Token 下预填充计算量降低 5.02 倍,KV 缓存缩小 4.5 倍。
- Meta AI 智能体 Muse 一周吸引 50 万用户 [19]:日活超 25 万,累计输入超 200 万条提示词,登顶 App Store,同时被指借鉴 OpenClaw。
- Anthropic 工程师解释 Claude 写作质量下降原因 [9]:新模型针对数学与代码优化,学会写给 AI 看的技术性表达,产生"Claudeish"文风。
🔗 Sources
[0] WorkBuddy 把办公 Agent,做成了人人可搭的「赛博乐高」 — https://www.bestblogs.dev/article/5e0c711e05?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item [2] Microsoft Research 论文研究测试时通信:k 个智能体团队媲美 4k 独立智能体 — https://aihot.news/items/cmue9rxdt0siwrogh7vkadlwl [3] Google 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 语音模型 — https://aihot.news/items/cmuea0fus0styroghsv6n2nc1 [4] Google DeepMind 发布