## 🔍 核心洞察 **多智能体协作**与**开源模型**成为本周最密集的突破方向:Microsoft Research 证明 k 个通信智能体可媲美 4k 个独立智能体 [2],Stanford 与 Together AI 的 SAT 框架在五项基准上平均准确率达 **66.7%** [7];与此同时,**小米**开源全模态模型 **MiMo-V2.6 Pro** 在 Agent 基准上对标 **Claude Opus 5** 与 **GPT-5.6 Sol** [5],并官宣 **MiMo-V3** 将采用全新 **HySparse 2** 架构 [12]。 ## 🚀 重点动态 - **腾讯 WorkBuddy 实测:办公 Agent 做成"赛博乐高"** [0]:通过专家广场、安全中心与团队空间,将个人经验转化为组织可复用资产。 - **Microsoft Research:k 个通信智能体媲美 4k 个独立智能体** [2]:在 ARC-AGI-3 与 polyomino packing 上超越 best@k 及已知最优成绩。 - **Google 发布 Gemini 3.8 Flash TTS 系列语音模型** [3][4]:支持 100+ 语言自定义声音与 2,000+ 现成语音,可生成数小时无毛刺音频。 - **小米开源 MiMo-V2.6 Pro/Flash 全模态模型** [5]:Pro 在 Artificial Analysis 智能指数得分 46,为开源模型最高。 - **Stanford 与 Together AI 提出 SAT 自组织智能体团队** [7]:o3-mini、Claude Sonnet 4 与 DeepSeek-V3 组队学习协作策略,平均准确率 66.7%。 - **罗福莉官宣小米 MiMo-V3 采用 HySparse 2 架构** [12]:1M Token 下预填充计算量降低 5.02 倍,KV 缓存缩小 4.5 倍。 - **Meta AI 智能体 Muse 一周吸引 50 万用户** [19]:日活超 25 万,累计输入超 200 万条提示词,登顶 App Store,同时被指借鉴 OpenClaw。 - **Anthropic 工程师解释 Claude 写作质量下降原因** [9]:新模型针对数学与代码优化,学会写给 AI 看的技术性表达,产生"Claudeish"文风。 ## 🔗 Sources [0] ‌​⁣‌‌⁤⁡⁤‬⁡​‌⁤‬‬⁣​‌⁢​‬⁣‬​​⁤​‬​‬‍​⁤⁤​⁢⁣⁢​‍⁡​‬‬⁢WorkBuddy 把办公 Agent,做成了人人可搭的「赛博乐高」 — https://www.bestblogs.dev/article/5e0c711e05?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item [2] Microsoft Research 论文研究测试时通信:k 个智能体团队媲美 4k 独立智能体 — https://aihot.news/items/cmue9rxdt0siwrogh7vkadlwl [3] Google 发布 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 语音模型 — https://aihot.news/items/cmuea0fus0styroghsv6n2nc1 [4] Google DeepMind 发布