本周 AI 领域呈现出技术落地加速与行业焦虑并存的双重态势。一方面,复旦团队复盘了 744B 参数 MoE 模型 Atria Dawn Preview 的开发过程,显示 AI 智能体承担的执行操作中位数在四周内从 11 次跃升至 28.5 次 [0];阿里达摩院开源了腹部 CT 诊断多模态模型 RADAR [17],Interfaze 则推出基于 Qwen-3.5 4B 的高效质检模型 lev [...
## 🔍 核心洞察
本周 AI 领域呈现出**技术落地加速**与**行业焦虑并存**的双重态势。一方面,**复旦团队**复盘了 **744B 参数 MoE 模型** Atria Dawn Preview 的开发过程,显示 AI 智能体承担的执行操作中位数在四周内从 11 次跃升至 28.5 次 [0];**阿里达摩院**开源了腹部 CT 诊断多模态模型 **RADAR** [17],**Interfaze** 则推出基于 **Qwen-3.5 4B** 的高效质检模型 **lev** [18]。另一方面,**Anthropic** 部分早期员工被曝因担忧"AI 失控"而考虑在偏远地区购置土地 [7][12],折射出行业内部对**AGI 安全**的深层焦虑。
## 🚀 重点动态
- **复旦团队复盘 Atria Dawn Preview 开发** [0]:56 名参与者、700+ 任务日志显示,每人对应智能体操作中位数四周内从 11 升至 28.5,人类仍主导决策。
- **阿里达摩院开源 RADAR 医疗 AI** [17]:多模态模型辅助腹部 CT 诊断,具备接近专家的病变分析能力。
- **Interfaze 开源 lev 质检模型** [18]:基于 Qwen-3.5 4B,通过内部概率直接输出结果,实现高效多任务质检。
- **Anthropic 资深员工被曝筹备"AI 失控"避难所** [7][12]:WSJ 报道数位早期员工考虑在偏远地区购地,内部 Slack 曾推演末日情景。
- **GPT-6 完成微信无接口长链任务** [3][11]:傅盛实测 GPT-6 连续执行 120+ 条微信祝福任务,认为 AGI 可能已到来。
- **Opus 5.5 与 Sol 引发团队选型分歧** [8]:两款模型各有拥趸,文章同时讨论 evals 正成为越来越多招聘要求的趋势。
- **Privatemode 展示 GLM-5.3-Flash 类型化决策方法** [21]:无需微调,通过编号选项与 log 概率读取,实现单次前向输出带概率的决策。
- **努比亚 NaviX Ultra 用户玩《王者荣耀》遭强制下线** [4]:豆包手机助手声明未对腾讯游戏系统做任何操作,建议用户暂停尝试登录。
## 🔗 Sources
[0] 复旦团队复盘 Atria Dawn Preview 开发:AI 智能体承担更多执行,人类仍做绝大多数决策 — https://aihot.news/items/cmujz82l112d4ro9hsb2680j6
[3] 微信无接口环境下 AI 长链任务成功 — https://www.bestblogs.dev/status/2104209485489430644?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item
[4] 努比亚 NaviX Ultra 用户玩《王者荣耀》遭强制下线,豆包手机助手称未对腾讯游戏系统做任何操作 — https://aihot.news/items/cmujwzb0a1020ro9h28gpqmyg
[7] Anthropic 部分资深员工考虑在偏远地区购置土地,以防"AI 失控" — https://aihot.news/items/cmujwzb0b1022ro9h55cz1o8y
[8] Opus 5.5 与 Sol 让团队一分为二 — https://aihot.news/items/cmuj
本周 AI 领域呈现出技术落地加速与行业焦虑并存的双重态势。一方面,复旦团队复盘了 744B 参数 MoE 模型 Atria Dawn Preview 的开发过程,显示 AI 智能体承担的执行操作中位数在四周内从 11 次跃升至 28.5 次 [0];阿里达摩院开源了腹部 CT 诊断多模态模型 RADAR [17],Interfaze 则推出基于 Qwen-3.5 4B 的高效质检模型 lev [18]。另一方面,Anthropic 部分早期员工被曝因担忧"AI 失控"而考虑在偏远地区购置土地 [7][12],折射出行业内部对AGI 安全的深层焦虑。
🚀 重点动态
- 复旦团队复盘 Atria Dawn Preview 开发 [0]:56 名参与者、700+ 任务日志显示,每人对应智能体操作中位数四周内从 11 升至 28.5,人类仍主导决策。
- 阿里达摩院开源 RADAR 医疗 AI [17]:多模态模型辅助腹部 CT 诊断,具备接近专家的病变分析能力。
- Interfaze 开源 lev 质检模型 [18]:基于 Qwen-3.5 4B,通过内部概率直接输出结果,实现高效多任务质检。
- Anthropic 资深员工被曝筹备"AI 失控"避难所 [7][12]:WSJ 报道数位早期员工考虑在偏远地区购地,内部 Slack 曾推演末日情景。
- GPT-6 完成微信无接口长链任务 [3][11]:傅盛实测 GPT-6 连续执行 120+ 条微信祝福任务,认为 AGI 可能已到来。
- Opus 5.5 与 Sol 引发团队选型分歧 [8]:两款模型各有拥趸,文章同时讨论 evals 正成为越来越多招聘要求的趋势。
- Privatemode 展示 GLM-5.3-Flash 类型化决策方法 [21]:无需微调,通过编号选项与 log 概率读取,实现单次前向输出带概率的决策。
- 努比亚 NaviX Ultra 用户玩《王者荣耀》遭强制下线 [4]:豆包手机助手声明未对腾讯游戏系统做任何操作,建议用户暂停尝试登录。
🔗 Sources
[0] 复旦团队复盘 Atria Dawn Preview 开发:AI 智能体承担更多执行,人类仍做绝大多数决策 — https://aihot.news/items/cmujz82l112d4ro9hsb2680j6
[3] 微信无接口环境下 AI 长链任务成功 — https://www.bestblogs.dev/status/2104209485489430644?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item
[4] 努比亚 NaviX Ultra 用户玩《王者荣耀》遭强制下线,豆包手机助手称未对腾讯游戏系统做任何操作 — https://aihot.news/items/cmujwzb0a1020ro9h28gpqmyg
[7] Anthropic 部分资深员工考虑在偏远地区购置土地,以防"AI 失控" — https://aihot.news/items/cmujwzb0b1022ro9h55cz1o8y
[8] Opus 5.5 与 Sol 让团队一分为二 — https://aihot.news/items/cmuj