OpenAI 发布 GPT‑5.6 系列(Sol/Terra/Luna)并下线独立 Codex App,将 ChatGPT Work 定义为「可部署的生产力中枢」,标志 AI 从对话工具正式迈入自主任务执行平台。
先看最新一期,再按任务继续看
最新一期用几分钟交代当天主要变化;需要数据、实现细节和完整分析,再进入对应专题。
更新文章
Kimi K3以2.8T 参数与百万级上下文刷新国产大模型标杆,多项评测显示其综合能力逼近国际头部模型;与此同时,AI 芯片三龙头海光信息、摩尔线程、芯原股份同日释放业绩预增与大额订单信号,标志国产算力芯片正式迈入规模放量阶段 [7][11]。
办公AI正加速从「能做」迈向「懂你」,金山办公灵犀专业版凭借长期记忆与项目级组织能力重构人机协作范式;与此同时,800V高压平台、16合1智能电驱与零重力座椅等关键技术密集下探至10万元级市场,标志着智能硬件普惠化进程全面提速 [1][2][3]。
OpenAI Codex 项目负责人 Tibo 因主导 ChatGPT、Codex 与 API 的「超级应用」整合而备受关注,其权限管理机制甚至催生“赛博义父”网络梗 [1];与此同时,国行 Apple 智能(Apple Intelligence)确认将集成阿里「千问」大模型,标志中美头部AI厂商首次在终端级AI系统中达成深度合作 [2]。
MoE 架构与具身基础模型正成为大模型工程化与机器人落地的关键突破口;中间表示(IR) 的成熟度被反复验证为决定 AI 在垂直领域规模化落地的底层瓶颈 [2][4]。
具身智能与端云协同AI架构正加速落地,星尘智能发布「隐式世界-动作模型」架构的Lumo-2,腾讯Marvis验证Multi-Agent在消费级产品的规模化可行性;与此同时,苹果发起法律行动阻击OpenAI硬件布局,凸显AI终端生态竞争已进入白热化阶段 [3][4][1]。
苹果正式起诉前员工及OpenAI,指控其通过挖角窃取机密以加速开发竞品AI硬件;与此同时,力积电宣布存储代工报价暴涨45%,折射出AI服务器驱动的DRAM长期供需失衡已持续至2027年 [1][2][3]。
全球AI竞争正加速从大模型性能比拼转向智能体操作系统、可信治理架构与真实世界执行闭环的多维博弈;Step AOS成为首个智能体原生操作系统,而DeepMind CEO Demis Hassabis连续提出前沿模型监管框架,呼吁建立国际AI标准机构并实施上市前30天安全体检机制 [5][6][12]。
AI Agent 安全风险与开源生态加速崛起成为本周双主线:攻击者已能通过一封邮件向 AI Agent 植入持久性虚假记忆[11],同时 NVIDIA 推出开源 Nemotron 模型,以 4 位预训练、混合 SSM‑Transformer 架构推动算力效率革命[6];国内全国产十万卡超集群曙光 8000正式投用,标志大模型基建进入“全栈国产化”拐点[22]。
Sakana AI 成功将仿生智能从软件模拟推向真实硬件,推出无中央控制的3D 智能细胞砖;逐际动力完成 2 亿美元 Pre-IPO 融资,估值达150 亿元,并明确反对营收对赌等违背具身智能演进规律的商业化路径 [5][8]。
英伟达在中国首发 RTX Spark AIPC 平台,将游戏、创作与本地 AI 推理能力浓缩于轻薄笔记本;与此同时,高盛预警 AI 硬件需求正推升美国核心通胀约 50 个基点,内存芯片涨价成关键推手 [1][13]。
RTX Spark AIPC 平台在中国首秀,标志英伟达正式押注端侧AI算力;LongCat-2.0与HyOCR-1.5双双开源,国产大模型在万亿参数优化与1B级轻量OCR两条技术路线上齐头并进;高盛首次公开警示AI债券发行已逼近市场承接能力极限,金融侧风险信号升级 [1][3][8][11]。
AI 图像工具正加速迈向对象级可控编辑,字节跳动 Seedream 5.0 Pro 在多语种文化理解与交互式精准编辑上实现关键突破;与此同时,具身智能硬件迎来手部自由度跃升(25 DoF),但真实自主性仍受限于预编程依赖 [1][2]。企业级 AI 硬件则显现“卡片化”新范式,微软 Project Solara 首次验证专用轻量设备的场景适配优势 [3]。
Agent Runtime、具身智能数据基建与生产力AI国产化落地正成为技术演进与商业化的三大支点;腾讯WorkBuddy与Hy3协同加速入场,而智谱“摸高计划” 和英灵殿全模态分子世界模型则代表中国AGI攻坚的两种范式跃迁 [12][20][1]。
具身智能落地亟需新型多模态数据与闭环训练场支撑,而AI代理权限失控风险正引发行业对安全边界的紧急重审;与此同时,腾讯 WorkBuddy 以深度微信生态集成和本地化工作流设计,成为国产AI编码助手新标杆 [2][4][0]。
AGI 战略加速落地,智谱与 MiniMax 同步公布长期技术路径并绑定高管激励;RTX Spark 超级芯片实现 CPU+GPU 紧耦合架构,首次支持笔记本端本地运行 120B 大模型;人形机器人完成首例活体猪腹腔镜手术,但完全自主操作仍未突破 [2][5][3]。
AI 基础设施正经历存储超级周期与光通信演进双重重构,而自治智能体和长程任务建模成为下一代模型竞争焦点;与此同时,中国大模型加速出海,海外企业因 API 成本压力转向国产方案 [1][3][4][9][10]。
GPT-5.6 在数学推理与办公AI领域实现突破性落地,单小时攻克50年图论猜想,并正式接管微软365 Copilot;与此同时,中国十万卡国产超集群曙光8000落成,标志着AI基建进入全栈自研的规模化新阶段 [15][20][14]。
苹果正式起诉 OpenAI 窃取商业秘密,指控涉及前高管及数百名员工流动;SK海力士预警2027年将迎史上最大存储短缺,AI算力扩张持续加剧供需失衡 [10][8]。
AI 产业正加速进入可信落地期:从HBM 存储龙头 SK 海力士创纪录美股上市[5],到百度搭子系统拓展 Agent「托付半径」[3],再到Claude Code 安全漏洞推动 AI 安全预算转向刚性运维支出[7],技术信任、基础设施与工程化能力成为新竞争焦点。
百度正通过「搭子」产品体系系统性拓展 AI Agent 的托付半径,覆盖个人办公、企业可信部署与跨行业生态协同 [1];与此同时,OpenAI 推出高性价比的 GPT-5.6 系列,并将原独立 Codex 应用整合进 ChatGPT Work 超级应用,加速 Agent 实战化落地 [2]。
OpenAI 推出主打性价比的 GPT-5.6 系列模型,同步下线独立 Codex App 并整合进全新超级应用 ChatGPT Work;全球首例人形机器人(宇树 G1)完成活体腹腔镜手术并登上 Nature,标志临床前可行性验证重大突破 [1][4]。
AI 工程化核心指标从“模型能力”转向“系统效率”:快手验证 Agent 端到端交付可将上新周期压缩 80%(20 天→4 天),腾讯混元 3 正式版在编程与 Agent 构建能力上已逼近旗舰模型水平。
OpenAI 正式发布 GPT‑5.6 系列模型(Sol/Terra/Luna)并整合推出 ChatGPT Work 桌面应用,标志着其向自主任务执行型 AI 生产平台迈出关键一步;与此同时,Meta Muse、原力灵机 DM0.5 等新一代多模态与具身基础模型密集亮相,Zero-shot 能力提升31%、1M上下文窗口等指标持续突破 [1][6][15]。
AI 智能体正加速从“工具调用”迈向“云原生工作负载”,阿里云发布 AgentTeams 与 AgentLoop 平台,微软提出 Cloud Use 新范式,腾讯开源 BrowserSkill 实现浏览器桥接,标志着 Agent 已进入可治理、可观测、可托管的工业化部署阶段 [4][5][24];与此同时,奖励建模精度与安全响应速度成为关键分水岭——腾讯混元联合 UNSW 提出 E-GRM 框架显...