AI Agent 正加速从工具演进为用户交互的统一入口,推动“超级助理”范式替代传统 App 生态;与此同时,智谱凭借全模型开源策略,市值跃居全球最高开源软件公司,超越小米 [4]。思想领袖如 Naval Ravikant 则强调,在组织重构与硬件复兴浪潮中,需以不理性乐观应对 AI 带来的系统性变革 [3]。
先看最新一期,再按任务继续看
最新一期用几分钟交代当天主要变化;需要数据、实现细节和完整分析,再进入对应专题。
更新文章
具身世界模型迎来爆发式开源进展,τ0-WM 与 STI-WM 相继发布,标志着机器人「慢思考」决策与物理 AI 落地进入新阶段;智谱以全模型开源策略跃升为全球市值最高开源软件公司,估值已超小米 [1];与此同时,Anthropic被曝疑似人为降级旧模型性能,引发对大模型厂商商业伦理的深度质疑 [10]。
Anthropic 估值飙升至 9650 亿美元,正式超越 OpenAI 成为全球最高估值 AI 公司;与此同时,通用 Agent 被多位专家定义为“下一代操作系统”,正加速重构 App 形态、SaaS 架构与企业组织范式 [8][2][4]。
Anthropic 因过度依赖 TUI 交互范式而错失 GUI 产品机会,反衬出 Claude App 的设计优势;与此同时,国内首个 绿色算力全栈 AI 平台在内蒙古落地,集成算力调度、模型调用与词元交易三大能力,标志AI基础设施进入低碳协同新阶段 [1][7]。
微软公开45 年前 DOS 源码,以纸质档案 OCR 重建技术重现计算机史关键遗产 [0];小米首次披露 MiMo-V2.5 全链路推理优化架构,聚焦 Hybrid SWA + MoE + 多模态协同提效 [2];Fireworks AI 估值飙升至150 亿美元,折射全球 AI 推理基础设施赛道加速资本化 [6]。
AI Agent 正加速从 Copilot 辅助走向自主驱动的 SDLC 实践,Salesforce 已实现关键流程从 231 人天压缩至 13 天;与此同时,多智能体世界模型 Gamma-World 突破身份对称与通信瓶颈,标志着具身智能底层架构取得关键进展 [7][9]。
Claude Opus 4.8 新增对话中途系统消息功能,显著提升 Agent 可控性与工程鲁棒性 [10];比亚迪璇玑 A3 车规级 4nm 自研芯片发布,算力与能效对标英伟达,标志中国物理 AI 硬件竞争进入新阶段 [12];全球存储器出口价格暴涨近 1000%,折射 AI 算力基建需求爆发下的供应链重构压力 [11]。
国内AI产业正呈现“高投入”与“低体感”并存的撕裂状态:一边是启境GT7以华为乾崑智驾+鸿蒙座舱实现全栈技术集成,另一边是亚马逊等国际大厂明确划定AI滥用红线;与此同时,Grok Build 0.1正式登陆开发者主力工具Cursor,而行业反思声量亦同步升温 [1][2][3][4]。
Claude Opus 4.8 正式发布,显著强化编程能力与动态 Subagent 工作流支持,可并发调度数百子智能体处理复杂任务;与此同时,国产AI算力落地瓶颈正被清华系团队“智能算力电网”技术突破——通过异构池化将国产芯片转化为高可用、低成本的标准化 Token 产能 [13][11]。
Claude Code /usage 命令上线,首次实现 Skills/Agents/MCPs/Plugins 四类智能体能力的 Token 级细粒度消耗追踪,AI 工程进入「成本可计量」时代。
Anthropic 正以 Claude Opus 4.8 和 Dynamic Workflows 重构 Agent 能力边界,而行业共识正快速转向:Agent 的真实能力取决于可访问的工具与执行边界,而非角色拟人化;与此同时,大厂 AI 投入普遍陷入 ROI 不明、预算失控 的“黑箱账本”困局 [1][2][5]。
国产算力生态正加速迈入芯模协同新阶段,DeepSeek V4 与鲲鹏昇腾大会标志着从“芯片适配模型”转向“联合定义架构”[4];与此同时,Claude Code 的云端化部署成为工程落地热点,阿里 ATA 与社区教程共同推动其向多用户、流式服务、沙箱隔离的生产级架构演进[2][3]。
国产大模型Qwen3.7 Max在Vibe Coding(氛围编程)实测中跃居全球第二,力压多个国际主流模型;与此同时,海力士市值突破 1 万亿美元,成为全球首家迈入“万亿半导体俱乐部”的存储芯片厂商 [1][2]。
Agent 工程化正加速从概念验证迈向生产落地,Alook开源平台实现 CLI Agent 的角色化编排,复旦 NLP团队为学术场景提供免费 GPU 支持的全自动科研 Agent;与此同时,小米将国产大模型 API 价格压至 0.025 元/百万 Token,行业进入深度“Token 价格战”阶段 [16]。
手机 AI 的终极形态正迈向「无感智能」——OPPO ColorOS 16 与 vivo 官网 AI 导购均验证了意图识别小模型 + Agent 工作流 + RAG 知识库的轻量化落地路径 [0][5];与此同时,AI 商业化正遭遇结构性瓶颈,广告与订阅模式双双触顶,行业共识正加速转向以「任务执行」为核心的「执行经济」[9]。
触觉具身智能完成近亿元天使轮融资,成为机器人精细化操作新突破口;OpenRouter B轮融资达1.13亿美元,周Token处理量飙升至25T;SynthID已标记1000亿条AI生成内容,正加速嵌入Google搜索与Chrome生态 [5][16][20]。
CUDA 13.3 正式引入 C++ Tile 编程 与 CompileIQ 自动调优框架,标志着 GPU 开发范式向更高抽象层级演进;与此同时,Stack Overflow 在用户发帖量断崖下跌的背景下,凭借 企业AI知识库 和 数据授权服务 实现年收入达 1.15亿美元,验证了AI时代开发者平台的商业化新路径 [2][3]。
AI 工程化正加速迈入「AI 制造 AI」新阶段:面壁智能发布全球首个由 AI 编写的生产级预训练框架 ForgeTrain,并成功训练出 MiniCPM5-1B;与此同时,DSA、KV Cache 量化(如 OSCAR 的 2-bit 方案)与 韬定律 等底层架构创新密集落地,持续突破算力与能效瓶颈 [24][10][22]。
华为提出以时间常数 τ 为核心的新芯片演进范式「韬定律」,挑战摩尔定律传统路径;与此同时,DeepSeek 登顶全球大模型调用榜,凸显国产AI基础设施的规模化落地能力 [3];而AI对话产品因人格化设计引发的「承诺幻觉」,正暴露产品责任与法律监管的深层断层 [0]。
AI 工程正加速从提示工程向框架工程与上下文工程纵深演进,Agent Harness标准化和垂直领域工作流重构成为落地关键;DeepSeek以“蜜雪冰城式”低价策略切入编程 Agent 市场,直指Claude Code对标定位 [2][6][7][2]。
DeepSeek 以永久降价的 V4-Pro API 发起低价冲击,剑指Claude Code级编程 Agent 市场;面壁智能突破端侧瓶颈,实现600亿参数模型在昇腾平台的1.58-bit三值量化训练,显存节省6倍且保留97%能力 [2];与此同时,Gemini悄然变更计费逻辑,付费用户实际额度大幅缩水,暴露大模型商业化中的信任裂痕 [10]。
中国AI公司面壁智能联合清华与OpenBMB,以1.58-bit三值量化技术突破端侧大模型部署瓶颈,在华为昇腾平台实现600亿参数模型的端到端训练,显存节省约6倍且保留97%能力 [1];与此同时,连续空间语言建模新范式正挑战传统token-based自回归架构的结构性天花板,被视为通向AGI的关键路径演进 [6]。
Agent 技术成熟度加速跃迁,Codex 等工具链持续迭代关键工作流能力;与此同时,谷歌 CEO 公开承认 Gemini 在 Coding Agent 和长期任务上存在明显差距 [3],印证行业正从模型性能竞赛转向真实任务闭环能力比拼。Anthropic 提出的「该做」优于「能做」框架 [7],正成为AI时代判断力稀缺性的核心注脚。
AI 产业正加速迈入智能体(Agent)原生时代,Coding 能力成为 Agent 质变分水岭 [5];算力重心历史性转向推理,预计未来将消耗70% AI 总算力 [17];Anthropic首次公开下一代 Claude 的「做梦」记忆机制与长期协作架构 [9],而谷歌 CEO 明确承认 Gemini 在 Coding Agent 领域落后 [16]。
AI 产业重心正发生结构性迁移:推理算力占比将跃升至70%,而Agent 公司的竞争锚点已从 SaaS 预算转向企业工资单;与此同时,高质量医疗数据与结构化安全技能库成为新阶段核心壁垒 [1][7][2]。