Claude Code 在一周年之际实现双重突破:p99 内存占用骤降 40 倍,并正式上线跨设备Remote Control功能;与此同时,行业共识加速凝聚——从 “为人类编程” 全面转向 “为 AI Agent 构建”,以 CLI、可观...
先看最新一期,再按任务继续看
最新一期用几分钟交代当天主要变化;需要数据、实现细节和完整分析,再进入对应专题。
更新文章
GPT-5.3-Codex 正式全面登陆 OpenAI Responses API 与 OpenRouter,Token 效率提升 3–4 倍,并在 Terminal Bench 等多项编程基准中登顶;与此同时,Anthropic 推出 C...
视频扩散模型的时序鸿沟正被 Rolling Sink 机制系统性弥合;Anthropic 以 Claude Cowork 和行业插件矩阵加速企业级 AI 协作落地;Qdrant 1.17 首次实现向量索引原生的相关性反馈(Relevance...
Anthropic 公开指控 DeepSeek、Moonshot AI 与 MiniMax 实施“工业级蒸馏攻击”,引发模型安全与知识产权边界大讨论;与此同时,行业加速向 AI Agent 工程化演进,OpenAI Codex App、Ti...
OpenAI 全面升级实时能力:发布 gpt-realtime-1.5 模型并为 Responses API 引入 WebSockets 支持,实现最高 40% 的首字节时间(TTFT)降低;与此同时,Anthropic 提出全新 “人格选...
Anthropic正式推出「AI 流利度指数」,以11 种协作行为为标尺重构人机协同评估范式;与此同时,Llama 3.1 8B推理速度突破18,000 tokens/sec,依托硬件级参数固化技术刷新端侧性能边界。...
AI 推理性能迎来硬件级突破——Llama 3.1 8B 实现 18,000 tokens/sec 推理速度;与此同时,GLM-5 全栈适配国产芯片、COMI 框架在 32 倍长文本压缩下反超 25 个点,标志着模型效率与国产化能力双线跃进...
AI 正加速从智能体工程(GLM-5、Antigravity)向系统级重构演进:文件系统即数据库、代码即工具(MCP 架构)、草图即应用成为新范式;而SaaS 护城河持续瓦解,印证 AI 正在重定义软件复杂度与商业壁垒。...
2026 年开年,中美 AI 进入47天30次更新的高频竞速期;GLM-5正式发布,以DSA稀疏注意力与异步强化学习基础设施推动AI迈向“智能体工程”新范式;北京海淀成为全模态、全产业链突破的最强主场。...
LangChain 以「Harness Engineering」系统性方法推动编程智能体跃居 Terminal Bench 2.0 前5,同时其 Agent Builder 记忆系统融合程序性与语义记忆;Gemini 3.1 Pro 展现出...
Gemini 3.1 Pro 展现出将前沿学术论文(如 Local-First CRDT)直接转化为可运行模拟程序的惊人能力;与此同时,OpenAI Batch API 首次支持GPT 图像模型,批量任务成本直降 50%,标志着多模态规模化...
AI 基础设施正经历ASIC 硬件革命与推理成本断崖式下降双重冲击:Taalas HC1 芯片实现 17,000 token/s 推理速度,定价低至 $0.0075/百万 token;与此同时,英伟达转向战略级资本绑定,以 300 亿美元直...
AI 硬件与软件栈正同步加速重构:Taalas 以每秒 17,000 token 的专用 ASIC 芯片挑战英伟达算力霸权,而英伟达则转向战略级资本绑定——300 亿美元直接入股 OpenAI;与此同时,Claude Code 全面升级智能...
Gemini 3.1 Pro、Lyria 3 与 Claude Code 构成本周AI工程演进“三叉戟”:谷歌强化系统性工程推理与多模态创作能力,Anthropic 则以 1M Token 上下文、Code Security 研究预览版及全...
Llama.cpp 正式接入 Hugging Face 生态,标志着轻量级推理与模型分发体系深度协同;GPT-5.2 Thinking 在世界知识推理任务中超越 Gemini 3 DeepThink,凸显「思考链深度」正成为新一代大模型关键...
Gemini 3.1 Pro 正式发布,逻辑推理能力在 ARC-AGI-2 基准中跃升至 77.1%(前代仅 31%),多项指标超越竞品;与此同时,推理算力被 OpenAI 总裁 Greg Brockman 明确定义为当前软件生产力的核心瓶...
Gemini 3.1 Pro 正式登顶多维基准测试,逻辑推理能力翻倍提升(ARC-AGI-2 达 77.1%),推动 Google 重回 AI 模型第一梯队;与此同时,OpenAI、Perplexity、Replit 和 Anthropic...
日语AI落地迎来关键突破:NTT DATA 借助 NVIDIA Nemotron-Personas-Japan 合成数据集,将模型准确率从15.3%跃升至79.3%;与此同时,Anthropic 收紧生态权限,OAuth 接入全面禁用,凸显...
AI 正加速跨越工具层迈向决策层:Claude Opus 4.6以100万上下文窗口与动态计算重塑能力边界;Ling-2.5-1T、Qwen3.5-397B-A17B等国产大模型在开源赛道强势跻身全球前列;而分发能力与Agent 安全架构,...
Qwen 3.5 系列(含 397B-A17B 与 Plus 版本)正引发全栈生态爆发式适配——从 NVIDIA NeMo、AMD Instinct GPU 到 Ollama Cloud、ZenMux 和 mlx-vlm,主流硬件平台与开发...
Qwen 3.5 系列正引发全栈生态爆发——从 NVIDIA、AMD 到 Ollama Cloud、ZenMux 和 mlx-vlm,主流硬件厂商与开发平台均实现首日支持;与此同时,LlamaIndex加速向 AI Agent 基建层演进,...
Qwen 3.5 系列强势引爆开源大模型生态,397B 参数、原生多模态与MoE + Linear Attention 架构获 NVIDIA、AMD、Ollama、ZenMux、LMSYS 及 mlx-vlm 全栈首日支持;与此同时,Lla...
AI 正加速从能力增强迈向角色替代:LLM 代码翻译、视觉化 UI 编辑与记忆驱动型智能体成为新生产力基座;Qwen3.5-397B等开源大模型持续强化 B2B 实战能力,而傅盛团队和Google Antigravity则同步验证了 AI ...
阿里巴巴正式开源 Qwen3.5-397B-A17B——全球首个原生多模态、稀疏 MoE 架构的开源大模型,支持 1M 超长上下文与消费级硬件 4-bit 本地推理;与此同时,Manus Agents在 Telegram 上落地长期记忆与工...
OpenAI 正以战略级动作加速布局个人智能体生态,高调招揽 OpenClaw 创始人 Peter Steinberger;与此同时,MiniMax 凭借极致推理性价比技术路径实现估值跃升,而 Claude Code 已支撑起年化 25 亿...