更新速报

官方发布的简报与分析文章

先看最新一期,再按任务继续看

最新一期用几分钟交代当天主要变化;需要数据、实现细节和完整分析,再进入对应专题。

更新文章

Rolling Sink弥合视频扩散时序鸿沟 · 0225-58期

视频扩散模型的时序鸿沟正被 Rolling Sink 机制系统性弥合;Anthropic 以 Claude Cowork 和行业插件矩阵加速企业级 AI 协作落地;Qdrant 1.17 首次实现向量索引原生的相关性反馈(Relevance...

Anthropic发布AI流利度指数 · 0224-55期

Anthropic正式推出「AI 流利度指数」,以11 种协作行为为标尺重构人机协同评估范式;与此同时,Llama 3.1 8B推理速度突破18,000 tokens/sec,依托硬件级参数固化技术刷新端侧性能边界。...

Llama 3.1 8B推理达18000 tokens/sec · 0223-54期

AI 推理性能迎来硬件级突破——Llama 3.1 8B 实现 18,000 tokens/sec 推理速度;与此同时,GLM-5 全栈适配国产芯片、COMI 框架在 32 倍长文本压缩下反超 25 个点,标志着模型效率与国产化能力双线跃进...

Gemini 3.1 Pro 能将学术论文转运行程序 · 0222-50期

Gemini 3.1 Pro 展现出将前沿学术论文(如 Local-First CRDT)直接转化为可运行模拟程序的惊人能力;与此同时,OpenAI Batch API 首次支持GPT 图像模型,批量任务成本直降 50%,标志着多模态规模化...

Taalas HC1芯片推理达17000 token/s · 0222-49期

AI 基础设施正经历ASIC 硬件革命与推理成本断崖式下降双重冲击:Taalas HC1 芯片实现 17,000 token/s 推理速度,定价低至 $0.0075/百万 token;与此同时,英伟达转向战略级资本绑定,以 300 亿美元直...

Taalas推17000 token/s专用ASIC挑战英伟达 · 0221-48期

AI 硬件与软件栈正同步加速重构:Taalas 以每秒 17,000 token 的专用 ASIC 芯片挑战英伟达算力霸权,而英伟达则转向战略级资本绑定——300 亿美元直接入股 OpenAI;与此同时,Claude Code 全面升级智能...

Llama.cpp接入Hugging Face · 0221-46期

Llama.cpp 正式接入 Hugging Face 生态,标志着轻量级推理与模型分发体系深度协同;GPT-5.2 Thinking 在世界知识推理任务中超越 Gemini 3 DeepThink,凸显「思考链深度」正成为新一代大模型关键...

Claude Opus 4.6上线百万上下文 · 0219-42期

AI 正加速跨越工具层迈向决策层:Claude Opus 4.6以100万上下文窗口与动态计算重塑能力边界;Ling-2.5-1T、Qwen3.5-397B-A17B等国产大模型在开源赛道强势跻身全球前列;而分发能力与Agent 安全架构,...

Qwen 3.5发布首日获NVIDIA · 0218-40期

Qwen 3.5 系列正引发全栈生态爆发——从 NVIDIA、AMD 到 Ollama Cloud、ZenMux 和 mlx-vlm,主流硬件厂商与开发平台均实现首日支持;与此同时,LlamaIndex加速向 AI Agent 基建层演进,...

Qwen3.5-397B开源大模型强化B2B实战能力 · 0217-38期

AI 正加速从能力增强迈向角色替代:LLM 代码翻译、视觉化 UI 编辑与记忆驱动型智能体成为新生产力基座;Qwen3.5-397B等开源大模型持续强化 B2B 实战能力,而傅盛团队和Google Antigravity则同步验证了 AI ...