1/16 Anthropic 与 Google、Broadcom 签署多吉瓦级 TPU 算力协议
Anthropic 宣布与 Google 和 Broadcom 达成协议,获得多吉瓦级下一代 TPU 算力,预计 2027 年起陆续上线,绝大部分部署在美国本土。公告同时披露 Anthropic 年化收入已突破 300 亿美元,较 2025 年底的 90 亿美元增长超两倍;年付费超百万美元的企业客户数突破 1000 家,较今年 2 月翻倍。CFO Krishna Rao 称这是公司”迄今最大规模的算力承诺”。Claude 将继续在 AWS、Google Cloud 和 Azure 三大云平台提供服务。
2/16 OpenAI 推出 Safety Fellowship 项目
OpenAI 发布 Safety Fellowship 计划,支持独立研究者从事 AI 安全与对齐研究,旨在培养下一代安全人才。该计划将为研究者提供资金和资源支持。OpenAI 多位安全团队成员(包括 @tszzl、@jachiam0)转发确认对齐团队仍是 OpenAI 最大且算力最充裕的研究项目之一,Sam Altman 也转发了相关的超级智能政策过渡讨论。
3/16 Windsurf 上线 Adaptive 智能模型路由
Windsurf 发布三项更新:Adaptive 智能模型路由器会自动为每个任务选择最优模型并避免过度消耗高端模型配额;重新设计的模型选择器会显示精确的 token 定价;Max 用户取消每日限额,仅保留每周配额。Adaptive 推出两周内提供促销价格。此举回应了用户对定价不透明和限制过严的批评。
4/16 开源模型持续缩小与闭源差距
Abacus.AI CEO Bindu Reddy 总结上周赢家:MiniMax 2.7、Qwen 3.6、GLM 5、Kimi 2.5 等开源/低价模型使用量指数级增长,以闭源模型十分之一的成本实现 75-80% 的性能。Clement Delangue 转发称有开源模型首次在评测中超越 Sonnet 4.6。HuggingFace 社区同步发布了 Gemma 4 的 INT4/FP8 量化版本及评测结果。
5/16 DeepSeek V4 传闻即将发布,为华为芯片优化
据 Bindu Reddy 透露,DeepSeek V4 因需适配华为芯片而推迟发布,预计数周内推出,据传在工具调用和智能体能力方面表现优异。随着智能体工作负载爆炸式增长,业界对低成本高效模型的需求愈发迫切。
6/16 NVIDIA PersonaPlex 7B:实时对话 AI 开源
NVIDIA 发布 PersonaPlex 7B,一款支持全双工实时对话的模型——能像人类一样在对方说话时打断并回应。在对话自然度测试中击败 Gemini Live,中断响应速度快 18 倍。完全开源,可本地运行,无需 API 调用。
7/16 Clement Delangue 推动开源 AI Agent Traces 数据集
HuggingFace CEO Clement Delangue 呼吁构建开源前沿智能体数据集,率先将自己在 HERMES、OpenCode 和 Claude 等工具中的 agent traces 分享到 HuggingFace。Pi 开发者 @badlogicgames 也公开了全部编码智能体会话记录,并开发了 pi-share-hf 工具帮助社区贡献数据。
8/16 Sakana AI 完成日本总务省反虚假信息系统开发
Sakana AI 与日本总务省合作,完成了面向社交媒体的虚假信息可视化、判定与对策系统开发。该系统利用 Novelty Search 等独有技术,实现了 SNS 空间可视化、综合判定与对策方案制定的全流程支持。这是 Sakana AI 近期国防与情报领域业务拓展的又一项目。
9/16 Ethan Mollick:2025 年大型企业几乎未见 GenAI 实质影响
Wharton 教授 Ethan Mollick 指出,整个 2025 年大型企业中可能都没有出现 GenAI 带来的重大工作变革——因为彼时缺乏智能体工具,采纳需要时间,大家还在摸索流程。但这种情况正在改变,2025 年的”无影响”研究并不能预测 2027 年的状况。他还将 LLM 智能体与组织理论类比:高能力代理成本高,因此委派必须有策略。
10/16 Gary Marcus 与 ML 教授就幻觉问题激辩
纽约大学教授 Gary Marcus 与一位 ML 教授展开长线论战:对方声称前沿推理模型的幻觉已”近乎为零”,但其自己提供的数据显示最佳幻觉率仍为 4.6%(基于已知基准测试)。Marcus 类比指出,商业航班事故率为 4100 万次飞行中 7 次,而 LLM 每 25 次提示就幻觉一次,两者不可同日而语。他同时批评 X 平台上反犹内容泛滥。
11/16 Francois Chollet:符号学习 vs 曲线拟合
Keras 创始人 Chollet 发文区分符号学习与曲线拟合:后者是对生成程序输出的有损近似记录,前者是无损地逆向工程生成程序的源代码。他观察到许多深度学习研究者从未接触过梯度下降以外的学习形式。他还指出 LRM(大推理模型)的崛起被那些坚信 base LLM 已能推理的人完全忽视了。
12/16 Karpathy 谈 LLM 辅助知识管理
Andrej Karpathy 分享了对 LLM 辅助知识管理的思考:核心观点是这种方式让你跳过写作但不能跳过阅读和思考——而令人惊讶的是这样居然有效。他个人通过阅读文件、阅读摘要、再阅读 LLM 对信息如何融入知识库的分析来处理大部分归档内容。
13/16 Runway 推出 Ad Concepter 应用
Runway 展示了 Ad Concepter 应用:仅用两张输入图片和一段简短的创意描述,即可生成完整的品牌短片。演示作品”Runaway Luggage”讲述了一个在机场传送带上无人认领的红色行李箱独自环游世界的故事,引发广泛关注。
14/16 Abacus.AI 预告 Agent Swarms 即将发布
Bindu Reddy 预告 Abacus.AI 本周将推出 Agent Swarms 功能:由主控智能体创建、管理和调整工作智能体,协同完成大型项目。整个 SaaS 应用可以通过智能体集群来构建,包括编码、测试、监控、运维和调试各环节的专门智能体。
15/16 Databricks 推出 coSTAR 自动化智能体测试框架
Databricks 发布 coSTAR,用自动化测试-优化循环替代手动智能体迭代:智能体在预定义场景中运行,MLflow 捕获执行跟踪,LLM 评估器打分,编码助手自动更新智能体直到通过测试。将验证周期从数周缩短到数小时。
16/16 Google AI 可提前 24 小时预测山洪
据 Rowan Cheung 报道,Google 新 AI 系统能提前 24 小时预测山洪。方法是用 Gemini 从全球新闻中提取已确认的洪水位置和时间,构建从未正式存在的历史数据集,再用神经网络结合遥感和气象数据进行预测。所有预测已在 Flood Hub 免费上线。
Deep Dive
Anthropic 与 Google、Broadcom 多吉瓦级 TPU 算力协议 Anthropic 与 Google 和 Broadcom 签署协议,获得多吉瓦级下一代 TPU 算力,预计 2027 年起陆续上线,绝大部分部署在美国。该公司年化收入突破 300 亿美元(2025 年底为 90 亿),年付费超百万美元企业客户超 1000 家(2 月为 500+)。此举延续了 2025 年 10 月扩大 Google Cloud TPU 容量和 11 月 500 亿美元美国 AI 基础设施投资承诺。Anthropic 在 AWS Trainium、Google TPU 和 NVIDIA GPU 上训练和运行 Claude,以优化不同工作负载。CFO Krishna Rao 表示这是公司”迄今最大规模的算力承诺,体现了扩展基础设施的审慎策略”。 查看原文
Windsurf Adaptive 智能模型路由器 Windsurf 4 月 6 日发布三项重大更新。Adaptive 是一个智能模型路由器,自动为每个任务选择最佳模型,同时避免过度消耗高端模型配额,使配额持续更长时间;推出两周内提供促销价格。重新设计的模型选择器在界面中显示精确的 token 定价,方便用户根据各模型相对成本规划使用。Max 用户取消每日限额,仅保留每周配额,用户可自由分配使用节奏。这些更新直接回应了社区对定价不透明和限制过严的批评。 查看原文