AI Frontier Daily / 2026.03.28

Anthropic"Claude Mythos"数据泄露:比 Opus 4.6"显著更强"的新旗舰模型曝光

Anthropic 内容管理系统配置失误,意外将草稿博文公开暴露,披露了代号”Mythos”(又称 Capybara)的新一代旗舰模型的存在。泄露文件显示该模型在代码、学术推理、网络安全测试上均比 Claude Opus 4.6 取得”显著更高分数”,被 Anthropic 描述为”迄今构建的最强大模型”,代表”能力的阶跃”。文件同时警告该模型在网络安全方面”远超其他任何 AI”,并担忧其”可能助力大规模网络攻击”。Anthropic 确认模型正在部分早期用户中试用,因运行成本高昂暂未对外发布,计划先向网络安全防御机构开放。社交媒体流传”10 万亿参数”说法,Anthropic 未予证实。

1/15 Anthropic”Claude Mythos”数据泄露:比 Opus 4.6”显著更强”的新旗舰模型曝光

Anthropic 内容管理系统配置失误,意外将草稿博文公开暴露,披露了代号”Mythos”(又称 Capybara)的新一代旗舰模型的存在。泄露文件显示该模型在代码、学术推理、网络安全测试上均比 Claude Opus 4.6 取得”显著更高分数”,被 Anthropic 描述为”迄今构建的最强大模型”,代表”能力的阶跃”。文件同时警告该模型在网络安全方面”远超其他任何 AI”,并担忧其”可能助力大规模网络攻击”。Anthropic 确认模型正在部分早期用户中试用,因运行成本高昂暂未对外发布,计划先向网络安全防御机构开放。社交媒体流传”10 万亿参数”说法,Anthropic 未予证实。

2/15 OpenAI Codex 正式推出插件(Plugins)系统

Greg Brockman(@gdb)宣布插件功能在 Codex 中正式可用。插件将可复用工作流打包为”技能(Skills)+ 应用集成(Apps)+ MCP 服务”三合一组件,支持 Box、Figma、Linear、Notion、Sentry、Slack、Gmail、Google Drive、HuggingFace 等主流平台。用户可在 /plugins 目录浏览并安装,也可通过 @ 语法直接调用。支持自定义插件共享,可跨团队/项目同步,预计将显著提升 Codex 作为 AI 编程助手的生态扩展能力。

来源@gdb

3/15 Meta SAM 3.1 发布:视频处理效率大幅提升

Meta AI 发布 SAM 3.1,作为 SAM 3 的”直接替换升级版”(drop-in update),引入对象多路复用(object multiplexing)技术,在不牺牲精度的前提下显著提升视频处理效率。主要面向在较小设备上运行高性能应用的开发者。团队表示该更新专为社区开放,旨在降低高质量视频分割的算力门槛。此次更新获得 HuggingFace CEO Clément Delangue 转推推广。SAM 3 此前在 LVIS 数据集零样本分割任务上达到 47.0,较前 SOTA 的 38.5 大幅领先。

4/15 Stargate Michigan 首批钢梁落地:OpenAI 与 Oracle 合建超大算力中心

Sam Altman 宣布,Stargate 项目在密歇根州的基地(与 Oracle 及 Related Digital 合作)本周完成首批钢结构施工。Stargate 是 OpenAI 牵头、联合软银、Oracle 共同投资的 AI 基础设施项目,计划投入 5000 亿美元打造全美 AI 算力网络。密歇根站点的开工标志着 Stargate 向全国多地部署的计划正在加速落地,预计将成为美国最大规模 AI 数据中心集群之一。

来源@sama

5/15 微软+Crusoe 宣布 900MW 德州 AI 工厂:OpenAI 退出后微软接手

Crusoe 宣布在德克萨斯州阿比林(Abilene)新建 900MW AI 工厂园区,微软为主要客户。该项目原本由 OpenAI 参与规划,OpenAI 退出后由微软接盘。两栋新建筑+配套自建发电厂(900MW 背后电源,含电池储能)将于 2027 年中期首批通电。结合 Crusoe 现有阿比林基础设施,整个园区总规划容量将达 2.1GW。Mustafa Suleyman(Microsoft AI 负责人)称这是为微软 AI 舰队扩充更多产能的重要里程碑。

6/15 Perplexity 入驻三星浏览器:Galaxy 手机及 Windows PC 全面整合

Perplexity 官宣其 AI 搜索现已为三星浏览器(Samsung Browser)的 Browsing Assist 功能提供支持,覆盖 Galaxy Android 设备及 Windows(10/11)PC 版。Perplexity 接入后支持理解当前页面内容、跨标签搜索、视频定位等功能,用户可用自然语言提问并获得多源汇总答案。跨设备连续功能(Galaxy 手机→Windows PC 无缝切换)同步上线。agentic AI 功能目前限美国和韩国。

7/15 Hermes Agent + HuggingFace:开源自增长代理生态提速

NousResearch 的开源 AI 代理 Hermes Agent 宣布将 HuggingFace 接入为第一方推理提供商(first-class inference provider)。Hermes Agent 以”会成长的代理”著称——具备多层记忆系统,能跨会话学习用户偏好,解决难题后自动生成技能文档。可自托管于 5 美元/月 VPS,内置 40+ 工具,支持 Telegram/WhatsApp/Slack 等多渠道交互。Clément Delangue(HuggingFace CEO)同时呼吁开放更多 agent traces 数据集,并宣布 HuggingFace 后续将接入 5 万个推理提供商模型和 300 万 HF 模型。

来源@ClementDelangue12

8/15 LeCun 发布 LeWorldModel:首个不会崩溃的端对端 JEPA 世界模型

Yann LeCun 团队(Meta FAIR/MILA/AMI Labs)发布论文 LeWorldModel(LeWM),实现首个可直接从原始像素端到端训练、不会”表征崩溃”的 JEPA(联合嵌入预测架构)。该模型仅 1500 万参数,可在单张 GPU 上训练数小时,规划速度比基于大型基础模型的世界模型快最高 48 倍,同时在多种 2D/3D 控制任务上保持竞争力。技术关键:仅用两个损失函数(预测损失 + 高斯正则化)实现稳定训练,无需复杂启发式规则。

9/15 Meta TRIBE v2:用 AI 预测人类大脑响应,覆盖视觉/听觉/语言三模态

Meta FAIR 发布 TRIBE v2(Trimodal Brain Encoder),一个基于 500+ 小时 fMRI 数据(来自 700+ 健康被试)训练的基础模型,能够高精度预测人脑对几乎任何视觉、听觉和语言刺激的响应。相比 Algonauts 2025 获奖前作,分辨率提升 70 倍。模型展现对数线性 scaling 规律,且无性能瓶颈迹象。可对新被试、新语言、新任务进行零样本预测。模型权重、代码、论文和在线演示已以 CC BY-NC 许可开放,面向神经科学研究社区。

10/15 Unitree 开源 UnifoLM-WBT-Dataset:全身远程操控机器人数据集

Unitree Robotics 宣布开源 UnifoLM-WBT-Dataset,这是一个真实世界中人形机器人全身远程操控(Whole-Body Teleoperation)数据集,场景覆盖广、任务复杂度高,自 2026 年 3 月 5 日起公开,并持续高频更新。数据集在 HuggingFace 的 unitreerobotics 组织下可访问,与 Unitree 的开源机器人学习生态系统配套,旨在推动开放环境下人形机器人具身智能研究。

11/15 ChatGPT 帮宠物主人研发 mRNA 疫苗,Sam Altman:LLM 赋予个人研究机构级能量

Sam Altman 分享了本周最令他印象深刻的故事:一位叫 Paul 的用户借助 ChatGPT 和其他 LLM,为爱犬 Rosie 制定了一套 mRNA 疫苗方案,成功挽救了狗狗的生命。Paul 本人形容,”AI 聊天机器人让我一个人拥有了研究机构的力量——规划、教育、协助我和我的兽医共同工作”。Altman 称这是”令人惊叹的故事”,体现了 AI 工具对普通人的赋能效应。

来源@sama

12/15 Claude Code 新技能:一句话克隆任意网站

Linus Ekenstam(@LinusEkenstam)介绍了一个开源 Claude Code 技能,使用 /clone-website 命令即可指向任意 URL,由 Claude 自动分析并重建该网站。这一工具展示了 Claude Code 技能生态的扩展潜力——用户可以自定义复杂工作流并通过斜杠命令一键调用,无需编写复杂脚本。

13/15 Together Research:小模型分治策略可匹敌 GPT-4o 长上下文表现

Together AI 发表研究论文(已被 ICLR 2026 接收),展示了在长上下文任务中,使用”分治”(divide & conquer)策略的小模型,可达到甚至超越 GPT-4o 单次推理的性能。该方法将长文档分割处理后再汇总,显著降低了对超大上下文窗口的依赖,具有明显的成本优势。

14/15 Luma Labs Uni-1:具备世界知识的智能视觉生成模型

Luma Labs 持续展示新发布的 Uni-1 模型。Uni-1 可将世界知识和视觉合理性应用于场景补全,以上下文感知的方式生成真实感强的画面;同时支持跨风格变体同时保持主体身份一致。目前已在 Luma 网页端开放体验,面向广告、影视、创意制作等多个场景。

来源@LumaLabsAI12

15/15 Gary Marcus:大量美国人感到被”强行推入”AI 未来,行业需认真对待公众情绪

Gary Marcus 引用《纽约时报》报道,指出”许多美国人对 AI 持负面看法,感到自己正被强迫走向一个他们既未要求、也不想要的未来”。Marcus 认为 AI 行业若继续无视公众关切、缺乏透明度,只会加剧这种对抗情绪。他同时转推了 GitHub 用户隐私设置提醒(关闭允许 GitHub 用 AI 训练代码的选项)以及一项研究表明 AI 模型确实在记忆训练数据的论文。


Deep Dive 附录

Anthropic Claude Mythos / Capybara — 意外泄露的超强旗舰模型

Anthropic 内容管理系统配置错误导致草稿内容被公开访问,披露代号”Mythos”(或”Capybara”)的新模型。文件称其在代码、学术推理、网络安全测试中均”显著优于”Claude Opus 4.6,是”迄今最强大”模型,代表”能力的阶跃”。关键警告:Anthropic 内部认为该模型在网络安全方面”远超所有其他 AI”,并担忧可能”助力大规模网络攻击”,引发前所未有的安全顾虑。当前仅对网络安全防御者等小范围早期用户开放,因运营成本高昂尚未大规模发布,计划先提升效率再普及。社交媒体流传”10 万亿参数”,Anthropic 未证实,属未经核实的推测。 查看原文 查看原文

OpenAI Codex Plugins — AI 编程助手的插件生态系统

插件将”技能(Skills)+ 应用集成(Apps)+ MCP 服务器”打包为可复用工作流,一次安装即可跨项目/团队共享。首批官方插件覆盖:Box、Figma、Linear、Notion、Sentry、Slack、Gmail、Google Drive、HuggingFace 等。技能文档可被 Codex 按需渐进发现;应用集成提供 GitHub、Google Drive 等读写权限;MCP 服务器提供外部工具和共享上下文。用户可通过自然语言描述任务(Codex 自动选择工具),也可用 @ 语法直接调用特定插件。 查看原文 查看原文

Meta TRIBE v2 — 预测人脑神经活动的多模态基础模型

TRIBE v2 架构:三个冻结基础模型(LLaMA 3.2 处理文本、V-JEPA2 处理视频、Wav2Vec-BERT 处理音频)作为特征提取器,配合时序 Transformer 和个体特异性预测模块。训练数据:700+ 健康被试的 500+ 小时 fMRI 录制。关键指标:分辨率相比 Algonauts 2025 版本提升 70 倍;零样本预测新被试的准确率有时超过单个人类被试的实际录制值;展现对数线性 scaling 规律,无瓶颈迹象。应用:计算替代部分人类实验、加速神经学疾病研究。已以 CC BY-NC 许可开源(权重/代码/论文/在线 Demo)。 查看原文

LeCun LeWorldModel — 终结表征崩溃的极简 JEPA 世界模型

LeWorldModel(LeWM)是首个可从原始像素端到端稳定训练的 JEPA(Joint-Embedding Predictive Architecture)。此前此类架构普遍存在”表征崩溃”问题——损失函数收敛到平凡解,无法学习有意义的物理世界表征。LeWM 仅用两个损失函数(下一步嵌入预测损失 + 高斯分布正则化约束)解决了这一问题。规模极小:1500 万参数,单 GPU 数小时可训练完成;规划速度比基础模型版本快最多 48 倍;在多种 2D/3D 控制任务上保持竞争性性能。由 LeCun 团队(Meta FAIR + MILA + AMI Labs)于 2026 年 3 月发布。 查看原文

微软 + Crusoe 900MW AI 工厂(德克萨斯阿比林)

Crusoe 宣布在阿比林新建 900MW AI 工厂园区,微软为主要客户。背景:OpenAI 此前放弃了该扩建项目,微软随后接手,毗邻 OpenAI 与 Oracle 现有算力基础设施。项目规格:两栋超高密度计算建筑 + 900MW 背后电源自建发电厂(含电池储能,闭环非蒸发式液冷)。时间线:土地清整已开始,首栋建筑预计 2027 年中期通电。叠加现有容量后,阿比林全站预计总容量达 2.1GW。 查看原文 查看原文