1/17 SpaceX + Cursor 达成 $60B 收购期权,联手构建下一代编程 AI
SpaceX 宣布与 AI 编程工具 Cursor 建立深度战略合作,并持有今年晚些时候以 600 亿美元收购 Cursor 的期权(或向 Cursor 支付 100 亿美元作为合作报酬)。双方将合并 Cursor 在顶级工程师中的产品分发优势,以及 SpaceX Colossus 超算(相当于 100 万块 H100 算力)进行联合模型训练。Cursor 已基于 xAI Colossus 基础设施训练其 Composer 系列模型,从 Composer 1.5 迭代至 Composer 2,每次算力升级均带来明显能力提升。该交易中,SpaceX 与 xAI 已于 2026 年 2 月合并(整体估值 1.25 万亿美元)。值得注意的是,目前 Cursor 仍依赖 Claude 和 GPT 等第三方模型,而 Anthropic 和 OpenAI 都在推出自己的编程工具,此次合作或是 Cursor 摆脱依赖的关键一步。
2/17 OpenAI 发布 ChatGPT Images 2.0:支持”思考模式”与多语言文字渲染
OpenAI 于 4 月 21 日发布 ChatGPT Images 2.0,核心升级包括:内置推理的”思考模式”(Think before drawing)、精准多语言及非拉丁文字渲染、幻灯片与信息图自动生成、多宽高比与分辨率支持,以及更强的指令跟随能力。标准版面向所有用户开放,思考模式仅限付费订阅者。该模型已在 ChatGPT、Codex 和 API 上线,与 Google Nano Banana 2 展开正面竞争。Ethan Mollick 等研究者在 Twitter 上发布了大量实测截图,展示其在生成书籍封面、图表、艺术图像等场景的能力提升,也指出编辑稳定性(多轮修改后易漂移)仍有改进空间。
3/17 Google Gemini Deep Research API 重大更新:支持 MCP、原生图表生成,推出 Max 模式
Sundar Pichai 宣布 Gemini API 中 Deep Research 功能迎来重磅升级:(1)标准版 Deep Research 现支持 MCP 协议,可接入 FactSet、S&P Global 等专有数据源;(2)新推出 Deep Research Max,基于 Gemini 3.1 Pro 构建,优先深度而非速度,采用扩展测试时计算;(3)原生图表与信息图生成能力,直接在报告中嵌入可视化内容;(4)基准测试:DeepSearchQA 达 93.3%,HLE 达 54.6%。两款产品均已通过 Gemini API 付费 Tier 公开预览,并将整合进 Google Cloud 企业版。
4/17 Kimi K2.6 演示极限 Coding Agent:13 小时自主重构金融撮合引擎,吞吐量提升 185%
Moonshot AI 展示了 Kimi K2.6 的两项长时程自主编程能力:其一,模型在 13 小时内自主重构了有 8 年历史的开源金融撮合引擎 exchange-core,发起超过 1000 次工具调用,修改逾 4000 行代码,通过分析 CPU Flame Graph 发现隐藏瓶颈并大胆重构线程拓扑(从 4ME+2RE 改为 2ME+1RE),最终将中位吞吐量从 0.43 提升至 1.24 MT/s(+185%)、峰值吞吐从 1.23 提升至 2.86 MT/s(+133%);其二,使用 Zig 这一小众语言在 Mac 本地部署并优化 Qwen3.5-0.8B 推理,12 小时 14 次迭代后将速度从 ~15 tokens/s 提升至 ~193 tokens/s,比 LM Studio 快约 20%。
5/17 Kimi Moonshot 开源 FlashKDA:Delta Attention 推理加速 1.72x–2.22x
Moonshot AI 宣布开源 FlashKDA,这是基于 CUTLASS 的高性能 Kimi Delta Attention(KDA)内核实现,在 H20 上相比 flash-linear-attention 基线实现 1.72×–2.22× 的预填充加速,可作为 flash-linear-attention 的即插即用后端替换。KDA 是 Kimi K2.6 核心架构中用于降低长上下文内存使用和提升生成速度的关键技术。
6/17 Windsurf 集成 Kimi K2.6,Pro/Teams/Max 用户免费试用 2 周
Windsurf 宣布 Kimi K2.6 现已在平台上线,Pro、Teams 和 Max 订阅用户可在接下来 2 周内免费使用。这是继 Cursor 之后,主流 AI 编程 IDE 中又一家集成 Kimi K2.6 的产品。
7/17 Databricks Unity AI Gateway:企业级 MCP 服务器治理,OAuth 全自动化
Databricks 宣布 Unity AI Gateway 现支持将 Agent 连接到 GitHub、Glean、Atlassian 等外部 MCP 服务器,全程通过 Unity Catalog 统一治理:细粒度权限控制与完整审计日志、代理以用户身份(而非超权服务账号)执行操作、Databricks 服务端自动处理全流程 OAuth(支持 AWS/Azure/GCP)。这解决了企业 Agent 部署中 Auth 一直以来的核心瓶颈。
8/17 Databricks Unity Catalog Business Semantics 正式 GA:AI Agent 与 BI 工具共享同一套指标定义
Databricks 宣布 Unity Catalog Business Semantics 正式 GA。该功能在数据层提供统一的指标、维度和业务规则定义,AI Agent、仪表盘和 Notebook 均从同一受治理的逻辑层获取一致的 KPI,支持血缘追踪、权限控制和性能优化。核心实现在 Apache Spark 中开源,保障跨系统的可移植性。
9/17 Scale AI 收购国防科技公司 ICG Solutions,强化实时流数据分析能力
Scale AI 宣布收购国防科技公司 ICG Solutions,后者专注于实时流数据分析,其 LUX™ 技术已被广泛部署于美国国防与情报体系。ICG 将作为 Scale 的全资子公司独立运营,以确保现有任务连续性。此次收购将 ICG 的实时流分析技术与 Scale 的 Agentic 平台整合,旨在为政府客户提供从原始数据到情境感知与 AI 决策的端到端情报解决方案。
10/17 Replit 荣获 Google Cloud 2026 年 AI 工具合作伙伴,推出 Startup 专项最高 $25K 算力补贴
Replit 宣布荣获 Google Cloud 2026 年度 AI 工具合作伙伴奖,同时上线”Replit for Startups”计划,向在平台上构建产品的初创公司提供最高 2.5 万美元算力补贴。Replit 目前已有超过 5000 万名开发者,并在 Twitter 上分享了其 CTO 关于 Vibe Coding 安全架构设计的思考。
11/17 Hugging Face 宣布在东京开设办公室,深化日本开源 AI 生态
Hugging Face 联合创始人 Lysandre Debut 宣布将在日本东京开设新办公室,目标是推动日本本地开源 AI 发展并扩展当地社区。Clement Delangue 同日暗示”Cursor 即将不再有 Claude?”(Countdown to no Claude in cursor?),引发社区对 Cursor 替换 Anthropic 模型路线的讨论。
12/17 Microsoft 推出 MAI-Voice-1 语音合成模型,效果以假乱真
Microsoft AI 发布 MAI-Voice-1 语音合成模型,展示了与真实录音难以区分的合成音频效果,由 Mustafa Suleyman(微软 AI CEO)转发推介。这一发布延续了微软在语音 AI 领域的持续投入,直接对标 ElevenLabs 等语音合成竞争对手。
13/17 Lyft 8 个 AI Agent 端到端解决 35% 客服问题
据 Harrison Chase(LangChain 创始人)转发,Lyft 已构建 8 个 AI Agent,能够端到端自主解决 35% 的客户问题,无需人工介入。这是大型消费互联网公司将 Agentic AI 落地客服的标志性案例之一。
14/17 苹果 CEO Tim Cook 宣布退休,Sundar Pichai 发文送别
Sundar Pichai 在 Twitter 上向退休的苹果 CEO Tim Cook 致敬,并表示期待与继任者合作。Tim Cook 在苹果任职超过 15 年,完成了 Apple Silicon 的战略转型。苹果新任 CEO 为 John(据 Pichai 推文推断)。
15/17 Cohere 发布技术报告:MoE 模型中的推测性解码更高效
Cohere 研究员 Ekagrna Ranjan 发布技术报告,揭示与直觉相悖的发现:MoE(混合专家)架构 LLM 实际上使推测性解码(Speculative Decoding)比密集模型更有效。报告分析了为何稀疏激活在 Draft-Verify 解码框架下具有天然优势,为 MoE 模型推理加速提供了新思路。
16/17 SakanaAI ICLR 2026:仅凭 Prompt,LLM 可生成高质量随机数
SakanaAI 在 ICLR 2026 发表论文,展示可通过特定 Prompt 引导 LLM 自主发展出哈希函数等随机数提取算法(如 Sum-Mod、Rolling Hash),在无外部工具的情况下生成高质量随机序列。研究发现推理模型”思考”越深入,生成字符串的复杂度越高、随机性越好。这一结果对 LLM 遵循概率性指令的能力具有理论与实用意义。
17/17 LlamaIndex ParseBench 新增 ChartDataPointMaster:首个 AI 图表数据点识别基准
LlamaIndex 宣布在 ParseBench(全球首个面向 AI Agent 的文档 OCR 基准)中新增 ChartDataPointMaster 子集,专门评测模型对图表中精确数据点的提取能力。这填补了此前文档理解基准对图表数值识别的空白,对构建能处理财报、科研文献等图表密集文档的 AI 系统有实际意义。
Deep Dive 附录
SpaceX + Cursor:$60B 收购期权背后的算力博弈
SpaceX(已与 xAI 合并,估值 1.25 万亿美元)与 AI 编程工具 Cursor 达成战略合作:双方将共同开发下一代编程与知识工作 AI,利用 SpaceX Colossus 超算(约 100 万块 H100 当量)大幅扩展 Cursor 的模型训练规模。协议核心条款:SpaceX 可选择在 2026 年晚些时候以 600 亿美元收购 Cursor,或仅支付 100 亿美元的合作费用。Cursor 当前估值已从 2025 年 1 月的 25 亿美元暴涨至此次隐含的 500 亿美元 pre-money。Cursor Composer 系列模型已从初始版本迭代至 Composer 2,每次算力升级均显著提升能力。值得关注的是,TechCrunch 指出 Cursor 目前仍依赖 Anthropic(Claude)和 OpenAI(GPT)的模型,而这两家公司都在推出自己的编程工具,此次合作标志着 Cursor 寻求算力和模型自主权的战略转向。 查看原文 查看原文 查看原文
Google Gemini Deep Research Max:深度研究 Agent 全面升级
Google 于 4 月 21 日推出 Deep Research 和 Deep Research Max 两款自主研究 Agent。Deep Research Max 基于 Gemini 3.1 Pro,优先深度而非速度,采用扩展测试时计算,在 DeepSearchQA 基准上达到 93.3%,HLE 达到 54.6%(均显著优于 2025 年 12 月版本)。关键新特性:(1)MCP 支持——可连接到 FactSet、S&P Global、PitchBook 等专业数据源;(2)原生图表生成——报告中直接嵌入 HTML 格式可视化内容;(3)多模态输入——支持 PDF、CSV、图片、音视频;(4)实时流式输出中间研究步骤;(5)协作式计划确认——在执行前与用户确认检索策略。两款产品均通过 Gemini API 付费 Tier 公开预览,并将通过 Google Cloud 向企业客户推出。 查看原文 查看原文
OpenAI ChatGPT Images 2.0:图像生成进入推理时代
OpenAI 于 4 月 21 日发布 ChatGPT Images 2.0(底层模型:gpt-image-2),最大突破是引入”思考模式”——模型在生成前会先推理、联网搜索、生成多个候选并自我核验。主要能力提升:精确多语言文字渲染(包括中文、阿拉伯文等非拉丁文字)、专业幻灯片和信息图生成(支持数据可视化布局)、多宽高比与分辨率控制、大幅提升的指令遵循精度。研究者 Ethan Mollick 实测显示其在书籍封面生成、数据图表制作方面已接近专业设计水平,但多轮编辑稳定性仍有不足(建议新对话重新开始而非在原对话继续修改)。标准版对所有用户开放,思考模式限付费订阅者,API 同步开放。 查看原文