AI Frontier Daily / 2026.04.18

xAI 正式发布 Grok 4.3 Beta

Elon Musk 宣布 Grok 4.3 进入早期公测阶段,并向所有用户免费开放 48 小时。新版本新增多项文件创建能力,包括生成幻灯片、电子表格、PDF 及 Word 文档,同时支持视频输入与音频提取。Elon 强调这是”better-than-nothing early beta”,将快速迭代更新。xAI 团队今天的推广力度极大,Grok 4.3 系列推文单条阅读量突破 200 万。

1/18 xAI 正式发布 Grok 4.3 Beta

Elon Musk 宣布 Grok 4.3 进入早期公测阶段,并向所有用户免费开放 48 小时。新版本新增多项文件创建能力,包括生成幻灯片、电子表格、PDF 及 Word 文档,同时支持视频输入与音频提取。Elon 强调这是”better-than-nothing early beta”,将快速迭代更新。xAI 团队今天的推广力度极大,Grok 4.3 系列推文单条阅读量突破 200 万。

2/18 xAI 1T 参数模型训练进入冲刺阶段

Elon Musk 透露,SpaceXAI 工厂内的 1 万亿参数 Grok 模型距完成初始训练约剩 5 天。他表示该模型将在编程、长上下文处理和专业技能方面实现”重大跃升”。目前运行的 Grok 4.3 仍为 5000 亿参数的更新检查点。Elon 称 SpaceXAI 模型工厂现已稳定运转,计划每约两周交付一个改进版本基础模型。

3/18 xAI 推出 Grok 语音转文字 API

xAI 官方宣布 Grok 的语音转文字 API 正式上线,支持 25 种语言的即时多说话人转录,官方声称定价为市场最优。新 API 基于 Grok 模型能力,强调低延迟和高准确率。这是 xAI 继 Grok 4.3 之后当天的第二项重要产品发布,显示 xAI 正在快速扩展其 API 产品线。

来源@xai

4/18 Anthropic Opus 4.7 自适应思考大幅改善

AI 研究者 Ethan Mollick 报告称,Anthropic 对 Opus 4.7 Adaptive Thinking 进行了重要更新,模型现在会更频繁触发深度思考,包括此前失败的任务。更新后还会调用更多 Web 搜索。Mollick 表示在非编程任务上看到了”大幅提升的输出质量”。此前他曾发布 Opus 4.7 用 max thinking 生成互动式三维巴别塔的演示,单条推文阅读量近 8 万次。

来源@emollick12

5/18 Claude Dev 账号 24 小时涨粉 25 万

创作者 Linus Ekenstam 观察到,Anthropic 的 Claude Dev X 账号在短短 24 小时内获得 25 万关注者,引发广泛讨论。他同时表示”Anthropic 正在对所有人展开攻势,如果 Claude Design 像 Claude Code 一样流行,这就成了定局。”当天多位知名创作者分享了 Anthropic 相关产品的使用体验,Anthropic 的生态影响力持续扩展。

来源@LinusEkenstam12

6/18 OpenAI Codex 全面开放:开源、计算机控制、图像生成

OpenAI 总裁 Greg Brockman(@gdb)持续推广 Codex 的多项新能力:Codex 已开源,任何人均可基于其构建应用;Computer Use 功能获好评,用户已实现 Codex 发送 Slack 消息、查阅书签等操作;图像生成功能”容易被低估但相当强大”;Codex 还新增主动建议功能。本周末 Cursor 将 Composer 2 用量上限翻倍,与 Codex 形成正面竞争。

来源@gdb12@cursor_ai

7/18 OpenAI 重磅新模型即将发布,Bill Peebles 离职

业内观察者 bindureddy 表示正在倒计时等待 OpenAI 新模型发布,据传该模型将”统治世界”,若定价合理将使 OpenAI 强势回归。与此同时,Sam Altman 为 Bill Peebles(OpenAI 生成媒体负责人)送别,称”你的创造力推动了 AI 视频新边界。”多位知名人士随后致意,显示 Peebles 在 AI 视频生成领域的重要地位。

8/18 Cursor 本周末 Composer 2 用量翻倍

Cursor 宣布在本周末期间(通过新 Agents 窗口)将 Composer 2 的使用上限临时翻倍,并邀请用户下载最新版 Cursor 体验。这一举措被解读为应对 OpenAI Codex 和其他 AI 编程工具竞争的直接回应,也是近期 AI 编程助手激烈竞争的缩影。

9/18 Google Gemini 3.1 Flash 文字转语音正式上线

Google AI Studio 宣布 Gemini 3.1 Flash 的文字转语音功能已在 AI Studio 上线,支持控制具体的声音表现,如停顿节奏、语气等。这是 Google 在 TTS 领域的重要产品更新,GoogleDeepMind 官方账号第一时间转发了这一消息。

10/18 Databricks:为编程 Agent 蔓延建立统一治理

Databricks 发布 Unity AI Gateway 的编程 Agent 治理支持,针对企业内 Cursor、Gemini CLI、Codex 等工具并存导致的”Agent 蔓延”问题提供解决方案。三大核心价值:统一安全审计(MCP 访问集中管控)、统一成本管理(单一账单,覆盖 OpenAI/Anthropic/Gemini 等模型)、全面可观测性(跨部门使用数据接入数据湖)。Databricks 警告 MCP 可能使 Agent 成为”组织内权限最高的开发者”。

11/18 Databricks Genie Agent Mode:像数据分析师一样调查数据

Databricks 同日推出 Genie Agent Mode,区别于传统 Genie 返回单一查询结果,Agent Mode 模拟数据分析师的工作方式:提出假设、执行多轮查询、迭代分析,最终生成含可视化和 SQL 引用的综合报告。适用于”为什么 Q3 流失率飙升?”等复杂问题,支持自动调整推理深度,并提供完整的透明可验证输出。

12/18 Runway Seedance 2.0 登陆 iOS,发起 $10 万大赛

Runway 宣布 Seedance 2.0 正式登陆 iOS 应用,首次订阅最高享半价优惠。同时启动”Big Pitch”创意大赛,面向所有创作者征集”你希望存在的节目”创意,提供 10 万美元奖金,入口码 RUNWAY50 可再享额外折扣。Luma Labs AI 同日分享了其”Hybrid Production”混合制作工作流,展示了 AI 与实拍无缝融合的未来影视拍摄方式。

来源@runwayml12

13/18 MIT 开发 AI 腕带:用超声波读取肌肉信号控制机器人

MIT 工程师推出 AI 腕带,通过超声波扫描手腕肌肉和肌腱图像,AI 算法将图像转化为五根手指 22 个自由度的精确位置,实现机器人精准控制。这一非侵入式接口有望彻底改变人机交互方式,尤其在假肢、远程操控和辅助技术领域具有重要应用前景。

来源@rowancheung12

14/18 论文:LLM 权重可在推理时即时更新(无需重新训练)

研究人员提出 In-Place Test-Time Training 技术,允许大语言模型在运行过程中直接更新自身权重,无需完整重训练。核心思路:将每个 MLP 模块中已有的矩阵重新用作”快速权重”,使模型能够在推理时吸收新知识。这一突破有望显著提升模型的实时适应能力和个性化能力。

15/18 Replit Agent 引入并行任务与上下文感知建议

Replit 宣布其 Agent 4 支持并行代理:可同时启动项目的多个副本并行工作,最后合并结果并自动处理冲突。新功能还支持基于完整项目上下文自动提议后续任务(新功能建议、性能优化、用户体验改进),用户选择后即可自动执行。这是 Replit 在 AI 编程体验上的重要架构升级。

16/18 Elon Musk 提出”普遍高收入”以应对 AI 失业

Elon Musk 发表观点:应对 AI/机器人导致失业的最佳方式是联邦政府直接发放”普遍高收入”(Universal High Income),并论证 AI 将大幅提升商品和服务产出,因此不会引发通货膨胀。该推文获超 16.5 万点赞、5100 万次浏览,是当天传播最广的 AI 相关讨论之一,引发了关于 AI 时代财富分配的广泛辩论。

17/18 emollick:AI 基准测试质量问题引发讨论

Wharton 教授 Ethan Mollick 批评了当前 AI 基准测试的质量问题,特别点名 Artificial Analysis 报告的 GDPval-AA 分数——该指标使用 Gemini 3.1 评判其他模型在 GDPval 公开题目上的表现,Mollick 认为”完全不能说明任何问题”。他呼吁行业提供更可靠的 AI 能力评测指标,而非可轻易操控的输出分数。GDPval 本身因使用专家评审、平均每题耗时一小时而获得认可。

来源@emollick12

18/18 Hugging Face 征集大型机器人数据集 Beta 测试用户

Hugging Face CEO Clément Delangue 宣布正在为新的机器人数据集托管功能寻找 Beta 测试用户,目标是当前正在托管大型机器人数据集的团队。这一举措延伸了 HF 在 AI 基础设施领域的布局,显示其正将平台能力从传统模型/数据集托管扩展至机器人领域。


Deep Dive 附录

Databricks:Unity AI Gateway 统一治理编程 Agent

随着企业内 Cursor、Gemini CLI、Codex 等工具并存,Databricks 识别出三大核心问题:安全风险(MCP 可能使 Agent 成为组织内权限最高的开发者,访问敏感数据)、成本爆炸(AI 工具成本正成为研发最大支出之一)、可视性盲区(管理层无法追踪各团队实际使用情况)。Unity AI Gateway 解决方案:统一安全审计(所有 MCP 访问集中追踪,日志存入 Unity Catalog)、统一成本管理(支持 OpenAI/Anthropic/Gemini 等主流模型,管理员可设置跨工具总费用上限)、全面可观测性(按部门追踪采用率,关联 AI 工具使用与业务产出)。官方声明目标是”在提升 AI 生产力的同时确保数据隐私和成本可视性”。 查看原文

Databricks Genie Agent Mode:数据分析师式多步推理

传统 Genie 返回单次查询结果,Agent Mode 则模拟完整分析师工作流:接收复杂问题(如”为何 Q3 流失率飙升”)→ 制定分析计划 → 提出假设 → 多轮查询验证 → 迭代推理 → 生成含图表和 SQL 引用的综合报告。系统会根据问题复杂度动态调整推理深度,简单问题快速响应,复杂问题深入分析。透明度方面,所有分析过程对用户完全可见,可验证底层数据和逻辑。目前已集成到 Genie 空间和 AI/BI Dashboard 中。 查看原文

xAI Grok 4.3 Beta:功能概览

Grok 4.3 本次更新重点在于扩展文档生成能力(幻灯片、电子表格、PDF、Word)和多媒体处理(视频输入、音频提取),Elon 本人和 xAI 官方账号集中发布多条推文展示功能演示。Elon 反复强调”这只是早期 Beta,每天都在改进”,设定预期管理。48 小时免费开放是典型的流量拉新策略。与此同时,xAI 还推出了独立的 Speech-to-Text API(25 语言,多说话人,市场最低定价),以及透露中的 1T 参数模型将在约 5 天后完成初始训练。三项消息同日发布,显示 xAI 正在进行一次集中的产品节奏冲刺。 查看原文