AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0

OpenAI 上线 GPT-5.6 Sol 效率改进并重置 Codex 额度,SpaceXAI 发布新一代 Grok Voice 语音模型。行业方面,月之暗面完成 35 亿美元融资,AlphaFold 团队面临解散。

GPT-5.6OpenAISpaceXAIGrok VoiceCursor月之暗面AlphaFoldAI 模型开发者动态技术资讯
查看原文图标查看原文
AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0配图

概览

要闻

  • OpenAI 上线 GPT-5.6 Sol 效率改进并重置 Codex 用量限制 #1

模型发布

  • SpaceXAI 推出 Grok Voice Think Fast 2.0 语音模型 #2
  • Google DeepMind 发布音乐模型 Lyria 3.5 #3
  • SKT 发布 688B 参数开源大模型 A.X K2 及音频版本 #4

开发生态

  • Cursor 官方宣布 Cursor 登陆 iPad #5
  • 支付宝升级AI支付开发者激励计划 #6
  • Qoder 开源 AI 编程 Agent 评估工具 Better Harness #7
  • Perplexity 开源 Numbat:面向客户端终端的 Agent 安全检测与响应套件 #8

产品应用

  • OpenAI推出ChatGPT for Academic Researchers计划 #9
  • Google为macOS版Gemini应用推出全新自然语言语音功能 #10
  • Replit 推出全新 Replit Design AI 设计工具 #11
  • Hermes Agent 新增 Hey Hermes 语音唤醒词 #12

技术与洞察

  • OpenAI称两项API设置使GPT-5.6基准得分提升三倍 #13
  • OpenAI称应用GPT-5.6 Sol优化自身运行:服务成本降20% #14
  • 腾讯混元开源 AngelSpec 推测解码框架 #15
  • MiniMax 与 Fireworks AI 联合开源 M3 稀疏注意力 GPU 内核 #16

行业动态

  • 月之暗面完成35亿美元融资,投后估值达350亿美元 #17
  • AlphaFold 团队遭解散,近四分之一研究人员离开 Google DeepMind #18
  • SpaceXAI起诉要求阻止限制AI"裸化"技术新法生效 #19

要闻

OpenAI 上线 GPT-5.6 Sol 效率改进并重置 Codex 用量限制 #1

Codex 负责人 Tibo 于北京时间 7 月 29 日中午宣布,已为所有ChatGPT Work和Codex用户重置额度,并上线效率改进。针对Sol消耗额度过快的问题,此次改进优化了工具等待和网页搜索场景,预计典型使用时长延长约18%。与此同时,此前暂停的五小时限制即将恢复。值得注意的是,Tibo 随后又回复一名社区用户的请求,暗示将于当地时间 7 月 31 日再次执行用量重置。

Codex 负责人 Tibo 于北京时间 7 月 29 日中午宣布,已为所有ChatGPT Work和Codex用户重置额度,并上线效率改进。针对Sol消耗额度过快的问题。关于原因,Tibo说明了以下几点。GPT-5.6 Sol更愿意持续工作更长时间、发起更多工具调用,并协调跨工具和subagent的复杂工作流;在相同推理强度下比此前模型工作强度更大,High档位在Sol上消耗的token多于GPT-5.5上的High档位。编程式工具调用赋予Sol并行运行工具调用或在等待时继续工作的灵活性,但也导致每轮回复更多、缓存输入token更多、用量高于预期,这种情况在Sol等待工具调用完成或运行大量网页搜索时尤为明显。影响分布也不均匀:中位数用户实际认为Sol的token效率尚可,而一些处理更难任务的重度用户额度消耗快得多;团队在发布前过于关注平均和中位数用量,未充分考虑长尾情况。此次改进优化了工具等待和网页搜索场景,预计典型使用时长延长约18%。与此同时,此前暂停的五小时限制将于明日恢复。值得注意的是,Tibo 随后又回复一名社区用户的请求,暗示将于当地时间 7 月 31 日再次执行用量重置。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 要闻配图

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 要闻配图

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 要闻配图

相关链接:


模型发布

SpaceXAI 推出 Grok Voice Think Fast 2.0 语音模型 #2

SpaceXAI 推出新一代语音模型 Grok Voice Think Fast 2.0,官方称其在多项语音基准测试中得分显著提升。目前该模型已在 API 和 Voice Agent Builder 中可用。

SpaceXAI 发布新一代语音模型 Grok Voice Think Fast 2.0,重点改进了智能、转写准确率和会话能力。根据官方公布的数据,该模型在多项语音基准测试中得分显著提升,官方称其在嘈杂环境中的转写准确率表现优于专用语音转文本模型。该模型目前已在 API 和 Voice Agent Builder 中提供,定价为每分钟音频 0.08 美元。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 模型发布配图

相关链接:


Google DeepMind 发布音乐模型 Lyria 3.5 #3

Google DeepMind发布音乐生成模型Lyria 3.5并接入Google Flow Music平台。新版本提升了歌词质量与人声表现力,支持更复杂的旋律。

Google DeepMind 发布最新音乐生成模型 Lyria 3.5,目前该模型已正式接入 Google Flow Music 平台供用户使用。官方称,Lyria 3.5 带来了更丰富的编曲和复杂的旋律结构,生成更高质量的歌词,并显著提升了人声的表现力、情感细腻度与发音的自然度。在创作控制方面,新模型更好地遵循用户的创作指令,支持设定精确的 BPM 与控制时长,并允许导出完整歌曲的 stems。

相关链接:


SKT 发布 688B 参数开源大模型 A.X K2 及音频版本 #4

SKT发布了开源大语言模型A.X K2,总参数量688B,激活参数33B,采用原生FP8训练。同时推出A.X K2 ALM音频语言模型,其权重计划后续发布。

SKT发布了开源大语言模型A.X K2及其音频版本A.X K2 ALM。A.X K2采用MoE架构,总参数量达688B,激活参数量为33B,使用原生FP8精度进行训练,并支持最长256K上下文。官方称该模型在数学和韩语领域表现突出,并在IMO 2025测试中达到金牌门槛。目前,A.X K2的权重已在Hugging Face上以Apache-2.0协议开源。A.X K2 ALM音频模型基于冻结的A.X K2 Light骨干构建,目前尚未公开权重,官方称计划后续发布。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 模型发布配图

相关链接:


开发生态

Cursor 官方宣布 Cursor 登陆 iPad #5

Cursor 官方宣布 Cursor 已上线 iPad,具备 iPhone 版全部功能。iPhone 和 iPad 版同步新增 inbox 和完整 PR review 体验。

Cursor 官方宣布,Cursor 现已上线 iPad。iPad 版提供了与 iPhone 版相同的全部功能,并为用户提供了更多空间与 agents 进行协作。同时,iPhone 和 iPad 版均新增了用于保持条理的 inbox 功能,以及涵盖完整 PR 的 review 体验,该 review 体验支持查看评论、检查和批准。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 开发生态配图

相关链接:


支付宝升级AI支付开发者激励计划 #6

支付宝升级AI支付开发者激励计划,提供最高5660元Token专项补贴。即日起至8月21日,个人开发者集成指定收款产品即可参与。

支付宝宣布升级AI支付开发者激励计划,继续为AI开发者提供最高5660元的Token专项补贴,并进一步扩展激励享受范围与降低参与门槛。即日起至8月21日,个人开发者Vibe Coding时集成支付宝AI按量付费、AI网页应用收款或AI移动应用收款任一款收款产品,即可按累计有效交易用户数解锁分档激励。此外,个人开发者使用AI按量付费还能享受0费率优惠至2026年12月31日。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 开发生态配图

相关链接:


Qoder 开源 AI 编程 Agent 评估工具 Better Harness #7

Qoder开源了AI编程Agent评估工具Better Harness。它从任务理解等五个维度审查Agent工作流,生成带证据的报告和修复建议。

Better Harness 是 QoderAI 开发的 AI 编程 Agent 工作流评估工具,目前已在 GitHub 上以 MIT 协议开源。该工具通过任务理解、受控执行、变更验证、可靠交付和学习捕获五个维度审查项目,生成带证据的报告并将发现转化为优先修复建议。Better Harness 支持 Claude Code、Codex Desktop、Codex CLI、Cursor 和 Qoder。

相关链接:


Perplexity 开源 Numbat:面向客户端终端的 Agent 安全检测与响应套件 #8

Perplexity 开源了 Numbat,一个跨 Agent 框架的安全检测与响应层,支持安全团队实时监控 Agent 行为并在危险动作执行前拦截。

Perplexity 正式开源了 Numbat,一个面向客户端终端的 Agent 检测与响应安全套件。Numbat 跨桌面端、命令行、IDE 和网关 Agent 框架运行,通过集成 Agent 钩子子系统、会话产物和 OTLP 遥测数据,为安全团队提供实时监控、本地检测、执行前拦截和取证重建能力。Numbat 内置 52 条检测规则,覆盖 11 类行为,包括机密访问、数据外泄、权限提升和横向移动等多步骤序列检测。Perplexity 内部已使用 Numbat 保护工程师使用的 Claude Code、Codex、OpenCode 和 Pi 等编码 Agent。Numbat 目前在 Apache 2.0 许可下以单个 Go 二进制文件提供,支持 macOS、Linux 和 Windows。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 开发生态配图

相关链接:


产品应用

OpenAI推出ChatGPT for Academic Researchers计划 #9

OpenAI推出ChatGPT for Academic Researchers计划,向科学家、数学家和工程师免费提供其前沿模型的使用权限。该计划首批面向一万名研究人员,预计到2027年扩展至十万人。

OpenAI宣布推出名为“ChatGPT for Academic Researchers”的计划,旨在为科学、数学和工程领域的研究人员提供免费访问其前沿模型的机会。根据官方信息,该计划首批将覆盖一万名研究人员,并计划在2027年将规模扩大至十万人,主要针对选定学术机构的用户。官方表示,此举旨在帮助研究人员处理高级问题、加速科学发现并提高生产力。

相关链接:


Google为macOS版Gemini应用推出全新自然语言语音功能 #10

macOS版Gemini上线全新语音功能。用户长按Fn键即可进行智能听写,开启设置后还能结合屏幕上下文执行复杂任务,目前正面向全球英语用户推出。

Google正式宣布Gemini for macOS应用上线全新自然语言语音交互能力,允许用户通过语音进行内容创建、编辑和总结。在桌面任意窗口长按Fn键即可使用默认的智能听写功能,应用会自动过滤语气词并捕捉中途纠正,将格式化文本直接输出至光标处。若用户在设置中手动开启Gemini推理能力,应用便能理解当前屏幕上的上下文,并根据语音指令执行提取与总结本地文件、重写文本以及生成和编辑图像等复杂任务。该功能目前已向全球所有Gemini for macOS应用用户推出,当前仅支持英语,后续将增加更多语言支持。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 产品应用配图

相关链接:


Replit 推出全新 Replit Design AI 设计工具 #11

Replit 推出 AI 设计工具 Replit Design,现已向所有用户开放。该套件内置 Ambient Intelligence,支持一键应用品牌系统。

Replit 官方发布了全新的 AI 设计创意套件 Replit Design,目前该工具已全面上线。Replit Design 内置名为 Ambient Intelligence 的功能,在设计的每一步为用户提供可一键采纳的建议版本,用户无需输入提示词或掌握专业设计语言。在模型支持上,用户可以自由选择多款模型,并对比不同模型的输出结果。此外,该套件直接整合了 Mobbin 拥有的超过 60 万个真实应用 UI 界面,用户无需单独注册 Mobbin 账号即可调用。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 产品应用配图

相关链接:


Hermes Agent 新增 Hey Hermes 语音唤醒词 #12

Hermes Agent 推出本地语音唤醒功能。用户说出唤醒词即可免手启动新会话。该功能检测全程在本地进行,默认关闭。

Hermes Agent 正式推出语音唤醒功能,允许用户通过说出特定短语来免手启动新的语音会话。该功能支持命令行界面(CLI)、TUI 界面以及桌面应用。为确保隐私,唤醒词的检测过程完全在本地设备上运行,在用户说出实际指令前不会有任何音频离开设备。该功能目前默认关闭,且仅限于具备本地麦克风的界面使用。

相关链接:


技术与洞察

OpenAI称两项API设置使GPT-5.6基准得分提升三倍 #13

OpenAI发文称,启用保留推理和压缩两项API设置,使GPT-5.6 Sol在ARC-AGI-3基准测试的得分提高三倍至38.3%,且输出Token减少6倍。

OpenAI官方博客说明,通过为GPT-5.6 Sol启用保留推理和压缩两项设置,其在ARC-AGI-3基准测试的表现大幅提升。根据官方数据,该模型在最高配置下的得分从原先的13.3%升至38.3%,提升约三倍,输出Token减少6倍。OpenAI指出,此前测试工具的丢弃推理和滚动截断机制导致了低分。官方建议API开发者使用其Responses API中的相同设置以最大化性能。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 技术与洞察配图

相关链接:


OpenAI称应用GPT-5.6 Sol优化自身运行:服务成本降20% #14

OpenAI 发文介绍其应用GPT-5.6 Sol优化自身运行基础设施的过程,通过重写生产核心和改进推测解码,服务成本降低20%,token生成效率提升超15%。目前优化已用于推理堆栈和Agentic harness。

OpenAI发布了关于GPT-5.6模型家族的效率更新的文章。官方表示,他们已在Codex中应用旗舰模型GPT-5.6 Sol来优化自身的基础设施和性能。根据官方数据,通过使用Triton和Gluon语言重写生产核心,该模型使端到端服务成本降低了20%;通过改进推测解码,使token生成效率提升了15%以上。目前这些优化已应用于OpenAI的推理堆栈和由Codex及ChatGPT Work使用的Agentic harness中。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 技术与洞察配图

相关链接:


腾讯混元开源 AngelSpec 推测解码框架 #15

腾讯混元团队开源了 AngelSpec 推测解码框架,支持训练与部署。官方称其在 {Hy|混元}3-A21B 上可实现最高 2.4 倍的端到端加速。

腾讯混元团队宣布开源端到端推测解码框架 AngelSpec,并发布了 v0.1.0 版本。该框架基于 torch-native,支持 MTP 和 block-parallel 推测解码训练,统一了 DFly、DFlash 等 6 种草稿架构的训练管线。官方数据显示,在 Hy3-A21B 模型和并发级别 4 到 64 的测试中,DFly 架构相比自回归解码实现了 1.98 至 2.40 倍的端到端加速,吞吐量比 DFlash 高出 10.5% 到 11.8%。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 技术与洞察配图

相关链接:


MiniMax 与 Fireworks AI 联合开源 M3 稀疏注意力 GPU 内核 #16

MiniMax 与 Fireworks AI 联合开源了两个面向 MiniMax M3 {块稀疏注意力|"块稀疏注意力"}的 GPU 内核仓库。

MiniMax 与 Fireworks AI 将双方合作开发的 MiniMax M3 块稀疏注意力 GPU 内核代码开源,两个仓库现已公开。fw-ai/minimax-kernels 由 Fireworks AI 开发,基于 NVIDIA Blackwell(SM100)CuTe-DSL 实现 KV-outer 块稀疏注意力,采用 Apache 2.0 许可证。MiniMax-AI/MSA 的 fireworks-msa 分支在原有 MSA 内核基础上集成了 Fireworks 的 KV-outer 稀疏预填充后端,采用 MIT 许可证。

AI 早报 2026-07-30 — OpenAI 上线 GPT-5.6 效率改进、SpaceXAI 推出 Grok Voice 2.0 - 技术与洞察配图

相关链接:


行业动态

月之暗面完成35亿美元融资,投后估值达350亿美元 #17

据报道,月之暗面已完成35亿美元融资,投后估值达350亿美元。报道称,该公司正以500亿美元投前估值接触投资者,计划最快今年赴港上市。

据彭博社报道,月之暗面已完成35亿美元融资,远超原定10亿至20亿美元目标,投后估值达350亿美元。报道指出,本轮融资得益于月之暗面Kimi K3模型在硅谷引发的轰动效应。知情人士还表示,公司目前已开始接触潜在投资者,寻求以500亿美元投前估值进行新一轮融资,这将是其赴港上市前的最后一轮融资,IPO最快有望于今年完成。

相关链接:


AlphaFold 团队遭解散,近四分之一研究人员离开 Google DeepMind #18

据报道,Google DeepMind解散了AlphaFold团队,近四分之一研究员离职,多数人转入Gemini项目或Isomorphic Labs。

据媒体报道,Google DeepMind 已经解散了负责蛋白质折叠的 AlphaFold 团队。在过去一年中,大多数原论文作者被重新分配到围绕 Gemini 大语言模型的项目,或者转入专注于药物发现的 Isomorphic Labs。Google DeepMind 研究副总裁 Pushmeet Kohli 证实实验室战略已发生演变,目前正转向开发能协助科学家的系统,并与 OpenAI 和 Anthropic 竞争构建前沿 AI 智能体。此外,近四分之一的原作者已完全离职,其中包括加入 Anthropic 的核心成员 John Jumper。

相关链接:


SpaceXAI起诉要求阻止限制AI"裸化"技术新法生效 #19

据报道,SpaceXAI在美国联邦法院起诉明尼苏达州总检察长,要求阻止{限制AI"裸化"技术的新法|"限制AI"裸化"技术的新法"}生效。该公司认为法律范围过宽,未提供免责机制。将迫使其限制Grok Imagine功能。

据报道,SpaceXAI已在美国联邦法院起诉明尼苏达州总检察长基思·埃里森,要求阻止该州限制人工智能"裸化"技术(nudification technology)的新法律生效。该法律即众议院第1606号法案(H.F. 1606),定于2026年8月1日生效,禁止网站、应用等服务的所有者允许用户使用裸化功能,违规者每次行为最高面临50万美元民事罚款及私人诉讼责任。SpaceXAI表示不反对禁止色情深伪影像,但认为法律范围过宽,未为采取合理措施的平台提供免责机制,可能覆盖经过同意或具有表达价值的影像。公司称该法将迫使其限制Grok Imagine的图像生成和编辑功能,主张该法违反美国宪法第一修正案。

相关链接:


提示:内容由AI辅助创作,可能存在幻觉错误


查看网页全文 · 查看 Markdown