AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5

DeepSeek V4 Flash 正式版 API 上线公测,Agent 能力显著提升;字节跳动发布 Seedance 2.5,将单次视频生成时长提升至 30 秒。此外,华为开源 5050 亿参数模型,特斯拉车机引入豆包语音助手。

DeepSeek V4 FlashSeedance 2.5Qwen Audio 3.0华为 openPangu特斯拉豆包GPT 5.4MiniMax Hub商汤 SenseNova
查看原文图标查看原文
AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5配图

概览

要闻

  • DeepSeek-V4-Flash 正式版 API 上线公测 #1
  • 字节跳动Seed正式发布Seedance 2.5,单次视频生成时长提升至30秒 #2

开发生态

  • ChatGPT桌面应用支持点击宠物快捷启动语音模式 #3
  • Google AI Studio 取消独立移动 App,整合进 Gemini 应用 #4
  • GPT-5.4 系列将于 8 月 31 日从 Codex 中下线 #5
  • Nous Research 发布首个官方 Hermes Desktop 插件 Kanban 及配套插件 SDK #6

模型发布

  • 千问发布Qwen-Audio-3.0-ASR-Flash语音识别大模型 #7
  • 美团发布 LongCat-Flash-Lite-Sparse,采用全新稀疏注意力框架 #8
  • 商汤开源发布 SenseNova-U1.5-8B-MoT 预览版 #9
  • LG AI研究院发布开源模型K-EXAONE 2.0 #10
  • 华为开源 openPangu-2.0-Pro 模型,总参数达 5050 亿 #11

产品应用

  • MiniMax 上线 MiniMax Hub 并推出 Media Plan 订阅方案 #12

行业动态

  • Google Earth AI生图功能上线一天后被撤回 #13
  • 特斯拉推送车机更新,引入豆包大模型语音助手 #14

技术与洞察

  • 数学家称 GPT-5.6 Sol 找到麦克斯韦猜想反例 #15

要闻

DeepSeek-V4-Flash 正式版 API 上线公测 #1

DeepSeek 宣布 DeepSeek-V4-Flash 正式版 API 上线公测。目前仅 API 端更新,App 和网页端模型保持不变,同时模型权重已在相关平台开放。该模型相较预览版在架构与参数规模上一致,仅重新进行了后训练,Agent 能力大幅提升,多项 Agent 基准成绩大幅超过 V4-Pro-Preview。同时,该模型原生支持 Responses API 且适配 Codex。此外,官方称 DeepSeek-V4-Pro 正式版也将尽快发布。

DeepSeek宣布,DeepSeek-V4-Flash正式版API已上线公测。正式版模型ID为DeepSeek-V4-Flash-0731,模型结构和尺寸与DeepSeek-V4-Flash-preview保持一致,仅重新进行了后训练。根据官方数据,正式版在多项Agent基准测试中远超V4-Pro-Preview。对于公开基准测试集中的Code Agent任务,正式版使用即将发布的DeepSeek Harness极简模式作为框架进行测试。此外,该模型支持Responses API格式并针对性适配Codex。官方文档同时显示,DeepSeek-V4-Pro API预计2026年8月初支持接入Codex。本次仅升级了DeepSeek-V4-Flash的API接口,APP及Web端模型未做更改,模型权重已在相关平台开放。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 要闻配图

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 要闻配图

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 要闻配图

相关链接:


字节跳动Seed正式发布Seedance 2.5,单次视频生成时长提升至30秒 #2

字节跳动Seed正式发布Seedance 2.5,该模型延续上代架构,重点突破长叙事能力、多模态参考能力和编辑能力,单次视频生成时长从15秒提升至30秒。模型正在即梦AI和豆包专业版陆续上线,API服务将于近期上线{火山方舟|"火山方舟"}。

字节跳动Seed正式发布新一代视频生成模型Seedance 2.5,延续了Seedance 2.0的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力。Seedance 2.5将单次视频生成时长从15秒提升至30秒,并支持多轮延长,用户可输入最多30张图片、10段视频和10段音频作为参考素材。模型支持通过时间戳精准编辑音视频内容,并强化了绿幕编辑、视角编辑等多种编辑能力。Seedance 2.5正在陆续上线即梦AI和豆包专业版平台,面向企业用户的API服务将在近期上线火山方舟。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 要闻配图

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 要闻配图

相关链接:


开发生态

ChatGPT桌面应用支持点击宠物快捷启动语音模式 #3

ChatGPT桌面应用宣布新增虚拟宠物快捷功能。用户只需点击桌面端的虚拟宠物,即可快速启动ChatGPT Voice语音模式。

ChatGPT官方宣布其桌面应用程序新增了通过虚拟宠物快捷操作的功能。目前,用户在桌面应用中只需点击宠物,即可快速打开ChatGPT Voice。在此快捷方式下,用户能够检查工作进度,并批准或停止相关任务。官方表示这一更新提升了桌面端的使用体验。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 开发生态配图

相关链接:


Google AI Studio 取消独立移动 App,整合进 Gemini 应用 #4

Google AI Studio取消了获超80万次预约的独立移动端App。官方决定将相关能力整合进Gemini应用,让应用在日常对话中自然产生。同时,官方将继续投入优化网页版,满足用户的深层次开发需求。

Google AI Studio 取消了独立移动端 App 的发布计划。此前,该应用在 iOS 和 Android 平台已获得超过 80 万次预购。官方决定采取新方案,将 AI Studio 体验直接整合进 Gemini 应用的移动端和桌面端,让应用在日常对话中自然产生。同时,Google AI Studio 将继续投入优化其网页版体验,服务于有更深层次开发需求的用户。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 开发生态配图

相关链接:


GPT-5.4 系列将于 8 月 31 日从 Codex 中下线 #5

OpenAI 宣布 GPT-5.4 和 GPT-{5.4|五点四} mini 将于 8 月 31 日对通过 ChatGPT 登录的 Codex 用户停用,但在 API 中仍可使用。

OpenAI 宣布 GPT-5.4 和 GPT-5.4 mini 将于 8 月 31 日正式从 Codex 中退役,不再向通过 ChatGPT 账号登录的用户提供。这两个模型在 OpenAI API 和通过 API 密钥验证的 Codex 会话中仍保持可用状态。官方建议开发者将现有的 gpt-5.4 替换为 gpt-5.6-terra,将 gpt-5.4-mini 替换为 gpt-5.6-luna,并在此期限前更新所有相关的默认设置和自定义任务。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 开发生态配图

相关链接:


Nous Research 发布首个官方 Hermes Desktop 插件 Kanban 及配套插件 SDK #6

Nous Research 发布首个官方 Hermes Desktop 插件 Kanban 及配套 Desktop Plugin SDK。开发者可无构建步骤加载自定义插件,为桌面应用添加扩展能力。

Nous Research 官方宣布首个 Hermes Desktop 插件 Kanban 已上线,桌面原生版本应大量用户请求推出并进行了重大升级。配套发布的 Desktop Plugin SDK 对应模块 @hermes/plugin-sdk,允许开发者为 Hermes Desktop 原生应用添加独立页面、侧边栏导航、快捷键、状态栏操作、主题和后端接口等功能。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 开发生态配图

相关链接:


模型发布

千问发布Qwen-Audio-3.0-ASR-Flash语音识别大模型 #7

千问发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,已上线阿里云百炼平台。官方称该模型在上下文记忆、行业词识别和语音润色等五方面完成升级,支持30种语言。

千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,目前通过阿里云百炼平台开放调用,提供Flash、Filetrans(离线文件转写)和Streaming(实时语音识别)三个版本,Flash版本支持转写最长5分钟音频。新模型在上下文一致性、行业词识别、热词定制化、语音润色和多语种识别五个维度进行了系统升级。根据官方内部评测,医疗场景专业词召回率达95.36%,工业场景达93.24%,热词召回率在多数场景突破99%,七语种平均语义错误率为17.09%。Streaming版本理论出字延迟300毫秒,中文工业场景错字率7.8%。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 模型发布配图

相关链接:


美团发布 LongCat-Flash-Lite-Sparse,采用全新稀疏注意力框架 #8

美团开源了{LongCat-Flash-Lite-Sparse|"LongCat Flash Lite Sparse"}模型。这是一个总参数量69B、激活参数约3B的MoE模型,引入了LongCat Sparse Attention,原生支持最高1M tokens上下文长度。

美团在 Hugging Face 上发布了 LongCat-Flash-Lite-Sparse 模型。该模型为非 thinking 的 MoE 架构,总参数量达 69B,每 token 激活参数量约为 3B。它引入了 LongCat Sparse Attention (LSA),原生支持最高 1M tokens 的上下文长度。相比前代密集模型,LongCat-Flash-Lite-Sparse 在保持推理和通用知识性能的同时,提升了长上下文推理效率和 Agentic 能力。模型权重在 MIT 许可下开源,可通过 SGLang 在单节点上进行部署。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 模型发布配图

相关链接:


商汤开源发布 SenseNova-U1.5-8B-MoT 预览版 #9

SenseNova 开源发布 SenseNova-U1.5-8B-MoT 预览版,支持原生 4K 图像生成与细粒度图像编辑,同步公开预训练脚本与配置文件。官方称更完善的正式版本将在不久后发布。

SenseNova 发布并开源 SenseNova-U1.5-8B-MoT(预览版),这是基于 NEO-unify 架构构建的原生统一多模态模型,引入了全新 patch 编码层与 ConvDecoder 解码层。相比前代 U1,该预览版支持原生 4K 图像生成,在纹理、材质、光照和真实感方面显著提升,中英文文字渲染和密集复杂版式组织能力增强,图像编辑方面在指令遵循、主体身份保持和结构一致性上均有改进,并支持通过蒙版、边界框和视觉标记进行区域可控的细粒度编辑。官方明确,更强大、更完善的正式版本将在不久后正式发布。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 模型发布配图

相关链接:


LG AI研究院发布开源模型K-EXAONE 2.0 #10

LG AI研究院发布了K-EXAONE 2.0开源模型。该模型拥有7500亿总参数和370亿激活参数。据官方数据,该模型在长上下文理解和安全性等基准测试中表现突出,并支持十种语言。

LG AI研究院在Hugging Face上正式发布K-EXAONE 2.0模型,这是韩国科技信息通信部主权人工智能基金会模型项目下开发的第二代产品。新模型采用混合注意力MoE架构,拥有7500亿总参数和370亿激活参数,规模是初代的三倍以上。模型支持多标记预测和DSpark两种投机解码方法,可加速生成约3至5倍,并将其多语言覆盖范围从六种扩展至十种。该模型采用Apache 2.0许可证完全开源,根据官方公布的基准测试数据,其长上下文检索和安全性表现优于现有的多款主流开源模型。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 模型发布配图

相关链接:


华为开源 openPangu-2.0-Pro 模型,总参数达 5050 亿 #11

华为开源基于昇腾 NPU 训练的 open{Pangu|盘古}-2.0-Pro 模型。该模型总参数规模约 5050 亿,目前已提供模型权重、{基础推理代码|"基础推理代码"}及技术报告。官方指出其在复杂软件工程任务上仍与顶尖模型存在差距。

华为开源基于昇腾 NPU 训练的大规模混合专家模型 openPangu-2.0-Pro,相关权重、推理代码和技术报告已正式上线。该模型总参数规模约 5050 亿,激活参数约 180 亿,支持 512K 上下文长度,采用了 DSA+SWA 独立分层混合架构与 Muon 优化器。技术报告披露了其包含 Thinking 和 Non-Thinking 两种模式的测评数据。官方称模型在通用能力和逻辑推理等方面表现优异,但也承认在处理复杂现实世界软件工程任务时,仍与顶尖模型存在明显差距。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 模型发布配图

相关链接:


产品应用

MiniMax 上线 MiniMax Hub 并推出 Media Plan 订阅方案 #12

MiniMax 官方正式上线 MiniMax Hub,并推出了全新的 Media Plan 订阅方案。主要覆盖视频生成、图片创作、配乐制作和语音合成等核心创意场景,支持 Seedance 2.0、MiniMax H3 以及 Seedream 5.0 Pro 等主流模型。

MiniMax 官方上线 MiniMax Hub,并针对音视频创作者、影视内容创作团队以及内容营销团队,推出了全新的 Media Plan 订阅方案。根据 MiniMax 官方平台信息,MiniMax API 开放平台目前日均处理超万亿 Token 请求,累计服务超 10 万开发者。全新的 Media Plan 主要覆盖视频生成、图片创作、配乐制作和语音合成等核心创意场景,提供 Starter、Plus 和 Pro 三个层级的按年订阅方案,支持 Seedance 2.0、MiniMax H3 以及 Seedream 5.0 Pro 等主流模型。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 产品应用配图

相关链接:


行业动态

Google Earth AI生图功能上线一天后被撤回 #13

Google上线仅一天便回滚了Google Earth的AI图像生成功能。因发现有用户分享疑似违规的生成截图,Google决定在完善防护措施期间暂时撤回该功能。

Google此前在Google Earth中推出了一项AI图像生成功能,允许用户使用其Nano Banana 2图像生成模型,通过提示词在卫星地图上创建虚构图像并叠加于真实地图之上。该功能上线后很快遭到批评,评论者指出该工具可能被用于制造和传播虚假地理信息。Google随后发表官方声明称,已观察到有用户分享疑似违反平台政策的生成图像截图,因此决定在实施更强护栏期间回滚该功能。Google还指出,生成的图像不会在Google Earth主界面中对其他用户可见,且已标注为AI生成的水印。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 行业动态配图

相关链接:


特斯拉推送车机更新,引入豆包大模型语音助手 #14

据报道,特斯拉中国向 Model 3 等车型推送新版本车机软件更新,核心新增豆包大模型智能语音助手。

特斯拉中国发布 2026.14.13 版本车机软件更新,现已分批次向 Model 3、Model Y、Model S、Model X 车型推送,这是特斯拉首次在国内车机中引入第三方大模型服务。豆包大模型智能语音助手可实现自然流畅对话和实时信息检索,提供多款音色及"万事通""音乐爱好者""故事会"等个性化角色,但需开通高级车载娱乐服务才能使用。据官方更新说明,该语音助手暂不支持车辆控制指令,无法通过语音调节空调、设置导航等车载操作。据反馈,本次更新适用于搭载 HW 3.0 及更早硬件的车辆,即非 AI4 硬件车型。

相关链接:


技术与洞察

数学家称 GPT-5.6 Sol 找到麦克斯韦猜想反例 #15

数学家Philip Arathoon 称,GPT-5.6 Sol 找到麦克斯韦猜想反例——5 个点电荷的三角双锥体产生 24 个平衡点,超出猜想上限。

Philip Arathoon 于社交平台宣布,麦克斯韦猜想被证伪,反例由 AI(GPT-5.6 Sol)发现,并由人类数学家整理撰写论文发布于 arXiv。该反例为一个由 5 个点电荷构成的三角双锥体结构,产生 24 个平衡点,超过猜想给出的 (n-1)² 上限。Greg Brockman 转发该消息,称 GPT-5.6 Sol 可解决百年以上的数学猜想。另有用户指出,麦克斯韦原文的实际表述为 (n-1)(n-2) 而非 (n-1)²,且其本人从未将该表述称为"猜想","猜想"这一名称于 2007 年才被后人提出。目前该发现尚未获得独立验证。

AI 早报 2026-08-01 — DeepSeek V4 Flash API 公测、字节跳动发布 Seedance 2.5 - 技术与洞察配图

相关链接:


提示:内容由AI辅助创作,可能存在幻觉错误


查看网页全文 · 查看 Markdown