概览
要闻
- Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1 ↗
#1 - OpenAI 宣布 Astra 即将发布 ↗
#2 - Gemini 3.7 Flash 等三款模型上线 Agentic 视频理解 ↗
#3
开发生态
模型发布
- World Labs 发布世界模型 Atlas,统一架构覆盖生成、重建与时空模拟 ↗
#6 - Meta 发布实时音频感知模型 Muse Voice Transcribe ↗
#7 - 讯飞星火开源星火X2.5端侧模型 ↗
#8 - Celeris 推出混合扩散模型 Celeris-1 Magnus ↗
#9 - Abliteration.ai 发布 GLM-5.3 abliterated 版模型 ↗
#10 - 腾讯混元发布 Hy4 preview 轻量版(量化版) ↗
#11
产品应用
行业动态
- Manus 宣布正式恢复独立运营,创始团队继续领导公司 ↗
#14 - Anthropic 推出 Enterprise Frontier Safeguards ↗
#15 - 消息称 Anthropic 与 Lambda 签署 350 亿美元云计算协议 ↗
#16
要闻
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1 #1
Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1。Fable 5.1 已全面开放,强化编程、知识工作、计算机操作和长时间 Agent 任务;Mythos 5.1 则通过可信访问计划开放。Fable 5.1 输入、输出单价较前代不变,缓存读取价格下降 75%,官方称典型工作负载预计节省约 25%。与此同时,Anthropic 调整了安全机制,Claude Code 的网络安全防护干预约减少 60%,基础生物和医疗正常请求的安全触发约减少 85%;此外还加入企业 EFS、反蒸馏机制和文本水印,发布当天重置了所有用户的 5 小时及每周额度。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者使用同一模型,但安全限制不同:Fable 5.1 已全面开放,Mythos 5.1 则面向经过验证的网络安全和生命科学机构,通过可信访问计划提供。Fable 5.1 重点提升编程、知识工作、计算机操作和长时间 Agent 任务,能在需要人工介入前持续执行更久,更容易主动说明受阻状态,写作风格也更自然;Terminal-Bench 4.0 得分从 Fable 5 的 42.0% 提升至 55.8%,Terminal-Bench-Science 0.1 达到 52.6%。
科研方面,Anthropic 展示了模型设计高亲和力蛋白质结合物、生成更高分辨率金星地形图,以及将 7 个开源生物学模型最高加速 2.5 倍等成果。价格方面,输入、输出单价较前代不变,缓存读取价格下降 75% 至每百万 token 0.25 美元,典型工作负载预计节省约 25%,高度 Agent 化任务最高约 45%。安全机制也更精细:Fable 5.1 可用于发现软件漏洞,Claude Code 的网络安全干预预计减少约 60%,基础生物和医疗正常请求的安全触发减少约 85%,同时加强新 API 账户的反蒸馏限制。
此外,Anthropic 推出 Enterprise Frontier Safeguards(EFS),让企业数据保存在自身控制的云基础设施中,并将从今年秋季起分阶段上线;新模型还按欧盟 AI 法案相关要求加入不可见文本水印,并推出检测 API 私有预览。配合 Fable 5.1 发布,官方同时重置了所有用户的 5 小时和每周使用额度。







相关链接:
- https://www.anthropic.com/claude-fable-and-mythos-5-1
- https://www.anthropic.com/news/enterprise-frontier-safeguards
- https://support.claude.com/en/articles/16761192
OpenAI 宣布 Astra 即将发布 #2
OpenAI 宣布新模型 Astra 很快将开放使用,但将限制其最先进网络安全能力的初期开放,后续再通过 Daybreak Blue 扩大防御性使用。官方称,这是其首个达到网络安全“Critical”门槛的模型,可发现未知漏洞并开发利用方式;官方测试中,它在 ExploitBench 获得 100%,还发现两个零日漏洞,并完成浏览器沙箱逃逸和系统提权链。OpenAI 已强化拒答、监控和对齐机制。
OpenAI 宣布正准备发布新模型 Astra,并发布博文《Path to Astra》介绍称,Astra 是其首个达到 Preparedness Framework 网络安全“Critical”门槛的模型,在配合相应工具和权限时,可发现未知安全漏洞并开发利用方式。官方评测中,Astra 在 ExploitBench 获得 100%,内部测试还发现并利用了两个零日漏洞;专家测试中,它完成了浏览器沙箱逃逸以及从普通用户到 root 的操作系统提权链。 为准备发布,OpenAI 推迟了 Astra 的部分开发和发布工作,并强化模型拒答、系统安全分类、训练基础设施隔离、跨会话监控及未授权行为检测。对齐测试中,Astra 更能遵守安全限制和授权范围,并将配套推理与行为监控用于生产环境。Astra 计划近期开放,但最先进的网络安全能力初期仅提供给部分测试者,随后通过 Daybreak Blue 扩大防御性使用;安全系统也可能暂停或终止被判定存在风险的正常任务。

相关链接:
Gemini 3.7 Flash 等三款模型上线 Agentic 视频理解 #3
Google 宣布为 Gemini 3.7 Flash 等模型上线 Agentic 视频理解,模型可自主决定观看哪些片段、以什么方式观看。官方称长视频分析 token 最高减少 88%、成本最高降低 66%,功能现已开放API调用。
Google 官方宣布为 Gemini 3.7 Flash、Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 推出 Agentic 视频理解能力,目前已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 上线,支持视频上传和 YouTube 视频。与默认以 1 FPS 固定帧率整体读入视频的静态处理不同,模型可自主决定观看哪些片段、以什么速度、通过视觉帧、音频还是字幕获取信息。根据官方公布的评测数据,token 消耗最高减少 88%,分析成本最高降低 66%,准确度最高提升 7%,且在长视频上收益尤为明显。开发者只需在 API 配置中将视频的 processing 参数设为 agentic 即可启用,按标准 token 计费,无额外功能费用。该能力即将面向 Gemini 应用所有用户推出,并将在未来数月内支撑 YouTube 视频观看页的 Ask YouTube 功能。


相关链接:
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-agentic-video-in-gemini/
- https://ai.google.dev/gemini-api/docs/video-understanding#agentic-video-understanding
- https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/capabilities/video-understanding
开发生态
智谱庆祝 GLM Coding Plan 一周年向订阅用户发放重置卡 #4
智谱宣布为庆祝 GLM Coding Plan 上线满一周年,已向每位当前订阅用户发放一张重置卡。用户可在控制台用量统计页面查收使用,有效期至 2026 年 10 月 1 日。
智谱旗下 GLM Coding Plan 上线满一周年,官方宣布向每位当前订阅用户发放一张重置卡。这张重置卡可用于补满周配额和 5 小时配额,智谱官方运营表示这次不用赶时间,什么时候执行重置由用户自行决定。用户可在「控制台 - 用量统计」中查收重置券,有效期至 2026 年 10 月 1 日。

相关链接:
Ollama 订阅方案改按 token 计费 #5
Ollama宣布订阅套餐改为按token计费,Pro月付20美元含60美元用量,Max 每月 100 美元含 300 美元用量。老用户可随时升级至新计费方式。
Ollama 宣布 Pro、Max 和 Team 订阅方案改用透明按 token 计费,每个方案每月附带一池用量额度,按定价页公示的每百万 token 价格消耗。Pro 每月 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元用量,Team 每月 500 美元含不限人数共享的 1000 美元用量,免费方案每月含少量入门模型用量,充值后可按需解锁全部模型。现有 Pro、Max、Team 用户原方案继续有效,可随时在账户设置中升级,新注册用户直接使用新方案。官方称新定价无服务费、无 5 小时或每周限制,额度用完后可按相同 token 价格继续使用,Ollama 还表示正在开发错峰定价。

相关链接:
- https://ollama.com/pricing
- https://ollama.com/public/Ollama
- https://x.com/ollama/status/2094664013993177514
模型发布
World Labs 发布世界模型 Atlas,统一架构覆盖生成、重建与时空模拟 #6
World Labs 发布世界模型 Atlas,原生支持文本、图像、视频与 3D 输入。官方称其视频生成与 3D 重建超越多个专用模型,将在未来几周开放早期访问。
World Labs 发布新一代世界模型 Atlas。该模型从零预训练,原生处理文本、图像、视频和 3D,采用多模态自回归扩散 Transformer 架构,将所有输入整合进共享空间上下文并生成与已见内容保持 3D 一致的输出。Atlas 支持以精确相机控制从一到六张输入图像生成最长 1 分钟的 1440p 视频,也能以少至两三张图像重建真实场景并输出点云或 3D Gaussian splats,还支持视频重新取景、机器人 Real-to-Sim 以及文生图与 360 全景。官方基准显示,其在相机控制生成和稀疏视角 3D 重建上均超过多个专用模型。目前 Atlas 正面向特定合作伙伴进入早期访问,官方称将在未来几周开放早期访问,并将在未来驱动 Marble 等产品。

相关链接:
Meta 发布实时音频感知模型 Muse Voice Transcribe #7
Meta 超级智能实验室推出首个实时音频感知模型 Muse Voice Transcribe,官方称其流式语音转写与公开说话人分离基准均排名第一。模型现已在 Meta Model API、Meta AI for Mac 和 Muse Code 上线。
Meta 超级智能实验室发布旗下首个实时音频感知模型 Muse Voice Transcribe,现已正式推出。该模型在单一模型内原生提供实时流式 ASR、支持 20 多名说话人的分离以及端点检测,支持多语言与句内语码转换,并可通过语言、关键词和上下文偏置提升准确率。官方称该模型在 Artificial Analysis 流式语音转文字榜及公开说话人分离基准上排名第一。模型已在 Meta Model API 上线并提供零数据保留层级,Meta AI 与 Muse Code 中的语音听写也已由其驱动,用户通过 Meta AI for Mac 和 Muse Code 即可使用。








相关链接:
- https://research.meta.ai/blog/introducing-muse-voice-transcribe
- https://ai.meta.com/meta-ai/download/
讯飞星火开源星火X2.5端侧模型 #8
讯飞星火开源了星火X2.5-4B和1.7B两款端侧模型,官方称基于全国产算力平台完成训练,原生支持最长100万Token上下文,对应模型API已上线讯飞星辰MaaS平台并提供限时免费调用。
科大讯飞词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,模型权重、代码仓库和部署文档已在Hugging Face、GitHub等平台开放。官方称这是端侧模型中首个原生支持最长100万Token上下文的模型,采用混合注意力架构,围绕智能体、代码、数学和指令遵循等能力优化。根据官方数据,星火X2.5-4B在SWE-Bench Pro、AIME 2026等多项测试中取得同尺寸领先成绩。两款模型基于全国产算力平台完成训练,支持英伟达、华为、海光、后摩等硬件,兼容vLLM、SGLang、llama.cpp等推理框架,可通过Ollama、LM Studio部署,许可证为Apache 2.0。对应模型API已上线讯飞星辰MaaS平台,限时免费。


相关链接:
- https://mp.weixin.qq.com/s/kTyKUjRM7q-cLr1KYMn9Ow
- https://github.com/XHToken/Spark-X2.5
- https://huggingface.co/collections/XHToken/spark-x25
- https://maas.xfyun.cn/modelSquare
Celeris 推出混合扩散模型 Celeris-1 Magnus #9
Celeris 发布混合扩散模型 Celeris-1 Magnus,官方称其基于 qwen3.8-27b 衍生、针对 Agent 工作负载优化,现已上线 API。
Celeris 发布了面向 Agent 工作负载的 Celeris-1 Magnus 模型。Celeris 官方称,Magnus 是一款基于 qwen3.8-27b 衍生的混合扩散模型,在此基础上针对 Agent 场景进行了优化,重点支持原生推理、多步工具调用、代码执行以及需要持续获取外部信息的复杂任务。官方称其在 τ³-Banking 基准解决率 41.2%,超过 gpt-5.6-sol。现已面向所有 API 用户开放。
相关链接:
- https://celeris.ai/introducing-celeris-1-magnus
- https://celeris.ai/celeris-1-magnus
- https://console.celeris.ai/
Abliteration.ai 发布 GLM-5.3 abliterated 版模型 #10
Abliteration 发布并上线基于 GLM-5.3 的 abliterated-model-large-v2,官方称该模型移除了拒绝行为、保留编码与 Agent 能力,现已提供API。
Abliteration.ai 发布基于 GLM-5.3 的 abliterated-model-large-v2,目前已上线并以 API 形式提供服务。官方介绍,abliteration 会定位模型激活中产生拒绝的方向并从权重中移除;编码、网络安全和 Agentic 能力保留,模型不会再在任务链中途拒绝。

相关链接:
腾讯混元发布 Hy4 preview 轻量版(量化版) #11
腾讯混元为旗舰模型Hy4 preview推出轻量版(量化版),用自研Sherry稀疏三值量化算法和混合精度策略,把约1.5TB的权重压缩到约214GB,能力基本保持,量化GGUF已开源。
腾讯混元为旗舰模型 Hy4 preview 推出轻量版,通过 Sherry 稀疏三值量化算法和 MIX-STQ1_0 混合精度策略,把约 1.5TB 的模型权重压缩到约 214GB,压缩幅度约 86%。腾讯混元的测试结果显示,压缩版在长文理解、多轮长上下文检索上与原版基本处于同一水平,数学有小幅回落,多个主流评测集与 BF16 原版差距在一两分以内,整体领先社区常用的 UD-IQ1_M 量化方案。量化 GGUF 已发布在 Hugging Face 的 AngelSlim 仓库,共三个版本,其中 STQ1_0 版体积 213.66 GiB;仓库明确这些文件无法在原版 llama.cpp 上直接运行,需先应用仓库提供的补丁,STQ1_0 版全量驻留显存约需 214GB。

相关链接:
产品应用
Google 推出图像创作与编辑工具 Google Pics #12
Google 推出图像创作与编辑工具 Google Pics,基于 Nano Banana 模型。该工具将在未来几周内面向 Google AI Pro 和 Ultra 订阅用户及多数 Workspace 商业客户推出。
Google 在官方博客宣布,来自 Google Workspace 的图像创作与编辑工具 Google Pics 目前正陆续推出。Google Pics 基于 Nano Banana 图像生成与编辑模型构建,将同时以独立产品和 Workspace 应用集成两种形式提供,集成率先覆盖 Docs 和 Slides,Drive 将在未来几周内跟进。功能上,Google Pics 支持对象分割、图像内文字编辑与翻译、多人协作编辑,以及单次提示生成多个图像选项。根据官方说明,该工具将在未来几周内覆盖所有 Google AI Pro 和 Ultra 订阅用户以及大多数 Workspace 商业客户,用户可通过 pics.new 试用。

相关链接:
OpenAI 上线 ChatGPT 礼品卡:仅限美国美元账户网页端兑换 #13
OpenAI 上线了OpenAI礼品卡,目前可在部分授权零售商购买数字版。兑换仅限美国地区美元结算账户,余额只能用于 ChatGPT 网页端订阅、续费和购买额度。
OpenAI 在官方帮助中心说明 ChatGPT 礼品卡的购买与兑换规则。礼品卡为美元计价、不可充值的储值卡,目前可在部分授权零售商购买数字版。兑换和使用仅限美国地区、美元结算的 ChatGPT 账户,余额可用于订阅、续费、升级和额度购买,但不能支付 Apple App Store 或 Google Play 的交易。ChatGPT Free、Go、Plus、Pro 以及 Business 工作区所有者可使用兑换,兑换需受账户余额和每日充值上限约束。

相关链接:
行业动态
Manus 宣布正式恢复独立运营,创始团队继续领导公司 #14
Manus 官方宣布正式恢复独立运营,创始团队继续领导公司,持续投入产品创新并面向全球用户推进通用 AI Agent。
Manus 在官方博客和官方账号宣布,公司已正式恢复独立运营,创始团队将继续领导公司,持续投入产品创新并面向全球用户推进通用 AI Agent。Manus 表示,作为独立 agent lab,接下来会让 Manus 更深度地嵌入用户日常工作流程、更直接地与世界交互,并更主动地代表用户行动。此前过渡期间,部分用户需要备份和恢复数据,并经历了访问的临时中断。已备份但尚未恢复的用户可通过恢复门户完成恢复,官方称没有截止期限,未受影响的用户无需采取任何操作。

相关链接:
- https://manus.im/blog/manus-resumes-independent-operations
- https://x.com/ManusAI/status/2094606484508144069
Anthropic 推出 Enterprise Frontier Safeguards #15
Anthropic 官方宣布推出 Enterprise Frontier Safeguards,一套结合零数据保留与自动化滥用监测的企业级安全方案,将自今年秋季起分阶段向客户开放。
Anthropic 发布企业前沿安全防护方案 Enterprise Frontier Safeguards(EFS),官方称其将零数据保留的隐私性与用于检测滥用的安全防护相结合。该方案与超过 100 家金融、医疗、制造、电信、法律、零售及公共部门领域的客户,以及 AWS、Google Cloud 和 Microsoft Azure 共同开发。EFS 的核心是活动数据存储在客户自有云账户中,由客户管理加密密钥、访问策略和审计日志;自动监测发现可疑信号后直接发送给客户,由客户团队进行复核,无需 Anthropic 员工进行人工审查。客户自有的存储、客户托管加密密钥和全自动审查均为可选功能,不会改变模型行为、API 定价或速率限制;Anthropic 不对 EFS 收费,客户自行承担云存储及读写、数据流出费用。EFS 将支持 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Claude Platform on AWS、Google 的 Agent Platform 和 Microsoft Foundry,计划自今年秋季起分阶段推出并逐步扩大可用范围。

相关链接:
消息称 Anthropic 与 Lambda 签署 350 亿美元云计算协议 #16
据知情人士透露,Anthropic与受英伟达投资的云服务商Lambda签署350亿美元云计算协议,租用得克萨斯州容量约350兆瓦的数据中心,以扩大AI算力应对Claude需求增长。
据知情人士透露,Anthropic 已与获英伟达投资的云服务商 Lambda 签署价值 350 亿美元的云计算协议,以快速扩大自身 AI 算力。该协议对应位于得克萨斯州努埃塞斯县、由 Hut 8 开发的数据中心,容量约 350 兆瓦。报道还提到,Lambda 将部署英伟达芯片为 Anthropic 提供云服务,以应对 Claude 需求增长。
相关链接:
- https://www.reuters.com/technology/anthropic-signs-35-billion-cloud-deal-with-nvidia-backed-lambda-source-says-2026-08-31/
- https://www.bloomberg.com/news/articles/2026-08-31/anthropic-seals-35-billion-cloud-deal-with-nvidia-backed-lambda
提示:内容由AI辅助创作,可能存在幻觉和错误。
