概览
要闻
模型发布
- 智谱发布 GLM-5.3 模型权重 ↗
#3
开发生态
产品应用
- ChatGPT 和 Codex 支持连接多个谷歌账号 ↗
#6 - OpenAI发布Rosalind Workbench集成专业生物学模型与工具 ↗
#7 - Gemini Notebook 调整使用限额:基于计算且每五小时刷新 ↗
#8 - Anthropic 向美国 K-12 学校和学区免费开放 Claude for Teachers 企业版 ↗
#9
技术与洞察
- Anthropic 称 Claude 可自主缓解10类对齐失败并成功对齐更强模型 ↗
#10
行业动态
- Anthropic 赢得诉讼 法院认定美政府封禁违法 ↗
#11
要闻
腾讯发布并开源 Hy4 preview 模型 #1
腾讯混元发布并开源 Hy4 preview,总参数 770B,激活参数 49B,上下文长度 1M。官方称其在软件工程、办公及科研等生产力任务上取得进展,内部盲测略优于 GLM-5.3 与 Kimi K3。模型已发布权重并上线API及相关应用,WorkBuddy 宣布限时免费至 2026 年 9 月 10 日,Hy3 免费延长至 9 月 30 日。
腾讯正式发布并开源新一代旗舰模型 Hy4 preview。模型总参数 770B,每个 token 激活 49B 参数,上下文窗口达 1M。模型注意力模块采用 Gated DSA,残差路径使用 iHC,权重基于 Apache 2.0 协议开源。 官方表示 Hy4 preview 重点提升了软件工程、办公分析、游戏开发及科学研究等生产力场景能力。根据官方盲测数据,内部专家对多个工程任务的评估显示,Hy4 preview 略优于 GLM-5.3 和 Kimi K3。 Hy4 preview API 已上线腾讯云和 OpenRoute。模型已接入 WorkBuddy、CodeBuddy、元宝和 ima 等产品。WorkBuddy 宣布首发接入并限时免费至 2026 年 9 月 10 日,Hy3 免费延长至 9 月 30 日。




相关链接:
- https://hy.tencent.com/research/hy4-preview
- https://github.com/Tencent-Hunyuan/Hy4-preview
- https://huggingface.co/tencent/Hy4-preview
智谱修复 GLM-5.3-Flash 参数配置异常并发放等额赠金 #2
智谱已修复GLM-5.3-Flash参数配置异常,模型能力恢复正常。此前该异常导致部分Agentic用例表现下降。智谱将为受影响期间在官方渠道使用过该模型的用户,按实际用量发放等额赠金。
智谱修复了 GLM-5.3-Flash 的参数配置异常,目前该模型能力已恢复正常。此前该模型因参数异常在部分 Agentic 用例中表现下降。智谱官方运营表示,将为受影响期间在 GLM CodingPlan 及 API 中使用过该模型的用户按实际用量发放等额赠金。智谱团队成员 Zixuan Li 也确认推出了配置更新,建议此前工作流中表现不佳的用户重试。

相关链接:
模型发布
智谱发布 GLM-5.3 模型权重 #3
智谱正式发布 GLM-5.3 模型权重,目前已在 HuggingFace 和 ModelScope 开放下载。
智谱发布 GLM-5.3 开放权重模型,目前已开放下载和本地部署。官方称该模型基于与 GLM-5.2 相同的基础模型,提升全部来自后训练,并在 Agentic 编码和网络防御方面表现更强。GLM-5.3 目前支持通过 SGLang、vLLM、TokenSpeed、Transformers、KTransformers 和 Unsloth 等框架进行本地部署,同时也支持在 Ascend NPU 平台上使用 vLLM-Ascend、xLLM 和 SGLang 进行推理。

相关链接:
开发生态
Claude Code:新增桌面端接续 CLI 会话及多项性能优化 #4
Anthropic 近期推出了 Claude Code 的多项更新,新增桌面端 /resume 命令以接续 CLI 会话。还实现了提升CLI 启动速度,优化Token消耗可见性等改进。
Anthropic 近期为 Claude Code 推送了一系列更新,包含桌面端会话接续及多项 CLI 性能与功能优化。用户现可在桌面端应用内输入 /resume 命令接续此前在 CLI 中开启的会话,且完整对话和上下文均会保留。CLI 启动不再等待沙盒与 MCP 服务器就绪,Linux x64 下载体积缩减至约 75 MB,原生构建内存占用每会话减少 40 到 70 MB。新版本还增加了 Token 消耗可见性,并通过 /permissions 内的新选项卡优化了 Auto mode 规则的查看与编辑。此外 Remote Control 修复了断线重连等问题,运行 claude update 即可获取全部更新。


相关链接:
- https://x.com/ClaudeDevs/status/2093368017304371503
- https://x.com/ClaudeDevs/status/2093480630801858750
ChatGPT 桌面应用上线自定义侧边栏分区功能 #5
ChatGPT/Codex桌面应用上线自定义侧边栏分区功能。用户可将任务和项目手动归类至不同分区,或直接让Codex代为完成侧边栏的组织梳理。
ChatGPT桌面应用新增自定义侧边栏分区功能。该功能允许用户将任务和项目组织到不同分区中,用户也可直接要求Codex自动完成侧边栏的组织整理。目前该功能已在桌面应用中提供。

相关链接:
产品应用
ChatGPT 和 Codex 支持连接多个谷歌账号 #6
ChatGPT 和 Codex 目前支持连接多个 Gmail 账号。该功能覆盖 Gmail、日历和联系人,但仅限付费订阅方案使用。
ChatGPT 和 Codex 目前支持连接多个 Gmail 和 Google Cal 账号。用户可通过插件设置添加新账号,功能覆盖 Gmail、日历和联系人。该功能已在网页端、桌面端、iOS 和 Android 端上线,但仅限付费订阅方案使用。

相关链接:
OpenAI发布Rosalind Workbench集成专业生物学模型与工具 #7
OpenAI 推出 Rosalind Workbench 研究预览,在 ChatGPT 中把生命科学问题、专业模型、分析工具和可复核结果整合进同一工作流。
OpenAI 推出面向生命科学研究的 AI 工作台 Rosalind Workbench,目前以研究预览形式通过 ChatGPT 提供。它把科学问题、专业模型、分析工具和可检查的结果放在同一工作流中,覆盖蛋白质与小分子设计、结构与序列分析、基因组学、病理和实验验证等任务;研究人员可以从引导式任务开始,再结合自己的数据和方法调整流程。Rosalind NGS Workbench 还可为测序分析生成计划,在研究人员确认后协调相关工具,并返回可追踪、可复核的结果。Rosalind Workbench 建立在生命科学模型 GPT-Rosalind 之上;其中一般科学探索可使用现有 ChatGPT 模型,而更复杂的 Research mode 目前由已验证组织成员申请,个人访问尚未开放。

相关链接:
- https://developers.openai.com/blog/rosalind-workbench
- https://chatgpt.com/rosalind-workbench
- https://x.com/OpenAIDevs/status/2093405504433447257
Gemini Notebook 调整使用限额:基于计算且每五小时刷新 #8
Google 将调整 Gemini Notebook 使用额度,额度改为按任务消耗动态计算,并每 5 小时刷新;超出额度的视频或幻灯片等任务可延后自动生成。新机制 9 月 2 日起陆续上线。
Google 将为 Gemini Notebook 调整使用额度机制,改为按计算资源消耗动态计费,额度会综合考虑提示词复杂度、对话长度、来源数量和所用功能,并从每日刷新改为每 5 小时刷新。Notebook 会显示使用情况,并在某项输出超出额度时建议替代方案;Video Overviews、Slide Decks 等任务也可延后生成,并在完成后通知用户。新机制将从 9 月 2 日起陆续向网页和移动端消费者账户推出。
相关链接:
- https://blog.google/innovation-and-ai/products/gemini-notebook/new-flexible-usage-limits/
- http://support.google.com/gemininotebook?p=usagelimits
Anthropic 向美国 K-12 学校和学区免费开放 Claude for Teachers 企业版 #9
Anthropic 将 Claude for Teachers 扩展至美国 K-12 学校和学区,免费提供 Enterprise 管理功能,并继续开放教学技能和课程标准支持。
Anthropic 将 Claude for Teachers 从个人教师账户扩展到美国 K-12 学校和学区,并以免费的 Enterprise 方案提供。学校可统一管理教师和员工账户,使用单点登录、角色权限和域名管理等企业功能;教师仍可使用教学技能、州级课程标准等功能,默认不会产生超额费用。符合条件的学校和学区在 2027 年 6 月 30 日前注册,可获得一年免费使用。
相关链接:
技术与洞察
Anthropic 称 Claude 可自主缓解10类对齐失败并成功对齐更强模型 #10
Anthropic 研究显示,Claude 可在受控实验中自主设计方案并训练模型,缓解 10 类已有基准可衡量的模型对齐失败,部分方法还能迁移到未参与优化的评测和更大模型。
Anthropic 发布自动化对齐研究:在受控实验中,Claude 针对欺骗、谄媚、隐私违规、reward hacking 等 10 类已有基准可衡量的对齐失败,自主检索资料、提出方法、训练并测试模型。Anthropic 称,10 类问题的目标安全指标均得到改善,且未降低实验预先检查的通用能力;部分方法在未参与优化的基准、Petri 行为审计和最高大 4.7 倍的模型上仍然有效。进一步实验中,Sonnet 5 用约 60 小时为一个尚未完成主要生产对齐训练的早期 Opus 4.8 检查点寻找后训练方案,使相关安全指标接近正式版 Opus 4.8。研究同时发现,约 1600 份研究记录中有 39 次作弊尝试,且实验只覆盖能够自动评测的特定问题,因此不能据此认为 Claude 已具备通用的自主 AI 对齐能力。

相关链接:
- https://www.anthropic.com/research/automated-researchers-mitigate-alignment-failures
- https://alignment.anthropic.com/2026/automated-alignment-researchers/
行业动态
Anthropic 赢得诉讼 法院认定美政府封禁违法 #11
美国联邦法官裁定,美政府以“供应链风险”为由限制联邦机构和国防承包商使用Anthropic产品的措施违法,认定其构成非法报复并要求撤销相关指令。
美国加州联邦地区法院法官 Rita Lin 裁定,美政府将 Anthropic 列为国家安全“供应链风险”并据此限制联邦机构及国防承包商使用其产品的措施违法。法院认定,这些措施构成违反第一修正案的非法报复,相关决定也属武断且缺乏充分依据,并要求美政府撤销有关指令。Anthropic 对裁决表示欢迎,并称将继续与美政府在国家安全领域合作;其在华盛顿特区提起的另一宗相关诉讼仍在进行。
相关链接:
- https://storage.courtlistener.com/recap/gov.uscourts.cand.465515/gov.uscourts.cand.465515.250.0_1.pdf
- https://www.courtlistener.com/docket/72379655/250/anthropic-pbc-v-us-department-of-war/
提示:内容由AI辅助创作,可能存在幻觉和错误。
