概览
开发生态
产品应用
模型发布
行业动态
- 字节整合TRAE与扣子至豆包体系 ↗
#7 - 小米发布玄戒三款自研芯片并展出AI Cube原型机 ↗
#8 - SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72 ↗
#9 - NVIDIA 发布 Vera Rubin NVL72 性能数据 ↗
#10 - NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理 ↗
#11 - 传Nvidia拟投资Perplexity AI数十亿美元 ↗
#12 - Mistral AI 与 HUMAIN 布局中东主权 AI 基建 ↗
#13 - Thinking Machines Lab发布开源模型安全资助 ↗
#14
开发生态
MiniMax与GMI Cloud合作开放M3等模型14天免费访问 #1
MiniMax与GMI Cloud官方宣布,8月24日至9月6日提供14天免费无限制访问,涵盖MiniMax M3及M2.7等模型。
MiniMax与GMI Cloud官方宣布,在8月24日至9月6日期间推出为期14天的免费无限制访问活动(有反滥用及速率限制机制)。此次活动涵盖MiniMax M3和M2.7模型,以及Speech 2.8和Music 3.0功能。开发者可通过GMI API密钥,活动期间内上述服务不设使用量限制。

相关链接:
- https://www.gmicloud.ai/minimax-week
- https://x.com/MiniMax_AI/status/2091948930124947941
- https://x.com/gmi_cloud/status/2091925007756857368
阿里云云工开物面向高校学生发放Qoder CN专业版 #2
高校学生完成支付宝学生认证后,可在阿里云云工开物领券免费兑换1个月Qoder CN个人专业版Pro,支持多款国内模型,限领1次。
阿里云云工开物面向高校学生推出开学季福利,学生完成支付宝学生认证后可领取300元代金券,用于免费兑换1个月Qoder CN个人专业版Pro。该专业版支持Qwen3.8、GLM-5.3、DeepSeek-V4等多款国内模型服务。该福利仅限在阿里云下单页面使用代金券抵扣,在Qoder CN官网下单无法抵扣,且同一阿里云账号完成认证、领券与下单仅限抵扣1次。

相关链接:
产品应用
OpenAI 推出美国大学生四个月免费 ChatGPT Plus #3
近期,OpenAI 宣布向符合条件的美国大学生提供四个月免费 ChatGPT Plus,需在10月31日前验证领取。
OpenAI 推出面向美国大学生的优惠活动,提供价值80美元的四个月免费 ChatGPT Plus。符合条件美国学位授予机构的全日制与兼职学生需在10月31日前通过 SheerID 验证领取。新用户需添加付款方式激活且免费期内不扣费。

相关链接:
Anthropic 升级 Claude 流式渲染器 #4
Anthropic 重建了 Claude 网页端与桌面端流式渲染器,官方称{长回答|"常回答"}流式输出平滑度现已提升约 4 倍,同时降低了设备卡顿。
Anthropic 重建了 Claude 网页端与桌面端的流式渲染器,使长回答流式输出平滑度提升约 4 倍。官方称该渲染器目前仅处理仍在变化的内容,从而让慢速笔记本上的长回复卡顿减少 9 倍、最长冻结时间缩短 4.5 倍。在 120Hz MacBook 上,该功能可维持从头到尾 120fps 的帧率。

相关链接:
模型发布
Agnes AI 开源 Agnes 2.5 Pro Alpha 多模态推理模型 #5
Agnes AI 开源了 Agnes 2.5 Pro Alpha多模态推理模型,该模型基于 Qwen3.5-397B后训练,支持1M上下文
Agnes AI 发布多模态推理模型 Agnes 2.5 Pro Alpha 模型权重,该模型为 Qwen3.5-397B 的后训练衍生版本,参数量为 397B,采用 Apache 2.0 许可证。模型支持 1M token 上下文窗口、65536 输出 token、图像理解、扩展推理与工具调用。官方称其在八项 Artificial Analysis 评测中有六项优于 Qwen3.5-397B。

相关链接:
- https://huggingface.co/Agnes-AI/Agnes-2.5-Pro-Alpha
- https://wiki.agnes-ai.com/en/docs/agnes-25-pro-alpha
阿里视频模型Wan3.0正式上线 API限时7折 #6
阿里宣布视频生成模型Wan3.0正式上线,用户可在阿里云百炼、万相官网及千问等8个平台体验,API同步开启限时优惠。
阿里视频生成模型Wan3.0结束公测正式上线,在生成时长、全能参考与真实世界还原等维度实现升级。该模型单次视频生成时长达30秒,首次支持输入doc、xls、ppt、pdf及md格式文档,并在指令遵循与跨镜头一致性等方面有所提升。用户可在阿里云百炼、万相官网及千问等8个平台体验,API按分辨率定价为0.3至1.2元/秒,部分平台正推行限时7折优惠。井英科技、美图旗下RoboNeo等多家企业已接入该模型。

相关链接:
行业动态
字节整合TRAE与扣子至豆包体系 #7
据媒体报道,字节跳动将TRAE与扣子团队及产品整体并入豆包体系,其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为编程产品线。报道称豆包最快将于本周内推出面向AI办公场景的统一产品和品牌“豆包工作”。
据媒体报道,字节跳动已完成办公AI产品团队整合,TRAE与扣子团队整体并入豆包体系并向豆包产品负责人汇报,其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为编程产品线。报道称豆包最快本周内推出统一AI办公产品“豆包工作”并与飞书深度整合。字节方面回应称调整旨在协同资源且现有用户权益不受影响。

相关链接:
小米发布玄戒三款自研芯片并展出AI Cube原型机 #8
小米发布 O3、O100及D100 三款芯片,其中O3已开启规模量产,O100与D100研发完成并计划于明年商用。O3将搭载于小米18 Fold与小米平板9 Pro Max并于9月上市或发布,同时官方展出了集成三芯的AI Cube Prototype原型主机。
小米在玄戒芯片技术沟通会上发布O3、O100及D100三款芯片,均已通过回片验证,其中O3已开启规模量产,O100与D100研发完成并计划于明年商用。据官方数据,O3作为AI旗舰SoC安兔兔跑分达522万且首发支持LPDDR6,O100为行业首颗6nm 3D晶圆级堆叠AI加速芯片且具备1.22TB/s近存带宽,D100为国内首款3nm智驾芯片且最高支持160GB统一内存。O3将搭载于小米18 Fold与小米平板9 Pro Max并于9月上市或发布,同时官方展出了集成三芯且支持150W性能释放的AI Cube Prototype原型主机,该主机未公布售价与上市时间。


相关链接:
SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72 #9
SpaceXAI宣布将部署NVIDIA Vera CPU加速Agent AI,并计划明年四季度发射搭载Vera Rubin NVL72的Starmind卫星入轨。
NVIDIA宣布SpaceXAI将部署NVIDIA Vera CPU加速其Agent AI应用,并扩展支撑Grok的AI基础设施。此外,SpaceXAI正计划将优化后的Vera Rubin NVL72延伸至太空,其首颗Starmind卫星预计明年四季度发射入轨并于2028年显著扩规,旨在适应轨道环境的同时保持与地面相同的架构与软件生态。

相关链接:
- https://x.com/elonmusk/status/2091939113008238838
- https://nvidianews.nvidia.com/news/spacexai-adopts-nvidia-vera-cpu-to-accelerate-agentic-ai-at-massive-scale
NVIDIA 发布 Vera Rubin NVL72 性能数据 #10
NVIDIA 官方博客发布 Vera Rubin NVL72 系统实测数据,称其在 Agent 工作负载下较 GB300 NVL72 每兆瓦吞吐量提升最高达 30 倍,每百万 token 成本降低最高达 35 倍。
NVIDIA 官方博客公布了 Vera Rubin NVL72 系统的最新实测性能数据,显示该系统在运行 Agent 工作负载时,较 GB300 NVL72 实现最高 30 倍的每兆瓦吞吐量提升与最高 35 倍的每百万 token 成本下降。该测试通过 SemiAnalysis AgentX 工作负载中的真实 Agent 编码轨迹完成,主要针对 DeepSeek V4 Pro 模型测得。NVIDIA 强调这些结果为早期数据,目前正等待 SemiAnalysis 审查,且尚未反映用于工具调用的 Vera CPU 性能。官方称 Vera Rubin 已进入全面量产阶段,并正跨生态系统扩展规模。


相关链接:
NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理 #11
NVIDIA宣布Groq 3 LPX全面投产以扩展Vera Rubin平台Agent推理,并发布网络与基础设施更新。
NVIDIA宣布交互式AI推理加速器Groq 3 LPX全面投产,作为Vera Rubin NVL72平台的扩展,专为Agent系统提供超快Token生成。官方基准测试显示,运行Gemma 4 31B模型及10万Token上下文时,其输出达每秒3400个Token,速度为最接近替代平台的4倍。Nebius成为首个采用该加速器的AI云服务商。

相关链接:
- https://blogs.nvidia.com/blog/vera-rubin-lpx-spectrum-x-nvlink-fusion/
- https://nvidianews.nvidia.com/news/nvidia-groq-3-lpx-now-in-full-production-with-world-class-speed-for-agentic-ai
传Nvidia拟投资Perplexity AI数十亿美元 #12
据媒体援引消息人士报道,Nvidia正商谈向Perplexity AI投资数十亿美元并磋商技术授权,该轮融资估值超300亿美元。
据媒体报道,Nvidia正商谈在Perplexity AI最新股权融资轮中向其投资数十亿美元,双方还在磋商技术授权协议。此轮融资对Perplexity AI的估值超过300亿美元,其年化营收已从2026年初的不到2.5亿美元增至7.5亿美元以上。
相关链接:
Mistral AI 与 HUMAIN 布局中东主权 AI 基建 #13
Mistral AI与HUMAIN宣布战略协作,将在沙特及中东开发阿拉伯语前沿模型与部署AI基建,合作规模达数亿欧元。
Mistral AI与沙特阿拉伯公共投资基金全资子公司HUMAIN宣布达成战略协作,涵盖AI基础设施、先进模型开发及AI解决方案在沙特及中东地区的部署。双方将本地化先进AI模型,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral AI将探索使用HUMAIN的数据中心,并计划在沙特针对受监管行业制定联合市场战略,官方声明此为前瞻性表述,实际结果可能存异。
相关链接:
Thinking Machines Lab发布开源模型安全资助 #14
Thinking Machines Lab发布Tinker资助计划,为开源权重模型安全研究提供最高5万美元算力额度。
Thinking Machines Lab启动Tinker资助计划,为开源权重模型的安全研究提供最高5万美元的算力额度。该计划重点关注使模型更安全地开源、理解对齐失败模式以及测量与预测风险三大领域,具体涵盖防御主导能力训练、危险数据分类器构建、防篡改安全训练及涌现性不对齐等方向。

相关链接:
- https://thinkingmachines.ai/news/safety-research-grants/
- https://x.com/thinkymachines/status/2091979709915795759
提示:内容由AI辅助创作,可能存在幻觉和错误。
