Epoch 0
JA · EN
每日 AI 日报
2026-08-25
来源:橘鸦 AI 早报 · 14 条
MiniMax与GMI Cloud合作开放M3等模型14天免费访问
开发生态
MiniMax 与 GMI Cloud 宣布,将在原文未注明年份的 8 月 24 日至 9 月 6 日开放 14 天免费访问,覆盖 M3、M2.7、Speech 2.8 和 Music 3.0,并设置反滥用与速率限制。
MiniMax 与 GMI Cloud 宣布,将于原文未注明年份的 8 月 24 日至 9 月 6 日,通过 GMI Cloud 开放为期 14 天的 MiniMax 模型与功能免费访问。活动涵盖 MiniMax M3、M2.7、Speech 2.8 和 Music 3.0,开发者需使用 GMI API 密钥接入。官方表示,活动期间上述服务不设使用量上限,但仍适用反滥用机制和速率限制。
读原文 →
阿里云云工开物面向高校学生发放Qoder CN专业版
开发生态
阿里云“云工开物”已面向通过认证的中国高校在校生发放 Qoder CN 专业版权益,并为每名同一用户提供1张300元无门槛优惠券。该券自领取起有效1年,可用于指定公共云产品,活动结束时间以官网通知为准。
阿里云已启动“云工开物”Qoder CN 专业版高校学生活动,通过学生认证的中国高校在校生现可领取1张300元无门槛优惠券,活动已经开始,结束时间以官网通知为准。据活动规则,适用对象包括专科、本科、硕士、博士及在职研究生等具有高等教育学籍的在校生,同一用户的多个关联账号按同人账号管理。优惠券自领取之日起有效1年,可用于页面用券专区列出的部分公共云产品;单笔订单金额不超过剩余余额时可重复使用至余额为0,但不可与产品折扣或其他优惠券叠加,也不能用于后付费产品领取、提现预留金额或转让。到期未使用的余额作废,资源用量超出券额后按产品资费标准支付;适用范围不含 alibabacloud.com、jp.aliyun.com 及其下属页面。
读原文 →
OpenAI 推出美国大学生四个月免费 ChatGPT Plus
产品应用
OpenAI 向就读于美国符合条件学位授予机构的全日制及兼职学生开放 4 个月免费 ChatGPT Plus,官方标称价值 80 美元。申领人须于 2026 年 10 月 31 日前完成 SheerID 验证。
OpenAI 已推出面向美国大学生的 ChatGPT Plus 优惠,符合条件的学生须在 2026 年 10 月 31 日前通过 SheerID 完成验证并领取 4 个月免费使用期。据其说明,该优惠价值 80 美元,适用对象包括就读于美国学位授予机构的全日制学生和兼职学生。新用户在激活 ChatGPT Plus 时需要添加付款方式,但在 4 个月免费期内不会被扣费。
读原文 →
Anthropic 升级 Claude 流式渲染器
产品应用
Claude 网页端和桌面端换用 Anthropic 重建的流式渲染器,长回答输出平滑度约提升 4 倍。官方称,慢速笔记本上的卡顿减少 9 倍,最长冻结时间缩短 4.5 倍。
Anthropic 重建了 Claude 网页端与桌面端使用的流式渲染器,长回答在持续生成时的流式输出平滑度约提升 4 倍。官方表示,新渲染器目前的处理对象仅限于仍在变化的内容,这一处理方式用于改善长回复流式输出时的卡顿和冻结。据其说明,在慢速笔记本上,长回复的卡顿减少 9 倍,最长一次冻结的持续时间缩短 4.5 倍;在刷新率为 120Hz 的 MacBook 上,回答从开始生成到全部输出结束都可维持 120fps。
读原文 →
Agnes AI 开源 Agnes 2.5 Pro Alpha 多模态推理模型
模型发布
Agnes AI 推出多模态模型 Agnes 2.5 Pro Alpha,并通过 API 提供服务。该模型基于 Qwen3.5-397B-A17B 继续训练,仓库采用 Apache License 2.0。
Agnes AI 已发布 Agnes 2.5 Pro Alpha,评测快照截至 2026 年 8 月 18 日,模型可通过 OpenAI-compatible Chat Completions 和 Responses APIs 使用。它是 Qwen/Qwen3.5-397B-A17B 的 post-trained derivative,由 Agnes AI 追加 post-training;仓库和上游模型均采用 Apache License 2.0,并保留原始版权声明。据其说明,模型会为复杂任务使用 extended reasoning,适用范围包括代码库级 coding、技术研究、文档综合、视觉分析及带工具的 Agent。
该模型与 Qwen3.5-397B、Qwen3.7-Max、GLM-5.2-744B、MiniMax-M3-428B、DeepSeek-V4-Pro-1.6T、Claude Opus 4.7、Claude Opus 4.8 对比,结果均来自 Artificial Analysis 的独立 benchmark measurement。Quickstart 使用 8-GPU tensor parallelism,checkpoint 为多分片 BF16 package,单张 GPU 不足以运行。官方要求采用 sampling 而非 greedy decoding,为 extended reasoning 预留足够的 max_tokens 或 max_output_tokens,并在回复提前结束时提高上限;API key 应存入环境变量,图像输入需使用公开可访问的 URL。官方表示输出可能有误,高影响决策和工具动作需要在 application layer 验证,发送敏感或受监管数据前需查看 Agnes AI service terms。
读原文 →
阿里视频模型Wan3.0正式上线 API限时7折
模型发布
阿里视频生成模型 Wan3.0 已结束公测并正式上线,单次可生成最长 30 秒视频,API 价格为每秒 0.3 至 1.2 元。该模型已登陆 8 个平台,部分平台提供限时 7 折优惠。
阿里已将视频生成模型 Wan3.0 从公测转为正式服务,用户现可在阿里云百炼、万相官网、千问等 8 个平台使用。模型单次视频生成时长上限为 30 秒,并首次支持输入 doc、xls、ppt、pdf 和 md 格式文档;官方表示,生成时长、全能参考、真实世界还原、指令遵循和跨镜头一致性等能力均有升级。API 按分辨率计费,价格为每秒 0.3 至 1.2 元,部分平台正在提供限时 7 折优惠。井英科技、美图旗下 RoboNeo 等多家企业已接入 Wan3.0。
读原文 →
字节整合TRAE与扣子至豆包体系
行业动态
媒体报道称,字节跳动将 TRAE 与扣子团队整体纳入豆包体系,完成办公 AI 产品团队整合;相关能力将按办公场景和编程产品线重组,官方称现有用户权益不受影响。
据媒体报道,字节跳动已完成办公 AI 产品团队整合,TRAE 与扣子团队整体并入豆包体系,整合后的团队向豆包产品负责人汇报。产品层面,报道称 TRAE Work 和扣子将与豆包的工作场景能力整合,TRAE IDE 与 CLI 则归入编程产品线。报道还称,豆包将推出统一 AI 办公产品“豆包工作”,并与飞书深度整合。字节跳动官方表示,此次调整旨在协同资源,现有用户权益不受影响。
读原文 →
小米发布玄戒三款自研芯片并展出AI Cube原型机
行业动态
小米于 2026 年 8 月 24 日发布玄戒 O3、O100、D100 三款自研芯片,并展出 AI Cube 原型机。雷军称,三款芯片均完成回片验证,O3 将首发于小米 18 Fold,另两款计划 2027 年商用。
在 2026 年 8 月 24 日举行的玄戒芯片技术沟通会上,小米正式推出玄戒 O3、O100 和 D100,现场同时展示 AI Cube 原型机。小米创办人、董事长兼 CEO 雷军表示,三款芯片覆盖小米“人车家”全生态的端侧 AI 算力需求,均已完成回片验证;玄戒 O3 将在最高端折叠新品小米 18 Fold 上首次亮相,玄戒 O100 和 D100 将于 2027 年正式商用。据其说明,玄戒被定位为小米全生态的 AI 算力底座,覆盖从口袋、座舱和客厅到工厂的场景,既属于小米的芯片战略,也被其称为小米 AI 战略的物理基础。
读原文 →
SpaceXAI部署NVIDIA Vera CPU并计划发射太空版NVL72
行业动态
NVIDIA 宣布 SpaceXAI 的 AI 基础设施将采用 Vera CPU,并计划把优化后的 Vera Rubin NVL72 带入轨道。首颗 Starmind 卫星预计于 2027 年第四季度入轨,2028 年扩规。
NVIDIA 宣布,SpaceXAI 将部署 NVIDIA Vera CPU,用于加速 Agent AI 应用,并扩展支撑 Grok 的 AI 基础设施;SpaceXAI 还计划将为轨道环境优化的 Vera Rubin NVL72 部署到太空。首颗 Starmind 卫星预计于 2027 年第四季度发射入轨,并在 2028 年扩大部署规模。据 NVIDIA 说明,太空版系统的设计目标是在适应轨道环境的同时,保持与地面系统相同的架构和软件生态。
读原文 →
NVIDIA 发布 Vera Rubin NVL72 性能数据
行业动态
NVIDIA 公布 Vera Rubin NVL72 早期数据:在 AgentX 测试中,其每兆瓦吞吐量最高达 GB300 NVL72 的 30 倍,每百万 token 成本可降至后者的 1/35。
NVIDIA 公布了 Vera Rubin NVL72 在 Agent 工作负载上的当前推理性能,表示该系统在 SemiAnalysis AgentX 收录的真实 Agent coding session 中,每兆瓦吞吐量最高为 GB300 NVL72 的 30 倍。该工作负载保留了实际的 context 增长、tool call 和 sub-agent spawning;其中 DeepSeek V4 Pro 的结果仍待 SemiAnalysis 审核,且尚未计入 Vera CPU 执行 tool calling 的性能。据其说明,Vera Rubin NVL72 的每百万 token 成本可降至 GB300 NVL72 的 1/35;GB300 NVL72 在同一模型上的每兆瓦吞吐量则最高为 NVIDIA Hopper 架构的 15 倍。
OpenRouter 数据显示,Agentic AI 工作负载消耗的 token 是简单 chat request 的 15 倍。NVIDIA 表示,普通 chat 或文档摘要的输入与输出序列通常为 1K–8K token,而 Agent session 的 context 会在多步执行中累积至数十万 input token。其称,Rubin GPU 的第五代 Tensor Cores、第三代 Transformer Engine 与 NVFP4 quantization 用于加速 prefill 和 decode;第六代 NVLink 及 NVLink Switches 的 packet rate 为现成 Ethernet 替代方案的 10 倍,latency 降至其 1/3。据其说明,DSX MaxLPS 可在相同兆瓦预算内部署最多增加 40% 的 GPU。Vera Rubin 采用 seven-chip architecture,另含 Vera CPU、Groq 3 LPU、NVLink 6 Switch、BlueField-4 DPU、Spectrum-6 SPX 和 ConnectX-9 SuperNIC;官方表示该平台已全面投产。
读原文 →
NVIDIA发布全面投产的Groq 3 LPX扩展Vera Rubin推理
行业动态
NVIDIA 宣布用于 Vera Rubin NVL72 的 Groq 3 LPX 已全面投产;官方称其在 100,000-token 测试中达到每秒 3,400 个输出 token,为最近替代平台的 4 倍。
面向 Agentic AI 推理的 NVIDIA Groq 3 LPX 已进入全面投产阶段,并作为 token 生成专用加速扩展与 Vera Rubin NVL72 协同运行。官方表示,在 Artificial Analysis 使用开源 Agent 模型 Gemma 4 31B 的测试中,该系统面向 100,000-token 长上下文场景实现每秒 3,400 个输出 token,达到最近替代平台的 4 倍。其架构由 Rubin GPUs 处理大规模上下文,LPX 承担对延迟敏感的 decode 工作负载,以覆盖 Agent 推理、tool use 和系统交互中的逐 token 响应。
据 NVIDIA 说明,Nebius 成为首个采用 NVIDIA Groq 3 LPX 的 AI cloud,并将在 Nebius Token Factory 中加入该产品,用于交互式 Agent、coding 系统和其他实时 AI 应用。CoreWeave 已在生产环境部署 Spectrum-X Multiplane,通过多个并行 switch 连接 Vera Rubin racks,以提供高带宽、扁平且无损的 AI network。SpaceXAI 表示,其未来 AI 架构将以 Vera Rubin 为基础,覆盖地面 data centers 至轨道 satellites,并计划部署 Vera CPUs,处理 Agentic AI 的 orchestration、tool use、code execution、data processing 和 simulation。
读原文 →
传Nvidia拟投资Perplexity AI数十亿美元
行业动态
媒体于2026年8月24日报道,Nvidia正商谈在Perplexity AI新一轮股权融资中投资数十亿美元;该轮融资估值超过300亿美元,后者年化营收已升至7.5亿美元以上。
2026年8月24日,媒体报道称,Nvidia正在商谈参与Perplexity AI最新一轮股权融资并投入数十亿美元,双方同时也在磋商一项技术授权协议。据报道,该轮融资对Perplexity AI的估值超过300亿美元。其年化营收在2026年初低于2.5亿美元,此后已增至7.5亿美元以上;融资估值和营收数据均来自此次媒体报道。
读原文 →
Mistral AI 与 HUMAIN 布局中东主权 AI 基建
行业动态
Mistral AI 与 HUMAIN 宣布在沙特阿拉伯及中东开展主权 AI 战略合作,覆盖基础设施、模型开发与行业部署;官方称合作规模为数亿欧元,初期重点包括阿拉伯语、网络安全和语音。
Mistral AI 与 HUMAIN 宣布建立覆盖沙特阿拉伯及中东的战略合作,涉及 AI 基础设施、先进模型开发和 AI 解决方案部署,官方表示合作规模为数亿欧元。双方计划开发并本地化先进 AI 模型,初期聚焦网络安全和语音,同时开发强化阿拉伯语能力的 frontier models。Mistral AI 将评估使用 HUMAIN 的数据中心基础设施,以满足当地增长的算力需求;双方还计划制定面向沙特阿拉伯市场的联合 go-to-market 策略,为受监管行业提供 AI 解决方案。据其说明,该合作所指的主权 AI 允许客户控制数据、智能、算力和运营,并可在客户选择的基础设施及司法管辖区内进行训练和 inference,以 open weights 调整和持有模型。公告同时说明,相关内容包含前瞻性陈述,实际结果可能因风险、不确定性及后续商业协议而不同。
读原文 →
Thinking Machines Lab发布开源模型安全资助
行业动态
Thinking Machines Lab 启动 Tinker 资助,每笔最高 50,000 美元 credits,支持 open-weight 安全研究。方向为危险数据识别、抗篡改训练与 reward hacking。
Thinking Machines Lab 已启动 Tinker open-weight 模型安全研究资助,每笔提供最高 50,000 美元的 credits。该计划在 Inkling 和 Inkling-Small 以 open weights 形式发布后推出,面向可由额外 Tinker credits 加速的安全项目。列出的研究方向包括在 defensive fine-tuning 后分别测量攻方和守方的能力增幅,以判断差距是真实不对称,还是会在攻击压力下消失的抑制或只在测量中持续的 sandbagging;另一方向是训练能以足够规模和 recall 识别危险数据的 classifier,并通过下游 fine-tuning 测量过滤是否降低危险能力增幅。
研究范围还包括开发可在 adversarial fine-tuning 和普通 continued training 后保留的安全措施,以未见过的攻击策略测试泛化,并分析规模与 architecture 对 robustness 的影响。其余问题涉及窄范围有害 fine-tuning 何时扩展为广泛行为变化,模型能否把 planning、tool use 和领域知识组合成未在训练中端到端展示的行为,以及 reward hacking 如何随模型能力和 optimization pressure 变化。项目也关注早期信号能否在问题恶化前作出预测,以及规避或干扰 chain-of-thought monitors 的策略能否被检测并跨任务迁移。官方表示,这些方向并非完整清单。
读原文 →