每日 AI 日报

2026-09-09

来源:橘鸦 AI 早报 · 17 条

2026-09-09
2026-09-09 2026-09-08 2026-09-07 2026-09-06 2026-09-05 2026-09-04 2026-09-03 2026-09-02 2026-09-01 2026-08-31 2026-08-30 2026-08-29

OpenAI 发布 Navier–Stokes 方程 AI 解法

要闻

OpenAI 发布 Navier–Stokes 方程 AI 解法

OpenAI 宣布其内部多 Agent 系统给出 Navier–Stokes 千禧年难题解答,并公开证明及 Lean 形式化证明;约 10,000 个 Agent 用时约 88 小时,验证再耗时 17 小时。

OpenAI 已公布其内部多 Agent 系统对 Navier–Stokes 存在性与光滑性千禧年难题的解答,并同时发布证明文稿与 Lean 形式化证明。据其说明,该证明构造了一个初始光滑且静止的三维不可压缩流体:在光滑外力作用下,流速在有限时间内趋于无穷大,但总能量始终有限,因此确立官方问题表述中的 C、D 两项。该构造中的涡旋会持续向内收缩、沿轴向拉长并加速。

求解使用一个仍在训练的下一代内部模型,官方称其能力显著超过 GPT-6 Astra;约 10,000 个 Agent 协作约 88 小时得出解答,随后 GPT-6 Astra 额外运行 17 小时,完成 Lean 形式化与验证。求解过程产生约 2,700,000 条消息,消耗约 130,000,000,000 个输出 token。据 OpenAI 说明,该系统此前还给出无外力 Euler 方程正则性问题的反证。OpenAI 同时承认 Levent Alpöge 与 Tristan Buckmaster 在有外力 Euler 问题上的工作具有优先性,并表示不打算申领此次成果对应的千禧年大奖。

读原文 →

OpenAI 发布 ChatGPT Images 2.5

要闻

OpenAI 发布 ChatGPT Images 2.5

OpenAI 发布 ChatGPT Images 2.5,并已在 ChatGPT 各端及 API 开放使用。官方称,新模型较 Images 2.0 的生成延迟最多降低 50%,同时增强人物还原和局部编辑能力。

OpenAI 已将新一代图像模型 ChatGPT Images 2.5 上线,目前向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端,两款配套 API 模型也已可用。官方表示,与 Images 2.0 相比,新模型的生成延迟最多降低 50%,光影与纹理更自然,对参考照片中人物的还原更好;多轮编辑可只调整指定区域,并保持其他细节不变。ChatGPT 同期加入 Sketch 草图、海报等模板及图片评论编辑功能,用户可在对话框输入 @Sketch 直接生成草图图像,分享图片时也可附上提示词。API 提供 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst,前者被定位为多数应用的默认选择,后者用于高端创意场景,精度更高,但生成耗时更长。

读原文 →

DeepSeek 开启 V4.1 Flash 中间版本测试

要闻

DeepSeek 开启 V4.1 Flash 中间版本测试

DeepSeek 的 V4.1 Flash 中间版本已进入 API 用户测试,调用无需更改 base_url。测试版与 deepseek-v4-flash 同价,每个账号限 20 并发。

DeepSeek 已面向 API 用户开放 V4.1 Flash 中间版本测试。用户可保持 base_url 不变,将模型名设为 deepseek-v4.1-flash-expires-on-0910,其中 0910 为版本号;该版本当前计费标准与 deepseek-v4-flash 相同,每个账号的限流为 20 并发。官方表示,新版本采用新的模型结构,原生支持多模态,能力更强、速度更快、成本更低。DeepSeek 同时提供匿名问卷,收集账号、使用的 Agent 工具或框架及测试反馈,并询问测试者该模型能否全面替换线上的 DeepSeek V4 Pro。

读原文 →

DeepSeek 宣布9月10日12:00起调整 flash 系列定价

要闻

DeepSeek 宣布9月10日12:00起调整 flash 系列定价

DeepSeek 将于北京时间 2026 年 9 月 10 日 12:00 调整 flash 系列价格:空闲时段三类单价为 0.02 元、1 元和 4 元,高峰时段按两倍计费。

DeepSeek 宣布,其开放平台 flash 系列新定价将于北京时间 2026 年 9 月 10 日 12:00 生效。按照公告,空闲时段的输入缓存命中、输入缓存未命中和输出单价依次为 0.02 元、1 元和 4 元,高峰时段对应价格均为空闲时段的 2 倍。社区用户对比称,这三项此前在空闲时段的单价分别为 0.05 元、1.5 元和 4.5 元,据此计算的降幅分别为 60%、33% 和 11%。公告同时提醒用户合理安排使用。

读原文 →

小米 MiMo Desktop 桌面客户端正式开放邀测

要闻

小米启动 Xiaomi MiMo Desktop 邀请测试,审核通过者可在限时、限量条件下免费体验 2 款 Preview 模型。据其说明,客户端可交付能继续编辑的 PPT、网页、3D 和 App。

小米已正式开放 Xiaomi MiMo Desktop 桌面客户端及新一代模型 Preview 版邀测,申请者须在邀测页面提交申请并通过审核后下载使用。据其说明,该应用面向真实工作场景,可直接接收多格式素材,理解目标后拆解任务并调用工具,输出可继续编辑的 PPT、网页、3D 和 App,同时支持交互式预览、局部修改和版本回退。审核通过者可在邀测期间限时、限量、免费体验 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview,邀测优先面向 Xiaomi MiMo 开放平台已有用户。官方表示,MiMo-X 系列仍处于预览测试阶段,能力可能随版本迭代变化;电脑操控功能仅限海外版,服务暂不在欧盟、英国和韩国提供。

读原文 →

Google DeepMind 发布 AlphaGenome Atlas

模型发布

Google DeepMind 推出面向全球科研界的 AlphaGenome Atlas,以 1PB 数据覆盖人类基因组 90 亿种可能的单字母 DNA 变化,并提供影响评分、网页与 API 访问。

Google DeepMind 现已向全球科学界开放 AlphaGenome Atlas,可通过网站、AlphaGenome API 及 Google Antigravity 中的技能访问,Google Cloud 版本即将推出。该数据库用 AlphaGenome 模型预先计算人类基因组全部 90 亿种可能的单字母 DNA 变化对调控的影响,数据规模为 1PB;官方表示,这一规模超过 AlphaFold 数据库的 30 倍。系统还提供 AlphaGenome Variant Impact 评分,综合 AlphaGenome、AlphaMissense 等特征,按影响由低到高排列突变,并呈现突变破坏基因开关或 RNA 剪接指令等机制。Sundar Pichai 表示,该资源可直接在普通浏览器中使用,无需编程,并对学术研究人员免费。

读原文 →

蚂蚁百灵开源 Ling-3.0-flash-VL

模型发布

蚂蚁百灵开源 Ling-3.0-flash-VL

蚂蚁百灵团队已开源多模态模型 Ling-3.0-flash-VL,BF16 与 FP8 两种精度版本现可下载,FP4 与 INT4 量化版本将随后推出。

蚂蚁百灵团队现已开源 Ling-3.0-flash-VL,并开放 BF16 与 FP8 两种精度版本下载;FP4 和 INT4 量化版本尚未上线,据其说明将于后续推出。该模型已发布在 Hugging Face 和 ModelScope 的 inclusionAI 账号下,上述两种精度均可获取。官方表示,Ling-3.0-flash-VL 不只执行视觉识别,还可依据视觉线索处理图像、视频、文档和 UI,完成推理、搜索与验证,并调用工具、检查结果后再交付输出。

读原文 →

Nex-AGI 开源 Nex-N2.5 系列模型

模型发布

Nex-AGI 开源 Nex-N2.5 系列模型

Nex-AGI 发布 Nex-N2.5 Agent 模型,分为 mini、Pro、Max 3 款,权重计划开源,并配套托管服务。Max 使用 1.6 万亿参数的 text-only MoE 模型。

Nex-AGI 通过项目公告正式推出 Nex-N2.5 Agent 模型系列,并宣布将开源该系列的模型权重,同时提供 hosted online services。mini 与 Pro 延续 Nex-N2 的 multimodal 基础,重点改进 computer use、web browsing 和基于视觉定位的 Agent 能力;Max 基于 1.6 万亿参数的 text-only Mixture-of-Experts(MoE)foundation model。据其说明,这是 Nex-AGI 首次在万亿参数规模完成完整 post-training。官方表示,该系列可持续操作电脑和浏览器,自主执行及测试程序,并借助视觉反馈核验结果和自我修正。

该系列的评测覆盖 coding、agentic workflows、computer use 和 multimodal understanding。Nex-AGI 的评测采用 temperature = 0.7、top_p = 0.95、top_k = 40,coding 任务使用 NexAU harness,computer-use 与 browser-use benchmark 使用 NexCUA harness。部署方面,官方提供预装定制 sglang fork 的 Docker image nexagi/sglang:v0.5.18-nex-patch;在 OpenAI-compatible Chat Completions 中将 reasoning_effort 设为 "medium" 可启用 adaptive thinking,function calling 需在启动服务器时加入 --tool-call-parser qwen3_coder。

读原文 →

OpenUI 发布开源权重模型 OUI-1

模型发布

OpenUI 发布开源权重模型 OUI-1,用 openui-lang 生成用户界面。官方表示,它可在 RTX 5090 上以 FP8 运行,Generative UI 基准得分由 13.0% 升至 57.1%。

OpenUI 已发布开源权重模型 OUI-1,权重按 Gemma Terms of Use 上架 Hugging Face,用于生成 openui-lang 格式的用户界面。据其说明,该模型基于 DiffusionGemma 微调,可在 RTX 5090 上以 FP8 本地运行;DiffusionGemma 每次处理一个 256-token block,不同于逐 token 生成的 autoregressive model。OpenUI Lang 相比 JSON 最多可减少 67% token,并可在模型完成生成前开始流式呈现界面。

训练分为 supervised fine tuning 和 self-distillation 两个阶段。首轮使用约 700 个由更大模型生成、覆盖 7 个 component library 的 OpenUI Lang 样本,在 1 张 A100 上进行 LoRA fine-tune;缩小到基准所用的单一 component library 后,得分从 13.0% 升至 28.8%,但在相同 20 个 light brief 上,每次输出耗时从 1.6 秒增至 4.3 秒。随后,模型生成数百个程序,由 parser 筛选或按报错修复,再由 judge 检查是否符合 brief,并以通过的样本训练 500 steps,每轮在 1 张 A100 上耗时 1–2 小时。据官方公布的结果,self-distillation 将耗时降至 1.9 秒,输出 token 比基础 DiffusionGemma 多 28%,得分升至 57.1%;schema error 从 292 降至 76,wiring error 从 971 降至 484。该流程随后扩展至 27 个 component library。

读原文 →

Inception Labs 发布 Mercury 2.5

模型发布

Inception Labs 发布 Mercury 2.5

Inception Labs 发布 Mercury 2.5,官方称其智能水平较 Mercury 2 提升 40%,运行速度达每秒 1107 tokens,支持 260K tokens 上下文。

Inception Labs 已正式发布 Mercury 2.5,并通过 Inception API、OpenRouter 和 Baseten 向用户开放,新账户包含 1 亿免费 tokens。据其说明,该 diffusion LLM 是公司目前最强的生产模型,也是市面上最强的 diffusion LLM。官方数据显示,其智能水平较 Mercury 2 提升 40%,与 GPT-5.6 Luna(Low)和 Gemini 3.5 Flash-Lite 相当,在广泛可用的 NVIDIA GPU 上运行速度达每秒 1107 tokens,并支持 260K tokens 上下文。功能包括可调推理、并行工具调用和 schema 对齐 JSON。Mercury Voice 与 Mercury Router 已同步开放预览;官方表示,下一代模型已开始训练,计划在数月内发布。

读原文 →

Meta 正式推出个人 AI Agent 应用 Muse

产品应用

Meta 推出个人 AI Agent 应用 Muse,可并行处理多项任务,并在应用关闭后继续后台运行。据官方说明,它配有自己的计算机、文件系统、terminal 和完整 web browser,可填写表单、完成预订与购买。

Meta 已正式推出个人 AI Agent 应用 Muse,用于主动执行目标与任务,并可在应用关闭后继续处理后台工作。据官方说明,Muse 拥有自己的计算机、文件系统、terminal 和完整 web browser,能够编写代码、构建任务所需工具、搜索和浏览网站、填写表单,以及完成预订和购买;它也能生成文档、PDF 和网页。用户可同时发送多项任务或中途打断,Muse 会按计划或相关事件继续推进,并在完成后台工作后判断是否出现新信息或需要用户输入,再决定是否通知。

产品以一个持续的主 chat 承载交流,不要求用户等待上一项任务响应结束;其 memory 可跨对话保留,复杂主题则可放入 side chats。Muse 能在没有新 prompt 的情况下主动发送消息,用户可关闭、调低或调高这一功能。用户还可创建 avatar、为其命名并设定风格。为呈现后台行为,界面会在 avatar 下显示工作摘要,点击后可查看完整 activity log 和已批准的 permissions;Settings 与 Memory files 也可直接查看或编辑,Goals tab 用于汇总正在跟踪的事项及执行计划。

读原文 →

DaVinci Resolve 21.1 发布:集成 Claude 等 AI 助手

产品应用

Blackmagic Design 的 DaVinci Resolve 21.1 于 2026 年 9 月 8 日上线,可配合 Claude 等 AI 助手执行项目任务;Python 高级脚本已转入 Studio 版。

Blackmagic Design 于 2026 年 9 月 8 日发布 DaVinci Resolve 21.1,并开放从公司官网免费下载。官方表示,本次更新集成了 AI 助手,并扩展相机格式支持。据媒体报道,新版可与 Claude、Claude Code、ChatGPT Codex 等配合,通过提示词完成项目分析、媒体管理、批量渲染,以及从长视频制作高光剪辑。官方发布说明还显示,Python 高级脚本功能已从免费版移至 Studio 版,Windows 和 Linux 仅支持单处理 GPU。

读原文 →

Runway 推出 Adobe 插件,Pr 与 AE 内可直接生成视频

产品应用

Runway 推出 Adobe 插件,Pr 与 AE 内可直接生成视频

Runway 推出 Adobe 插件,用户可在 Premiere Pro 和 After Effects 时间线内生成图像与视频、重设素材风格并插入结果。插件免费下载,插件内生成适用于所有付费方案并消耗 credits。

Runway 现已推出可在 Adobe Premiere Pro 和 After Effects 内运行的 Runway Plugins,用户无需离开时间线即可生成图像和视频、重设素材风格,并把结果直接放入 comp 或 sequence。据其说明,插件面板省去了导出画面、上传至浏览器、下载结果和重新导入的流程;生成过程会显示在 feed 中,在 Premiere Pro 里,结果会出现在 playhead 位置并可继续剪辑。

Edit Studio 可处理 comp 或 sequence 中已选中的 clip。官方表示,用户重设 anchor frames 的风格后,Aleph 2 会按照源素材的相同时长重新渲染完整 clip,用户可在面板中对比处理前后的版本,再将结果放回编辑项目。面板支持登录现有账户,并通过 workspace switcher 切换团队;生成任务使用原有方案及 credits。HDR conversion、background removal 和 upscaling 可对任一已选 clip 或 feed asset 一键执行。插件可在 macOS 和 Windows 上免费下载,插件内生成功能适用于所有付费方案。

读原文 →

OpenAI Navier-Stokes 证明引发署名与数据争议

行业动态

OpenAI Navier-Stokes 证明引发署名与数据争议

数学家 Tristan Buckmaster 称,OpenAI 获悉其研究进展后推进相关证明,并以合作者任职 Anthropic 为由排除其署名;OpenAI 否认解题时查看两人的未公开工作。

数学家 Tristan Buckmaster 通过公开声明,披露他与 OpenAI 围绕 Navier-Stokes 相关证明的发表安排、论文署名和 Codex 数据使用发生争议。据 Buckmaster 叙述,OpenAI 得知他与合作者 Levent Alpöge 的研究进展后启动相关研究,并提议由 Buckmaster 单独撰写一篇介绍 OpenAI 证明的论文,理由是 Alpöge 任职 Anthropic,因此不将其列为作者。Buckmaster 称,他拒绝后告知对方将公开事情经过,对方随后说出涉及其职业生涯的言辞。他还要求确认两人上传至 Codex 的草稿是否被用于模型训练,但表示自己不知道相关数据实际是否被使用。

OpenAI 在公告中表示,这项研究由相关传言触发,公司原本希望协调发布,并认可 Buckmaster 和 Alpöge 在有外力作用的 Euler 方程研究上的在先成果。官方称,其研究人员和 Agent 在两人公开成果前均未看过相关工作,也没有为解题访问特定用户数据,但无法排除两人使用产品时产生的去标识化数据曾帮助改进模型。OpenAI 研究员 Sébastien Bubeck 表示,署名讨论针对一篇介绍 OpenAI 证明的新论文,并非要求删除 Alpöge 在其本人研究中的署名;他同时为涉及“毁掉职业生涯”的措辞道歉。

读原文 →

Mistral 完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元

行业动态

Mistral 完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元

Samsung Electronics 领投了 Mistral 的 30 亿欧元 D 轮融资,公司投后估值超过 210 亿欧元。官方称,该交易创下欧洲科技企业股权融资规模纪录。

Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,本轮由 Samsung Electronics 领投。Scaleup Europe Fund(由 EQT 管理)和现有投资者 PSG Equity 担任共同领投方;Advent、BlackRock 管理的基金及账户和卢森堡大公国作为新投资者加入,a16z、ASML、NVIDIA、Salesforce Ventures 等现有投资者也参与。本轮在公司成立三年后完成。官方称,这是欧洲科技公司迄今完成的最大规模股权融资;此前其 C 轮由 ASML 领投。

据其说明,资金将用于扩大 frontier research 和模型训练 compute capacity、扩建基础设施,并推进商业增长和国际布局。Mistral 目前在 20 个国家开展业务,为 125+ 家全球企业的关键 AI 转型提供支持,包括 Airbus、ASML 和 HSBC。官方将其方案定义为由 open-weight models、基础设施、compute capacity 与生产级产品组成的 full stack,并称该架构可避免客户受单一供应商的路线图、定价或可用性约束,也无需向组织外部暴露数据、工作流和机构知识。其所称的 sovereign AI 涵盖四个控制层面:数据留在组织边界内,模型可控且可定制,compute 私有且可预测,生产系统可控并可审计。

读原文 →

Cognition 宣布完成超 20 亿美元 E 轮融资

行业动态

Cognition 宣布完成超 20 亿美元 E 轮融资,估值达到 480 亿美元;自上一轮融资以来,其 run-rate revenue 已从 4.92 亿美元增至接近 9 亿美元。

Cognition 宣布完成 E 轮融资,筹资额超过 20 亿美元,本轮对应估值为 480 亿美元。新投资者 Andreessen Horowitz 和 Accel 领投,Founders Fund、General Catalyst 与 Avenir 等现有投资者参投,另有 Benchmark、Bessemer、Kleiner Perkins、Greylock、Lightspeed 等机构加入。官方披露,自上一轮融资以来,公司 run-rate revenue 从 4.92 亿美元增至接近 9 亿美元。据其说明,Devin 已用于 NVIDIA 的芯片设计、GE Aerospace 的航空业务、Citi 的金融服务、Mercedes-Benz 的汽车业务,以及 Modal 的 AI infrastructure。

Cognition 于 2024 年成立,并将工程师定位为负责设定目标和优先级的架构师,把更多执行工作交给 Agent。官方表示,当前功能包括用于初步调查事故的 Devin Auto-Triage、发现并分类漏洞的 Devin Security Swarm,以及可由 Slack、GitHub、Linear 等系统事件触发工作的 Devin Automations。公司称,其作为独立 Agent lab,可选择并组合包括自研模型在内、适合具体工作的模型,而不把客户绑定到单一供应商。过去一年,Cognition 在 Washington, D.C.、Tokyo、Singapore、London、São Paulo 和 Madrid 开设办公室,并在 San Francisco、New York 与 Austin 设有枢纽。

读原文 →

OpenAI 承包 Firmus 马来西亚两处 AI 工厂专用算力

行业动态

OpenAI 承包 Firmus 马来西亚两处 AI 工厂专用算力

Firmus 与 OpenAI 于 2026 年 9 月 8 日宣布多年合作,OpenAI 将承包马来西亚两座 AI Factory 的专用算力,使 Firmus 面向全部客户的签约容量超过 900 MW。

Firmus 与 OpenAI 于 2026 年 9 月 8 日达成多年战略合作,OpenAI 将从 Firmus 位于马来西亚的两处 AI Factory 获取专用 AI 算力,并成为其 anchor customer。该合作计入后,Firmus 面向全部客户的签约容量已超过 900 MW。其设施组合覆盖澳大利亚、新加坡、印度尼西亚和马来西亚 4 个国家,共有 7 座 AI Factory;其中位于澳大利亚和新加坡的 2 座已投入运营,另有 5 座正在开发,目标是在未来 24 个月内达到 ready-for-service 状态。

合作涉及的 AI Factory 将采用 NVIDIA DSX AI Factory Platform,把 NVIDIA Vera Rubin NVL72 rack-scale systems 与 Firmus HyperCube platform 集成。HyperCube 将液冷、机械系统和电气化整合为可重复部署的基础设施系统,并在新南威尔士州地方地区制造和预制。据 Firmus 说明,公司将在亚太地区规模化部署 NVIDIA Vera Rubin,相关设施将覆盖供电、冷却、accelerated computing systems、networking、software 和 workload performance。Firmus 还计划设立 Australian AI Access Program,支持符合条件的研究人员和机构将 AI 用于科学、教育、农业、能源与资源效率及气候韧性领域。

读原文 →