每日 AI 日报

2026-10-09

来源:橘鸦 AI 早报 · 30 条

2026-10-09
2026-10-09 2026-10-08 2026-10-07 2026-10-06 2026-10-05 2026-10-04 2026-10-03 2026-10-02 2026-10-01 2026-09-30 2026-09-29 2026-09-28

OpenAI 为 GPT-6.1 Sol 推出 Ultrafast 模式

开发生态

OpenAI 为 GPT-6.1 Sol 推出 Ultrafast 模式

OpenAI 正在 API、Codex 和 ChatGPT Work 上线 GPT-6.1 Sol 的 Ultrafast 模式;官方称速度最高为 Sol Standard 的 8 倍,API 每百万输入和输出 token 分别收费 12 美元和 60 美元。

OpenAI 为 GPT-6.1 Sol 推出的 Ultrafast 模式正在 API、Codex 和 ChatGPT Work 上线,已覆盖所有支持区域,并支持美国和欧盟数据驻留。API 向所有用户开放,每百万输入 token 的价格为 12 美元,每百万输出 token 为 60 美元。Codex 和 ChatGPT Work 的开放范围包括 Pro 500,以及符合条件的按量付费 Enterprise、配额计费 Edu 订阅方案,其中 Enterprise 需要管理员开启权限。官方表示,Ultrafast 的速度最高可达 Sol Standard 的 8 倍,智能水平接近 Astra。

读原文 →

OpenAI 为桌面应用中的 Codex 推出更快的 steering

开发生态

OpenAI 为桌面应用中的 Codex 推出更快的 steering

OpenAI 正在为 ChatGPT 桌面应用中的 Codex 更新 steering,让任务执行期间的追加指令更快得到响应。用户可选择用追加消息调整当前任务,或将消息留到下一次运行时处理。

OpenAI 正在 ChatGPT 桌面应用中推出响应更快的 Codex steering,支持用户在任务运行期间发送消息来调整执行过程。追加消息的处理方式可在 Settings → General → Follow-up behavior 中设置:引导当前运行,或等到下一次运行。用户可借此纠正 Codex 的做法、补充缺失信息或改变任务方向。OpenAI Codex 团队成员 Tibo 表示,改进后的 steering 可即时生效,模型能更快响应调整,在执行过程中纠正方向,避免浪费精力。

读原文 →

阶跃星辰:Step 5 Preview 多平台免费一周

开发生态

阶跃星辰:Step 5 Preview 多平台免费一周

阶跃星辰宣布 Step 5 Preview 上线 OpenRouter,OpenCode、Cline、NousResearch、KiloCode 等平台自宣布当天起陆续开放一周免费访问,并同步提供模型资料与 API 文档。

阶跃星辰 StepFun 宣布,Step 5 Preview 已上线 OpenRouter,OpenCode、Cline、NousResearch、KiloCode 等平台从宣布当天起陆续开放为期一周的免费访问。配套发布的资料包括模型概览、基准测试、演示、技术规格与 API 文档,用户可在现有工作流中直接切换至该模型。官方表示,该模型面向 agentic 与专业工作提供旗舰级智能,任务成本显著更低;原文未给出具体成本数字或降幅。

读原文 →

Vercel AI Gateway 上线 Glyph Cluster,匿名期免费

开发生态

Vercel AI Gateway 上线 Glyph Cluster,匿名期免费

Vercel 在 AI Gateway 上提供匿名期免费使用的 Glyph Cluster,面向已购买 Gateway credits 的 Pro 和 Enterprise 团队。该模型支持编程推理,但不提供 ZDR,输入与回复可能用于训练。

Vercel 已在 AI Gateway 上线处于 stealth 阶段的 Glyph Cluster,已购买 AI Gateway credits 的 Pro 和 Enterprise 团队可在该阶段免费使用。调用时的模型名为 stealth/glyph-cluster,可通过 AI SDK、兼容 OpenAI 的 Chat Completions 和 Responses APIs 接入,也可在连接 AI Gateway 的 coding Agent 中选择。Claude Code、Codex、Cursor 等工具的接入流程是安装最新版 Vercel CLI,运行 setup,再在 Agent 中选择该模型。

官方表示,Glyph Cluster 是面向编程和长上下文分析的 reasoning model,可处理规划、综合、定量推理和跨大规模输入的材料比较,也可审查代码、解释故障、调试问题、提出修改及分析实现方案。模型支持 function calling 和流式响应,但只接受文本,不接受图像或文件;工具使用仅限用户定义的 function tools,不支持 structured outputs。该模型不提供 ZDR,经其发送的 prompts 和 responses 可能用于训练和模型改进。用户也可在 model playground 中试用。

读原文 →

Claude 推出 Dashboards 和 Motion 两项测试功能

产品应用

Claude 推出 Dashboards 和 Motion 两项测试功能

Claude 宣布推出 Dashboards 和 Motion 两项测试功能,分别面向付费套餐及 Team、Enterprise 开放;Docs、Slides 和 Design 同时结束测试,覆盖包括 Free 在内的所有套餐。

Claude 在本次公告发布时开放 Dashboards 和 Motion 的 beta,并将 Docs、Slides 和 Design 转为正式功能。Dashboards 适用于付费套餐,Motion 适用于 Team 和 Enterprise,另外三项功能覆盖所有套餐,包括 Free。官方表示,用户在 Claude 中创建的文档、演示文稿和设计已超过 4500 万份。Enterprise 的 Dashboards 和 Motion 默认关闭,管理员可在 Organization settings > Artifacts 中启用。

据官方说明,Dashboards 可连接 BigQuery、Databricks、Snowflake 等数据平台及 Salesforce,按自然语言问题生成仪表盘,并随数据变化更新;用户可查看查询和图表上次刷新时间,也可将仪表盘发送至 Amplitude、Grafana、Hex 等工具继续分析。Motion 则通过代码为文字、图表、形状和图片制作动画,支持在编辑器中修改或要求 Claude 调整,并导出 MP4。官方表示,Motion 不使用 video generation model,不生成视频素材或 AI 人物,作品还可在 Adobe、Descript、Runway 等工具中继续处理。

读原文 →

Google Cloud 发布 Gemini 工作智能体

产品应用

Google Cloud 发布 Gemini 工作智能体

Google Cloud 在 Gemini at Work 2026 发布统一工作 Agent Gemini,将问答、内容生成与代码执行整合进单一 API;官方称近 80% 的 Google Cloud 客户已使用其 AI 产品。

Google Cloud 在 Gemini at Work 2026 宣布推出面向工作的统一 Agent Gemini,原文未披露具体上线日期。官方表示,用户可通过单一界面和单一 API 交付任务目标,由 Gemini 规划工作、调用工具并连接企业系统,完成问答、知识工作、图像与媒体生成,以及代码编写和运行。它还可直接在 Gmail、Drive、Docs、Slides、Sheets、Chat 和 Calendar 中工作,沿用相同的记忆、技能与控制设置。

据其说明,Gemini 在云端持续执行任务,跨设备与渠道保留记忆和上下文,用户关闭电脑后,耗时数小时或数天的工作仍可继续。它可创建具有独立身份的临时 sub-agents,协调并行或顺序执行的流程;底层模型与 Agent 分离,目前可调度 Gemini 系列模型和 Anthropic 的 Claude 模型。官方同时公布身份与权限管理、安全 sandboxing、network gateways,以及 Smart Routing 和实时支出上限等治理与成本控制机制,并称近 90% 的 Fortune 100 企业使用 Gemini Enterprise。

读原文 →

腾讯 WorkBuddy 上线独立文件浏览器

产品应用

腾讯 WorkBuddy 上线独立文件浏览器

腾讯 WorkBuddy 已上线独立文件浏览器,可在同一窗口用标签页查看、编辑多个本地文件,并通过右侧 AI 对话栏处理内容。官方表示,本地查看和编辑不消耗积分,AI 处理则按任务复杂度计费。

腾讯 WorkBuddy 已上线独立文件浏览器,用户可通过系统双击文件或右键菜单中的打开方式进入文件窗口。同一窗口支持多个文件,每个文件对应一个标签;从本地双击打开的文件会加入当前激活的文件窗口,关闭最后一个标签会关闭整个窗口。暂不支持的文件类型不会显示 WorkBuddy 打开入口。文件打开后可直接查看和编辑,顶部工具栏随文件类型提供不同功能;关闭有未保存改动的标签或窗口时,系统会提示保存或不保存。

窗口右侧的 AI 对话栏默认收起,可通过右上角按钮展开,使用 AI 编辑也会自动展开。用户可让 AI 总结、改写、润色或补充当前文件,也可选中正文内容后引用提问,让修改结果写入文档。据官方说明,浏览器只读取用户主动打开的文件,不遍历或扫描磁盘;本地查看和编辑不消耗积分,AI 处理按实际任务复杂度消耗积分。文件内容仅用于本次任务,除用户主动分享或上传至第三方储存外,不会共享给第三方。

读原文 →

JetBrains 开源 Mellum2.1,强化学习主打编程 Agent

模型发布

JetBrains 开源 Mellum2.1,强化学习主打编程 Agent

JetBrains 开源面向编程 Agent 的 Mellum2.1,模型总参数为 12B、激活参数为 2.5B,采用 Apache 2.0 许可。官方表示,此次更新主要通过强化学习提升仓库内的代码操作能力。

JetBrains 已在 Hugging Face 发布 Mellum2.1,原文未注明具体发布日期。该模型延续 Mellum2 的 mixture-of-experts 架构,总参数为 12B,激活参数为 2.5B,以 Apache 2.0 许可开源,面向在自有硬件上运行的编程 Agent 和 sub-agents。本次更新集中于 post-training,主要采用强化学习;官方表示,训练覆盖数千个真实环境中的数百万次 sandbox 运行,使模型能够探索代码库、编辑文件并检查修改。JetBrains 在同一评测设置下将其与 Mellum2、Qwen3.5-9B 和 Gemma 4 E4B 比较,据其说明,agentic coding 是相较 Mellum2 提升最多的领域;高负载下,吞吐量接近 Qwen3.5-9B 的两倍,单请求使用 MTP 后速度约为原来的 1.6 倍。用于 llama.cpp、Ollama 和 LM Studio 的 GGUF 构建,以及用于 vLLM speculative decoding 的 MTP head 尚待发布。

读原文 →

Hugging Face 开源基因注释模型 Carbon-A

模型发布

Hugging Face 开源基因注释模型 Carbon-A

Hugging Face 发布基因注释模型 Carbon-A 及配套数据库,官方称已在 22,617 个物种中发现 5.66 亿个新基因候选。模型、训练数据和技术报告一并开放,部分预测已开展实验验证。

Hugging Face 发布 Carbon Annotation Database 和基因注释模型 Carbon-Annotator(Carbon-A),原文未注明具体发布日期。官方表示,该模型在 22,617 个物种中发现了 5.66 亿个新基因候选,其中数千个物种此前未被研究。数据库、模型、训练数据和技术报告可在 HuggingFaceBio 的 Carbon Annotation Database Collection 中获取。团队与 ActiveSite、UCSD 合作,对部分新预测基因开展了实验验证。

Carbon-A 拥有 12 亿个参数,以 RefSeq 注释训练,直接从 DNA 预测蛋白质编码区域。模型使用 98,304 个碱基对的上下文窗口,对两条链输出核苷酸级预测,并以同一模型覆盖哺乳动物、其他脊椎动物、无脊椎动物、植物、真菌和原生生物。据官方报告,在 42 个基准基因组上,其宏平均核苷酸 F1 为 0.944,在核苷酸、exon 和基因层面的表现均超过所评估的基线;在采用非标准遗传密码的 Tetrahymena thermophila 上,核苷酸 F1 为 0.960。

读原文 →

LightOnAI 开源 LightOnOCR-3

模型发布

LightOnAI 开源 LightOnOCR-3

LightOnAI 开源 LightOnOCR-3,将复杂文档转换为应用可直接使用的结构化内容。官方表示,这一系列模型除文字转录外,还支持版面元素定位、图像描述及图表数据提取;此前 LightOnOCR 在 Hugging Face 的下载量超过 450 万次。

LightOnAI 开源了端到端 OCR 模型系列 LightOnOCR-3,用于将复杂文档转换为应用可直接使用的结构化内容,原文未注明发布日期。据官方说明,该系列不只进行文字转录,还能识别并定位版面元素、生成图像描述,以及从图表和科学图示中提取数据。LightOnOCR-3 基于此前的 LightOnOCR 发展而来,后者在 Hugging Face 的下载量已超过 450 万次;这一下载数字指的是 LightOnOCR,而非新发布的 LightOnOCR-3。

读原文 →

Odyssey 发布世界模型 Odyssey-3

模型发布

Odyssey 发布世界模型 Odyssey-3

Odyssey 发布世界模型 Odyssey-3 并开放研究预览;官方称,Pro 在 Physics-IQ Verified 的 video-to-video 测试中取得最高已报告分数 66.1,模型还可用于环境模拟和训练控制策略。

Odyssey 已发布世界模型 Odyssey-3,研究预览现已开放。该模型采用 autoregressive diffusion transformer,根据此前的观察和最新输入,预测物体运动、相互作用及场景随时间的变化。开发者可从 prompt 生成环境,在生成过程中移动或引入事件,观察模型如何响应;预览支持第一人称、第三人称导航及独立摄像机移动。据官方说明,Odyssey-3 Pro 在 Physics-IQ Verified 的 video-to-video 测试中取得最高已报告分数 66.1,在 image-to-video 测试中得分 54.7。该测试通过真实物理实验视频评估模型预测,覆盖流体动力学、光学、固体力学、磁学和热力学。

在官方使用 WorldMark 自带 captions、取其 13 项指标分数均值的评估中,Odyssey-3 在 4 个类别中的第一人称风格化、第三人称真实和第三人称风格化环境中排名第 1。官方同时说明,将模型用于具体物理系统仍需评估机器及任务所需的行为。适配方式包括用成对的观察与动作训练 action decoder 或 policy。官方称,模型仅用数十小时机器人演示即可完成操作任务,并出现演示中未包含的抓取失败后调整夹爪、拾回异常位置掉落物体等恢复行为。在印度真实道路的驾驶适配中,团队冻结 Odyssey-3 backbone,仅用 20 小时驾驶数据训练 policy,通过预测车辆前方的 waypoints 实现闭环驾驶。

读原文 →

Grok Imagine Video 1.5 Lite 上线,1080p 每秒 0.14 美元

模型发布

Grok Imagine Video 1.5 Lite 上线,1080p 每秒 0.14 美元

Grok Imagine 已通过 API 推出 Video 1.5 Lite,支持文本生成视频和图像生成视频。该模型按分辨率、按秒计费,480p、720p 和 1080p 的每秒价格分别为 0.02、0.03 和 0.14 美元。

Grok Imagine 宣布,视频生成模型 Video 1.5 Lite 已在 Grok Imagine API 上线,提供文本生成视频和图像生成视频两种功能。其收费标准按视频分辨率区分,并以秒为计费单位:480p 每秒 0.02 美元,720p 每秒 0.03 美元,1080p 每秒 0.14 美元。原文未提供具体上线日期,也未列出这三种分辨率之外的价格。

读原文 →

Ghostty 作者发布终端协议 OSC 7501

技术与洞察

Ghostty 作者发布终端协议 OSC 7501

读原文 →

研究称DeepSeek-V4长上下文存在周期性弱点

技术与洞察

研究称DeepSeek-V4长上下文存在周期性弱点

读原文 →

Epoch AI 推出真实工作评测

技术与洞察

Epoch AI 推出真实工作评测

读原文 →

人类数学协会呼吁抵制OpenAI

技术与洞察

人类数学协会呼吁抵制OpenAI

读原文 →

谷歌 AMIE 研究登上《柳叶刀》

技术与洞察

读原文 →

新版 Claude 使用政策:持续虐待 Claude 或遭封禁

行业动态

新版 Claude 使用政策:持续虐待 Claude 或遭封禁

读原文 →

Anthropic 启动 Cyber Mission,守护关键基础设施与开源软件

行业动态

Anthropic 启动 Cyber Mission,守护关键基础设施与开源软件

读原文 →

美国联邦科研计划 Genesis Mission 获 11 家行业伙伴 24 亿美元承诺

行业动态

美国联邦科研计划 Genesis Mission 获 11 家行业伙伴 24 亿美元承诺

读原文 →

报道称 OpenAI 年化营收接近 500 亿美元,比此前报道少约 200 亿

行业动态

报道称 OpenAI 年化营收接近 500 亿美元,比此前报道少约 200 亿

读原文 →

OpenAI 被解雇安全研究员发公开信否认违规

行业动态

OpenAI 被解雇安全研究员发公开信否认违规

读原文 →

OpenAI 封禁借假记者假智库散布宣传的俄伊账号

行业动态

读原文 →

Manus 母公司蝴蝶效应完成超 5 亿美元融资

行业动态

Manus 母公司蝴蝶效应完成超 5 亿美元融资

读原文 →

Arena 完成 2 亿美元 B 轮融资,发布对齐指数

行业动态

Arena 完成 2 亿美元 B 轮融资,发布对齐指数

读原文 →

疑似中国攻击者用AI工具攻击韩国银行并窃取数据

行业动态

疑似中国攻击者用AI工具攻击韩国银行并窃取数据

读原文 →

不满 Mistral 质量落后,Ecosia 转用中国开源模型

行业动态

读原文 →

Harness公司收购Augment Code部分资产

行业动态

Harness公司收购Augment Code部分资产

读原文 →

消息称 Isomorphic Labs 洽谈新融资 估值至少 400 亿美元

前瞻与传闻

消息称 Isomorphic Labs 洽谈新融资 估值至少 400 亿美元

读原文 →

阶跃终端首款智能体手机定档10月13日发布

前瞻与传闻

阶跃终端首款智能体手机定档10月13日发布

读原文 →