每日 AI 日报

2026-09-23

来源:橘鸦 AI 早报 · 18 条

2026-09-23
2026-10-01 2026-09-30 2026-09-29 2026-09-28 2026-09-27 2026-09-26 2026-09-25 2026-09-24 2026-09-23 2026-09-22 2026-09-21 2026-09-20

Anthropic 发布 Claude Opus 5.5:同步调整价格与订阅额度

要闻

Anthropic 发布 Claude Opus 5.5:同步调整价格与订阅额度

Anthropic 推出 Claude Opus 5.5,默认设置下典型工作负载成本较 Opus 5 低 40%,输出速度提高超过 30%,并上调多类订阅方案的五小时用量上限。

Anthropic 发布 Claude Opus 5.5,并在发布时同步调整价格与订阅额度;这是 Claude 5.5 系列的首款模型。输入和输出价格分别为每百万 token 4 美元和 20 美元,均比 Opus 5 低 20%;cache read 为每百万 token 0.20 美元,低 60%。官方表示,该模型在默认设置下处理典型工作负载的总成本低 40%,输出速度提高超过 30%,多数任务的表现与 Claude Fable 5.1 相当。Fast mode 已登陆 Claude Code 和 Claude Platform,速度最高为 2.5 倍,输入和输出价格分别为每百万 token 8 美元和 40 美元。Pro、Max、Team 和按席位计费的 Enterprise 方案提高了五小时用量上限,订阅用户还获得一次可留存并自行选择使用时间的 rate limit reset。

官方表示,Opus 5.5 在 agentic coding、computer use 和 knowledge work 基准中领先,但基准分差已难以稳定反映现实使用差异;除特别注明外,成绩均使用 adaptive thinking at max effort,并开启生产环境 safeguards。早期测试中,一名测试者用该模型在一天内完成了 680,000 行代码迁移;在优化 Web App 全部页面加载时间的测试中,该模型 40 次成功 39 次。官方还称,Opus 5.5 在其自动化行为审计中取得历来最高得分,发布前接受了 Frontier Design、METR 等外部评估。经审核的机构已可申请 Life Sciences Verification Program,Cyber Verification Program 将在未来数周扩大开放范围;Claude Sonnet 5.5 和 Claude Haiku 5.5 也计划在未来数周推出。

读原文 →

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,下调 API 价格并改进缓存

要闻

OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,下调 API 价格并改进缓存

OpenAI 扩充 GPT-6 产品线,推出面向复杂工作的 Sol 和侧重成本与吞吐的 Luna,并同步开放 API。两款模型的 API 价格较 GPT-5.6 促销价下调 50%,缓存输入最高可享 90% 折扣。

OpenAI 已发布 GPT-6 Sol 和 GPT-6 Luna,并开始向 Plus、Pro、Business、Enterprise 和 Edu 用户的 ChatGPT Work 与 Codex 提供,同时开放 API;Free 和 Go 用户可在桌面应用中使用 Luna。两款模型发布时尚未进入普通 Chat 界面,ChatGPT 端采用分批推送。Sol 面向复杂工作,Luna 面向更看重成本和吞吐的日常任务;GPT-6 Astra 仍是最高能力档位。Sol 和 Luna 沿用 Astra 的部分训练方法,覆盖专业工作、事实准确性、编程、计算机操作和对齐方面的改进。

API 定价较 GPT-5.6 的促销价整体降低 50%。Sol 每百万输入 token 为 2 美元、每百万输出 token 为 10 美元;Luna 对应价格为 0.10 美元和 0.50 美元。据 OpenAI 公布的评测,Sol 和 Luna 在专业工作、长任务编程和计算机操作中,能以更低的每任务成本达到或接近部分更昂贵模型的水平;其内部事实评测显示,Sol 的错误约为上一代的一半。据其说明,GPT-6 的默认缓存命中率提高,缓存输入最高可享 90% 折扣,并加入缓存监控、诊断、显式断点和预热功能;调整推理强度或工具可用性时,也可尽量保留既有缓存。GitHub 表示,这些改进让 Copilot 需要重新处理的 prompt token 较此前基线减少一半以上。

读原文 →

Tibo:为 Plus、Pro 和 Business 用户发放手动重置次数

要闻

Tibo:为 Plus、Pro 和 Business 用户发放手动重置次数

Codex 负责人 Tibo 表示,所有 Plus、Pro 和 Business 用户账户将各获得 1 次可手动使用的 banked reset;他未公布具体到账时间。

Codex 负责人 Tibo 表示,正在为所有 Plus、Pro 和 Business 用户账户增加 1 次可手动使用的 banked reset,但未说明各账户的具体到账时间。Tibo 此前承诺将在当地时间周二提供重置;此次更新进一步确认,这次发放采用可由用户手动启用的 banked reset 形式,适用范围覆盖上述 3 类订阅方案。原文未给出当地时间周二对应的完整日期。

读原文 →

智谱推出GLM Coding Plan双节畅享活动

开发生态

智谱推出GLM Coding Plan双节畅享活动

智谱为 GLM Coding Plan 推出双节活动:9 月 25 日至 10 月 7 日,所有套餐全天按非高峰期倍率消耗额度;其间 ZCode 每晚 23 时至次日 9 时可免费无限使用 GLM-5.3-Flash。

智谱将于 9 月 25 日至 10 月 7 日调整 GLM Coding Plan 的活动额度规则,活动期间所有套餐在全天均按非高峰期倍率消耗额度。GLM-5.3-Flash 的夜间活动也延长至 10 月 7 日;据其说明,用户每晚 23 时至次日 9 时可在 ZCode 中免费且不限量使用该模型,其他套餐所支持的 Agent 额度翻倍。GLM-5.3-FlashX 则以滚动方式在 Coding Plan 中开放试用,申请获批的用户可获得两周体验。

读原文 →

OpenRouter推出Batch API,70多款模型支持异步批处理

开发生态

OpenRouter 于 2026 年 9 月 22 日推出 Batch API,支持 70 多款模型异步处理任务;服务商可在 24 小时内完成请求,通常按常规每 token 价格的 50% 或更低收费。

OpenRouter 于 2026 年 9 月 22 日上线 Batch API,为 70 多款模型提供异步批处理,适用于可接受响应时间波动的工作负载。提交批次后,服务商可自行选择在 24 小时窗口内何时完成请求,通常收取常规每 token 价格的 50%,有时更低。用户通过 POST /api/v1/batches 提交请求列表并指定 endpoint shape;Chat completions、responses、messages 和 embeddings 均受支持。随后可轮询 GET /api/v1/batches/:id,直至状态变为 completed、failed、expired 或 cancelled;完成结果会直接包含在同一响应中。

据其说明,两周 beta 期间完成的超过 23 万个批次中,完成时间中位数为 7 分钟,第 90 百分位为 1.0 小时,第 99 百分位为 10.3 小时;提交时段对耗时的影响大于请求数量。太平洋时间 5:00 至 12:00 提交的批次更慢,最慢的 10% 耗时 2 至 4.5 小时;其他时段的第 90 百分位低于 1.1 小时,18:00 后低于 50 分钟。单请求批次依时段需 5 至 11 分钟,包含 1,000 个或更多请求的批次需 12 至 21 分钟;太平洋时间 0:00 至 12:00 提交且请求数超过 100 的批次中,最慢的 10% 最长耗时 6.8 小时。

读原文 →

阶跃星辰正式开源 Step Code v0.1.0

开发生态

阶跃星辰正式开源 Step Code v0.1.0

阶跃星辰已开源面向真实开发任务的 Step Code v0.1.0,开发者可在终端完成代码阅读、编写、调试、测试验证与交付,并通过 MIT 许可在 macOS、Linux 和 WSL 上安装使用。

阶跃星辰已将终端开发工具 Step Code v0.1.0 以 MIT 许可开源,并提供适用于 macOS、Linux 和 WSL 的官方安装器。该工具覆盖代码阅读、编写、修改、调试、执行、测试验证与交付等真实开发环节。据其说明,Step Code 借助上下文管理、工具调用和 subagent 并行执行减少 token 消耗,同时提供长任务托管、定时执行、StepPage 静态网站发布、MCP、Agent Skills、插件和多 Agent 编排能力。产品默认仅内置 Step provider,用户可通过 Step Plan 订阅或 Step Platform API Key 登录使用。

读原文 →

腾讯混元发布专业级生图模型 Hy Image3.5 preview

模型发布

腾讯混元发布专业级生图模型 Hy Image3.5 preview

腾讯混元发布专业级生图模型 Hy Image3.5 preview,支持最高 2K 分辨率输出和最多 5 张参考图;企业及开发者可通过腾讯云相关服务调用 API,2K 图片每张收费 0.15 元。

腾讯混元已推出面向生活、学习、生产力和专业视觉创作场景的 Hy Image3.5 preview,并将模型接入元宝、WorkRally、OnSolo、Miora、WorkBuddy 和 ima。企业与开发者也可通过腾讯云 TokenHub、媒体处理 MPS 和云点播 VOD 调用 API,2K 图片定价为每张 0.15 元,且仅对输出图片收费。据其说明,模型支持文生图、图生图、多轮对话编辑、最多 5 张参考图、多种尺寸比例及最高 2K 分辨率输出。官方表示,模型通过简化架构、高效蒸馏、文本与图像分支解耦部署及注意力算子适配提高资源利用率,综合能力较 Hy Image3.0 提升约 30%。Miora 将于 2026 年 9 月 22 日至 2026 年 10 月 7 日提供限时免费体验。

读原文 →

蚂蚁百灵发布Ming-Image两款60亿参数图像模型

模型发布

蚂蚁百灵发布Ming-Image两款60亿参数图像模型

蚂蚁百灵开源 Ming-Image-0.1-Design 系列,包含两款 6B 参数模型,分别用于视觉设计生成和可编辑图层分解;官方给出的最低验证配置为单张至少 80 GiB 显存的 GPU,以 BF16 运行。

Ming-Image-0.1-Design 由蚂蚁百灵以开源系列形式发布,系列内两款模型均为 6B 参数,任务分别是视觉设计生成和可编辑图层分解。官方表示,经验证的默认及最低部署规格为单张显存至少 80 GiB 的 GPU,以 BF16 运行,两类模型均可完成端到端执行。CLI 的 --model 可接收本地目录或 HF Hub repo ID;使用 Hub 模型时,会在加载组件前解析为一个不可变的本地 snapshot,--revision 可固定 branch、tag 或 commit。attention 默认使用 eager,可选 flash_attention_2;diffusion transformer 内部始终使用 PyTorch SDPA,而将 --attn-implementation 设为 sdpa 会在加载时失败。

两项任务都允许 --prompt 接收原始文本或 prompt 文件路径,--validate-only 可在不加载模型权重的情况下检查 checkpoint contract 与任务组合。Prompt enhancement 是 infer.py 之外的预处理步骤,可由 Ling-3.0-flash-VL 或 qwen3.8-27B 将简短描述改写为带布局、坐标、层级、颜色和文本归属的结构化说明。图层分解从 prompt 中的“Decompose this image into N layers”或“Number of layers: N”读取层数;模型会额外返回一张位于最前的 composite/full-canvas image,CLI 跳过该图后依次保存 layer_01.png 等文件。据其说明,分解时可显式指定 --resolution 512 以加快处理,推荐输出质量使用 1024;文生图按所选 bucket 输出正方形,图层分解则保留参考图宽高比。

读原文 →

PixVerse公布实时世界模型R2,支持提示词控制与编辑

模型发布

PixVerse公布实时世界模型R2,支持提示词控制与编辑

PixVerse 披露实时世界模型 PixVerse R2,称用户能以提示词探索、控制和编辑动态世界,决定故事走向,并与具有记忆和回应能力的角色互动。R2 通过两个核心引擎分别处理能力与效率问题。

PixVerse 在社交平台公布实时世界模型 PixVerse R2,并称用户可以通过提示词探索、控制和编辑动态世界,决定故事走向,以及与能够记忆并回应的角色互动。据其说明,R2 使用两个核心引擎分别处理模型能力和运行效率,以应对实时运行与模型能力之间的取舍。PixVerse 表示,实时运行倾向于采用更小、速度更快的模型,更广泛的理解能力则倾向于采用更大的模型。

读原文 →

Kimi Browser Extension 上线,可录制网页操作为 skill

产品应用

Kimi Browser Extension 上线,可录制网页操作为 skill

Kimi 已上线面向 AI Agents 的 Kimi Browser Extension,可将网页操作录制为 skill,并代替用户打开页面、点击按钮、填写表单和提取信息。

原名 Kimi WebBridge 的产品现已以 Kimi Browser Extension 之名上线,可把网页操作录制为 skill,供 AI Agents 使用。官方表示,该扩展能够像用户操作浏览器一样打开页面、点击按钮、填写表单并提取信息,用于处理繁琐的网页任务。使用时,用户需要先在浏览器工具栏中点击 Kimi 扩展图标,再使用 Kimi 账户登录,随后即可开始操作。

读原文 →

火山引擎推出 Seedance 2.5 Draft 模式

产品应用

火山引擎在 Seedance 2.5 API 上线 Draft 模式,用户可先生成 480P 样片,再凭样片 ID 制作 1080P 成片;官方称,特定 5 秒镜头流程可节约 57% 成本。

火山引擎已为 Seedance 2.5 API 推出 Draft(样片)模式,企业用户现可在创建视频生成任务时将 draft 参数设为 true,C 端创作者可在即梦选择“Seedance 2.5(样片模式)”。该模式允许用户先生成 480P 样片,确认构图和动作等效果后,再通过样片 ID 生成 1080P 成片,无需在每次尝试时直接生成高清版本。据其说明,成片会复用样片的生成条件,镜头结构和运动表现将尽可能保持一致,但局部细节可能发生变化。以不含输入视频、生成 5 秒 1080P 镜头并在尝试 4 次后选定片段为例,官方表示该流程可节约 57% 的成本,生成速度提升近一倍。

读原文 →

Artificial Analysis 新增九种语言语音合成榜单

技术与洞察

Artificial Analysis 新增九种语言语音合成榜单

Artificial Analysis 上线九语种语音合成榜单,Inworld Realtime TTS-2 以 1185 Elo 居普通话榜首;Cartesia Sonic 3.6 以 1146 Elo 排名第二。

Artificial Analysis 已新增覆盖九种语言的语音合成模型榜单,并提供按语言查看的入口。普通话榜单中,Inworld 的 Realtime TTS-2 以 1185 Elo 排名第一,Cartesia 的 Sonic 3.6 以 1146 Elo 排名第二,StepFun 的 StepAudio 2.5 TTS 以 1130 Elo 排名第三。阿里巴巴的 Qwen-Audio-3.0-TTS-Plus 与 MiniMax 的 Speech 2.8 Turbo 分别位列第四和第五;在普通话开放权重模型中,BreezeBlue 的 Breeze TTS 2 排名最高。该站同时提供公开语音合成竞技场,用户可参与投票,评测方法也已公布。

读原文 →

OpenAI提出第三方安全评估重点,承诺提供深度访问

行业动态

OpenAI 发布第三方安全评估重点与原则,拟让私营及非营利领域的独立机构深入接触模型训练、评估和部署环节,核查安全证据与防护效果。文件提出 4 项深入评估重点,现有材料具体列出其中 2 项。

OpenAI 发布第三方安全评估重点与原则,主张由私营及非营利领域的独立机构持续开展模型技术安全评估。按照文件设想,评估机构可深入接触模型训练、评估和部署环节,核查安全主张的依据、识别遗漏风险,并独立判断防护措施是否有效。文件提出 4 项深入评估重点;现有材料具体列出安全论证和关键防护措施 2 项,涉及训练、内部与外部部署中的证据、测试和实际防护效果。评估可并行开展,预计持续数周至数月;部分工作可在部署前进行,为部署决策提供参考。文件将这类工作定位为长期开展、不依附于单次发布的技术安全评估,而非面向公众开放的测试。

读原文 →

阿里云成为 Omacom 基金会创始企业赞助人

行业动态

阿里云成为 Omacom 基金会创始企业赞助人

阿里云成为 Omacom 基金会创始企业赞助人,承诺连续三年每年出资 100 万美元,总计 300 万美元。双方还将建设面向中国用户的 Omarchy China,并探索 Omarchy 与即将推出的 Qwen Book 的协作。

Omacom 基金会宣布,阿里云以创始企业赞助人身份承诺连续三年每年提供 100 万美元,用于 Omarchy 的开发、维护和推广;总计 300 万美元的承诺与 DigitalOcean 的支持规模相当。阿里云还将协助建设 Omarchy China,包括面向中国用户的本地 CDN、托管、网站、线下聚会和社区。双方计划让 Omarchy 适配 Qwen 模型,并与中国本土服务集成,同时探索将 Omarchy 用于即将推出的 Qwen Book。据阿里云说明,Qwen Book 旨在打造原生 AI Agent 计算机,系统兼容 ARM 和 x86,首发版本基于 ARM,并配有 Agent Engine 和 Continuous Context Engine;Qwen 模型服务将通过云端一体的方式提供。阿里云与 DigitalOcean、Meta Superintelligence Labs 同为创始企业赞助人。基金会表示,获得的支持资金总额约为 2170 万美元。

读原文 →

TypeSafe AI因需求激增暂停Jev新用户注册

行业动态

TypeSafe AI因需求激增暂停Jev新用户注册

TypeSafe AI 因 Jev 的需求增长而暂停新用户注册,以优先保障已注册用户的服务质量。现有用户仍可使用 Jev;官方表示正推进恢复开放,但尚未公布具体时间。

TypeSafe AI 已暂停 Jev 的新用户注册,目前尚未公布恢复注册的具体时间。此次调整只涉及新用户注册,已经完成注册的用户仍可正常使用 Jev。据其说明,暂停注册的原因是 Jev 的需求增长,需要优先保障现有注册用户的服务质量。TypeSafe AI 表示正在推进恢复开放,希望尽快让所有人都能访问 Jev,但没有给出重新接受新用户注册的时间安排。

读原文 →

千问发布Qwen Intelligence AI手机全栈方案

行业动态

千问发布Qwen Intelligence AI手机全栈方案

千问推出面向手机厂商的全栈方案 Qwen Intelligence,以 3 类 Agent 覆盖规划、手机操作和影像创作,并已与荣耀 Magic OS 结合落地。

千问已发布手机场景全栈解决方案 Qwen Intelligence,面向终端厂商和生态伙伴开展合作,并已在荣耀 Magic OS 中落地。该方案不涉及硬件生产,而是由针对手机场景优化的模型、模块化平台和场景解决方案组成,用于协助手机厂商构建可执行规划、设备操作与创意任务的手机 Agent。其 3 个组成部分为 Mobile Planner Agent、Mobile-Use Agent 和 Mobile Creative Agent,分别承担智能规划、手机操作和影像创作。官方表示,这 3 套方案在多项评测中取得领先成绩;目前该方案设有 Qwen Intelligence 官网及千问 AI 平台入口。

读原文 →

阿里巴巴披露Qwen4路线图,多款型号即将推出

前瞻与传闻

阿里巴巴披露Qwen4路线图,多款型号即将推出

阿里巴巴在云栖大会公布Qwen4路线图,称新架构模型已进入训练,Qwen4-Max等4款型号被标注为即将推出;后续Qwen4.5与Qwen5拟扩展至5—10T参数规模。

阿里巴巴在云栖大会披露Qwen4路线图;据其说明,Qwen4基于新一代架构并已进入训练,Qwen4-Max、Qwen4-Flash、Qwen4-Plus和Qwen4-27B处于即将推出阶段。大会展示的画面将这4个型号列入Qwen4系列,后续规划还包括Qwen4.5和Qwen5。路线图显示,这两个后续版本计划将参数规模扩展至5—10T。

读原文 →

阿里QwenBook演示真机亮相,官网招募100名体验官

前瞻与传闻

阿里QwenBook演示真机亮相,官网招募100名体验官

阿里旗下 Qwen Book 公布真机演示并面向用户公开招募 100 名体验官;官网称,入选者可免费使用纪念版、共享万亿 Token,并优先获得开发者系统新版本。

阿里已在 Qwen Book 官网公开真机演示,并启动 100 名体验官招募。体验官需完整体验产品、完成调研问卷,并参与共创研讨、提供洞察与建议;对应权益包括免费使用 Qwen Book 纪念版、共享万亿 Token,以及优先更新开发者系统新版本。官方表示,设备可在网页、文件和应用中根据用户指向的当前内容理解意图,无需切换应用、复制粘贴或重新说明上下文;YoooClaw 用于收集和整理上下文。官网还列出办公能力、本地化存储、手写、鼠标、麦克风、算力与续航等适配或能力,并称生态已覆盖 2000+ TOOLS、Linux、Windows、Android 等操作系统及 1000+ 生态伙伴。

读原文 →