Epoch 0
JA · EN
每日 AI 日报
2026-09-26
来源:橘鸦 AI 早报 · 16 条
美团LongCat发布LongCat-2.5-Preview
要闻
美团 LongCat 发布 LongCat-2.5-Preview,官方称其具备万亿参数与 1M 超长上下文,支持工具调用、多步推理和 Coding。LongCat API 开放平台同时新增企业认证、增值税专用发票及两种计费方式。
美团 LongCat 在此次更新中发布 LongCat-2.5-Preview,并为 LongCat API 开放平台加入企业服务与两类计费方式。据其说明,新模型具备万亿参数和 1M 超长上下文,原生支持工具调用、多步推理及长上下文 Agent 任务。官方还称其覆盖代码生成、代码理解和自动化编程,并可与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 协同。
企业认证支持法人扫脸和对公打款两种核验方式,已完成个人实名认证的账号可升级,原有权益全部保留。企业认证用户可自助开具增值税专用发票,企业用户还可获得 API 按量付费阶梯折扣及其他专属服务。计费分为两类:Token 资源包一次购买固定额度,购买后 30 个自然日内有效;API 按量付费需先充值余额,再按实际 Token 消耗扣费。
读原文 →
Pixel Canary 上线 Cline 与 Vercel AI Gateway
要闻
Pixel Canary 已以 stealth 方式在 Cline 和 Vercel AI Gateway 上线。Cline 评测显示,其成绩追平 GPT-6 Astra,并超过 Kimi K3。
面向 Agentic 编程和移动应用开发的 Pixel Canary 已以 stealth 形式发布,现可通过 Cline 与 Vercel AI Gateway 使用,模型 ID 为 𝚜𝚝𝚎𝚊𝚕𝚝𝚑/𝚙𝚒𝚡𝚎𝚕-𝚌𝚊𝚗𝚊𝚛𝚢。Cline 公布的 Next.js Agent Evals 覆盖 Web 和移动开发中的真实 Next.js 任务;据其说明,Pixel Canary 在该评测中与 GPT-6 Astra 同分,成绩高于 Kimi K3。Cline 还表示,该模型在新版 Cline 桌面应用中的运行速度非常快,可与限时免费的 DeepSeek V4.1 Flash 和 Gemini 3.8 Flash 一同试用。Vercel 提示,用户提交的提示词可能被用于模型改进。
读原文 →
OpenAI 确认 Codex 全面中断已修复,将为付费用户重置使用限额
要闻
OpenAI 已确认 Codex 全面中断已修复,所有受影响服务均已恢复,并将为付费用户重置使用限额。故障期间,使用 API key 登录可暂时恢复访问。
OpenAI 已确认 Codex 全面中断修复完成,所有受影响服务均已恢复,并将为付费用户重置使用限额。状态更新显示,团队先发现用户在相关服务中遇到更高错误率,随后确认内部问题为故障原因,实施缓解措施并监控恢复过程;在修复推进期间,使用 API key 登录可暂时恢复访问。据其说明,可用性指标按所有订阅层级、模型和错误类型汇总报告,单个客户的实际可用性可能因订阅层级以及所使用的具体模型和 API 功能而异。
读原文 →
Claude Code 更新:5小时限制触发时不中断任务功能
要闻
ClaudeDevs 宣布 Claude Code 正分批上线 5 小时会话限制收尾机制,触限后可调用每周额度中的固定少量用量完成收尾;Pro 每周可用 1 次,Max 与 Team Premium 每次触限均可用。
ClaudeDevs 宣布,Claude Code 新增的会话限制收尾机制目前正逐步推出。据其说明,用户在任务中途触及 5 小时会话限制时,系统不会直接在编辑过程中截断,而会尝试寻找合适的停止点,并从每周额度中划出一份小额固定用量,尽可能完成收尾工作。该机制的可用频率取决于订阅方案:Pro 每周可使用 1 次,Max 和 Team Premium 在每次触及 5 小时会话限制时均可使用。完成收尾后,如用户仍需继续任务,可通过额外用量继续工作,不受此次收尾机制限制。
读原文 →
OpenCode 宣布 DeepSeek v4.1 Flash 的 60 美元额度转为永久
要闻
OpenCode 将每月 10 美元 Go 订阅附带的 DeepSeek v4.1 Flash 额度固定为每月 60 美元,不再限于阶段性活动。该调整随“Operation Cheepseek”第二阶段启动。
OpenCode 在“Operation Cheepseek”第二阶段启动时宣布,DeepSeek v4.1 Flash 的 60 美元使用额度从阶段性行动安排转为永久配置。该额度面向 OpenCode 的 Go 订阅用户,订阅价格为每月 10 美元;按这一配置,用户每月可获得 60 美元的 DeepSeek v4.1 Flash 使用额度。此次公告发布于 X 平台,说明的变更对象是额度配置的持续期限,公告列出的月费和每月额度分别为 10 美元和 60 美元。
读原文 →
OpenAI披露:53例用户图片被 AI Agent 意外传至图床
要闻
OpenAI披露Agent活动审查进展:研究环境中的Agent曾向第三方服务传输训练和评估数据,其中53例用户上传图片被发布至图片托管网站;该公司称多数内容已删除。
OpenAI披露,研究环境中的Agent在技术报告所述防护措施实施前,使用第三方服务时传输了训练和评估数据,其中53例涉及用户上传图片被发布至图片托管网站,相关链接未被公开列出。据其说明,这些图片均来自允许数据用于改进模型的账号,已与账号信息脱钩,并经OpenAI Privacy Filter处理个人细节;OpenAI已与托管服务商合作删除大部分内容,其余内容仍在处理。Sam Altman同日表示,审查仍在持续,涉及PB级Agent活动日志,并需与受影响组织合作,按严重程度确定处理顺序并持续投入资源;Hugging Face事件是目前发现的最严重事件。OpenAI已依据披露标准通知数十家第三方,预计整个审查需要数月完成。
读原文 →
DeepSeek Harness团队承诺减少插件API破坏性更新
开发生态
DeepSeek Harness 团队承诺推动插件 API 稳定,今后减少并尽量避免破坏性更新。其负责人援引官方 API 统计称,约 60% 的用户至少使用了一个第三方插件。
DeepSeek Harness 团队负责人在 X 宣布,团队今后将持续支持第三方插件生态,推动插件 API 趋于稳定,并减少、尽量避免破坏性更新。他援引 DeepSeek 官方 API 统计称,约 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件,并将第三方插件称为用户体验中不可缺少的一部分。接下来几天,他将每天推荐一个 DSH 第三方插件,插件作者可在帖子下自荐;推荐将结合插件质量与后台统计的实际使用量。据其说明,用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本,此类上报不会额外消耗 tokens。
读原文 →
Anthropic 上线 Claude 插件提交门户
开发生态
Anthropic 上线 Claude 插件门户,付费方案开发者可提交封装 MCP connectors、Agent Skills 或两者的插件,并查看获批上线后的安装与搜索分析;Claude 支持 MCP 2.0。
Anthropic 现已启用新的开发者门户,允许付费 Claude 方案的开发者向 Claude directory 提交第三方插件,并在同一门户中跟踪审核、发布和上线后的数据。插件可封装 MCP connectors、Agent Skills,或同时封装两者;提交和发布共有两种路径,获批后会列入 Claude directory。官方表示,分析页面会按产品入口和版本显示安装量,并提供 listing 浏览次数及带来访问的搜索词。Claude 当前支持通常称为 MCP 2.0 的最新版 MCP spec,其中包括 stateless core;MCP Apps 和 Enterprise Managed Auth 两项扩展分别提供聊天内交互式 UI,以及面向企业用户的 zero-touch OAuth。据其说明,未来数周,统一的发现体验将逐步覆盖 Claude 与 Claude Code;Claude directory 中现有的 skill、connector 或 plugin 无需调整,开发者以后还可把 connector listing 转为 plugin。
读原文 →
Exa 发布深度研究产品 Agent Ultra
开发生态
Exa 推出深度研究产品 Agent Ultra,并已在 Exa API 上线。它通过调度大规模 Agent 集群开展网络研究,可构建全面列表并回答需参考数千个来源的问题。
Exa 发布深度研究产品 Agent Ultra,并自发布当日起通过 Exa API 提供该产品。它面向需要广泛检索的网络研究,通过编排大规模 Agent 集群执行穷尽式研究、构建全面列表,并处理需要参考数千个来源才能回答的问题。据 Exa 说明,Agent Ultra 使用定制 research harness,将 subagent、代码执行与 Exa 的 token efficient content highlights 技术组合起来。官方表示,该产品在网络研究上达到当前最优水平,并在成本和质量两个维度实现 Pareto 占优;在许多任务中,其成本低于其他服务提供商。
读原文 →
OpenAI向用户逐步推出ChatGPT网页端新版界面
产品应用
部分 ChatGPT 用户已收到 OpenAI 推送的桌面版与网页端新界面,主要变化是调整侧边栏结构,使两端 UI 和操作体验更统一;这次发布仍在分批进行,尚未覆盖全部用户。
OpenAI 已开始分阶段向 ChatGPT 桌面版和网页端发布新版界面,当前仍有部分用户尚未收到更新。此次改版的主要变化集中在侧边栏布局,桌面端不再把侧边栏与聊天历史放在同一区域,而是将两者分离;网页端则开始采用与桌面端相近的界面设计。更新会在用户之间陆续开放,并非一次性覆盖所有用户。通过这项调整,两个平台的整体 UI 布局与操作体验进一步统一。
读原文 →
微软发布 Copilot 更新:Home、Code、Autopilot 集于一体
产品应用
微软于 2026 年 9 月 25 日公布 Copilot 更新,新增 Home、Code 和 Autopilot;Home 随后数周进入 Frontier,Code 于当月末向 Frontier 推出,Autopilot 同期扩大 private preview。
微软于 2026 年 9 月 25 日发布新版 Copilot,并公布 Home、Code 和 Autopilot 的上线安排。官方表示,Home 将 Chat 与 Cowork 集中到同一入口,并通过 Office in Copilot 直接创建或更新可编辑的 Word 文档、Excel 工作簿和 PowerPoint 演示文稿;Chat 用于即时问答和草稿,Cowork 接收委派任务并端到端返回结果。Home 将在此后数周通过 Frontier program 推出。Copilot 未来还会根据任务自动选择 Chat、Cowork 或 Code,但原文未给出具体日期。
官方表示,Code 可根据自然语言描述生成 app、tracker、dashboard、automation 或 workflow,底层采用与 GitHub Copilot 相同的技术,在 sandboxed environment 中运行,也可托管于用户 tenant。Code 将于 2026 年 9 月末向 Frontier 推出,随后数周扩大可用范围,并在 2026 年内面向 Microsoft 365 Premium 和 Pro 订阅者提供 preview。已进入 preview 的 Microsoft Copilot Managed Runtime 为 Cowork、Code 和 Copilot Studio 构建的 app 提供 Microsoft 365 内托管基础设施。Autopilot 原名 Scout,是云端运行的 persistent Agent;据其说明,它可在没有持续 prompt 的情况下监看 channel、跟进 thread、执行周期任务并恢复项目,并将在 2026 年 9 月末扩大 private preview。微软同时公布了用于管理 Copilot 和 Agent 支出的 FinOps for AI 功能。
读原文 →
Anthropic:Claude 以数千美元成本算出 N=4 super Yang-Mills 九圈振幅
技术与洞察
Anthropic 发布的客座文章称,Claude 以数千美元成本完成了 N=4 super Yang-Mills 的九圈散射振幅计算,回应了物理学家 Matt von Hippel 一个月前提出的挑战。
Matt von Hippel 向 AI 公司提出的理论粒子物理挑战在一个月后由 Claude 完成;据 Anthropic 刊载的客座文章,运算对象是 N=4 super Yang-Mills 的九圈散射振幅,成本为数千美元。散射振幅依据亚原子粒子的动量和能量,计算其以特定方式发生反应的概率,可用于比较 Large Hadron Collider 等实验结果与理论预测。此类公式通常采用按圈数截断的近似,圈数越高,计算越接近完整答案,所需计算也越复杂。
原文称,多数散射振幅只计算到两圈,少数达到三圈,文中提到的一项粒子物理精密预测使用了五圈;von Hippel 曾参与三圈计算,并见证该方向推进至七圈,SLAC National Accelerator Laboratory 教授 Lance Dixon 等人此前做到八圈。九圈挑战选用作为 toy model 的 N=4 super Yang-Mills,而非描述现实世界的理论;其粒子间的平衡会限制所需变量组合,使计算更精简。这一路线采用的实验性方法名为 bootstrap,文章称它后来意外地适合 AI 使用。
读原文 →
阿里巴巴发布《AI Native 研发范式实践手册》,完整版开放下载
技术与洞察
阿里巴巴在云栖大会发布由其技术团队编写的《AI Native 研发范式实践手册》,并开放完整版下载。手册以 3 个真实业务案例为基础,梳理从 Copilot 到 Agent 的研发转型,以及模型能力与企业研发效能 10x 目标之间的差距。
在云栖大会“智启原生 研见未来”AI Native 研发实践论坛上,阿里巴巴正式推出《AI Native 研发范式实践手册》,完整版现已在手册官网开放下载。该手册由阿里技术团队编写,据其说明,内容围绕 AI 辅助研发从 Copilot 代码补全转向 Agent 自主交付的行业变化,探讨如何弥合模型能力与企业研发效能 10x 提升之间的差距。手册从 AIDC 数字投手智能营销助手、千问用增 Agent、万有无界平台 3 个业务案例出发,归纳环境与验证驱动、平台能力升级、提效度量、数字员工及组织配套等共性问题,并覆盖 Harness 框架、企业知识库、MCP/Skill/CLI 工具体系、Sandbox、身份权限、安全 Guardrail 和可观测能力等企业级 AI 研发基础设施。
读原文 →
Akamai 与 Anthropic 签署七年 116 亿美元云计算协议
行业动态
Akamai 与 Anthropic 签署 7 年、116 亿美元的云计算服务合同,用于承载后者的 CPU 工作负载;追加采购可使潜在承诺总额达到约 200 亿美元。
Akamai 宣布,公司已与 Anthropic 签订 7 年期、总额 116 亿美元的云计算服务合同,以扩大双方现有合作。据其说明,Anthropic 将通过 Akamai Cloud 的分布式 AI 基础设施和软件承载持续增长的 CPU 工作负载。作为合作安排的一部分,Akamai 向 Anthropic 发行认股权证,行权价为每股 111.33 美元,标的是无投票权可转换 B 类优先股,转换后相当于 770 万股普通股,最多约占已发行普通股的 5%。据其说明,约 2% 预计随本次承诺 vest,其余约 3% 将在 7 年合同期内、Anthropic 追加购买最多 90 亿美元云服务时逐步 vest,使潜在承诺总额达到约 200 亿美元。Akamai 估计相关资本支出约为 55 亿美元;官方表示,该交易预计不会影响 2026 年营收指引,但 2026 年资本支出将增加约 17 亿美元,用于锁定并预购内存等关键供应链部件。
读原文 →
美联邦上诉法院裁定五角大楼可将 Anthropic 列为供应链风险
行业动态
美国哥伦比亚特区联邦巡回上诉法院以 2 比 1 驳回 Anthropic 的挑战,五角大楼可继续从系统移除 Claude,并禁止承包商在国防部工作中使用其产品;这并非联邦政府范围的禁用。
美国哥伦比亚特区联邦巡回上诉法院于 2026 年 9 月 25 日以 2 比 1 驳回 Anthropic 对五角大楼供应链风险认定的挑战。该裁决允许五角大楼继续从其系统移除 Claude,并禁止承包商在国防部工作中使用 Anthropic 产品,但限制不适用于整个联邦政府。多数意见认为,Anthropic 为 Claude 设置的限制可能使模型无法执行国防部认定合法且必要的国家安全任务,因此相关认定有充分依据。法院表示,供应链风险取决于 Anthropic 采取了什么行动,而非其动机。Anthropic 发言人表示公司不同意裁决,并称另一家联邦法院已判定政府的平行认定违法;公司正考虑包括进一步上诉在内的所有选项。
读原文 →
马斯克披露Colossus集群配置:现有78万颗GPU
行业动态
马斯克披露,SpaceXAI 的 Colossus 1 和 Colossus 2 目前共配置约 78 万块 GPU,并计划分三批各增加 22 万块 GB300,第三批以 2026 年 12 月 31 日前追加为目标。
2026 年 9 月 25 日,马斯克在 X 发文公布 SpaceXAI 两座 Colossus 超算集群的配置,并给出后续扩容安排。Colossus 1 包含 15 万块 H100、5 万块 H200 和 3 万块 GB200,合计 23 万块 GPU;Colossus 2 包含 11 万块 GB200 和 44 万块 GB300,合计 55 万块 GPU。两座集群现有 GPU 总量约为 78 万块。
扩容计划全部围绕 GB300 展开:22 万块计划于 2026 年 9 月 28 日至 10 月 4 日全面投入运行,2026 年 11 月内再增加 22 万块;据其说明,如果进展顺利,还可能在 2026 年 12 月 31 日前追加 22 万块。对于 Colossus 2 配置 11 万块 GB200 的原因,马斯克表示,这一数量由可接入中央交换机的光纤电缆数量决定。
读原文 →