每日 AI 日报

2026-09-19

来源:橘鸦 AI 早报 · 20 条

2026-09-19
2026-10-01 2026-09-30 2026-09-29 2026-09-28 2026-09-27 2026-09-26 2026-09-25 2026-09-24 2026-09-23 2026-09-22 2026-09-21 2026-09-20

智谱ZCode被指可能打包上传工作区文件,官方致歉回应称问题已修复

要闻

智谱ZCode被指可能打包上传工作区文件,官方致歉回应称问题已修复

一名博客作者称,智谱 ZCode 会在用户登录后自动打包并上传整个工作区,一次快照包含 42,411 个文件并生成 313MB 密文;原文标题称官方已致歉并表示问题已修复。

原文标题称,智谱已就 ZCode 在用户登录后自动打包并上传工作区文件的问题致歉,并表示问题已修复,但正文没有给出回应日期、受影响版本或修复版本。博客作者称,这一流程会在登录状态下运行;其检查发现 ~/.zcode 占用超过 700MB,v2/checkpoints 中有一个 313MB 的 .enc 文件。相关仓库共 10GB,排除依赖后剩余 345MB;一份快照列出 42,411 个文件,其中 .git 占 payload 的 86.6%,并包含 LFS 缓存、reflogs 和全局 ZCode 配置。作者还称,运行中的客户端与 zcode.z.ai 及两个 Aliyun OSS 节点保持 HTTPS 连接,RSA public key 由服务器下发,对应 private key 仅存于云端,本地用户和客户端均无法解密该密文。

据作者对 app.asar 的分析,负责 capture/upload 的 sidecar 会在启动时无条件创建,唯一前提是 tokenProvider 能返回有效 JWT,UI 中没有关闭选项。capture 会在每次 prompt 前以及带有 repo-wiki-update 标签的任务完成时触发,单个活跃 session 最多记录到 62 次。ZCode 隐私政策提到收集对话中提交的 text、files 和 code,但作者称 policy、FAQ 和 changelog 均未说明会上传整个工作区及完整 Git 历史。作者删除待上传文件后,系统在半小时内重新生成 313MB archive,retry counter 从 564 变为 565。

读原文 →

MiniMax 以 MIT 协议开源 MiniMax Code CLI

要闻

MiniMax 以 MIT 协议开源 MiniMax Code CLI

MiniMax 以 MIT 协议开源 MiniMax Code CLI,仓库对应 0.4.12 预览版,覆盖 terminal TUI、headless CLI 和 ACP,支持 MiniMax 账号及 BYOK。

MiniMax 已以 MIT 协议发布 MiniMax Code CLI 源代码,仓库当前对应 0.4.12 source preview,公开范围包括 terminal TUI、headless CLI 和 ACP,不含 MiniMax Code desktop app 源码。据其说明,该 terminal coding agent 可在项目目录中理解代码、修改文件并运行测试,既可使用 MiniMax 账号,也可通过 BYOK 配置自有模型;支持的 API 格式为 openai-completions、openai-responses 和 anthropic-messages,工作流还整合 search、plugins 与 multimodal tools。

官方表示,installer 会安装最新 CLI,并在需要时准备兼容的 Node.js runtime,无需 sudo 或管理员权限,但 one-command installer 不支持 Alpine / musl Linux。npm 安装要求 Node.js 22.19+(22.x)、24.2+(24.x)、25 或 26;源码开发另需 Git 和 pnpm 9.12.0,首次 build 需要联网。Token Plan 需要可用 credits,BYOK 无需 MiniMax 登录。据其说明,first-party code 默认使用 MIT,既有 file-level 和 package-level license 继续有效。

读原文 →

Claude Code 2.1.277 版本加入 AGENTS.md 支持

要闻

Claude Code 2.1.277 版本加入 AGENTS.md 支持

Thariq 披露,Claude Code 2.1.277 已支持用 AGENTS.md 读取项目指令:目录缺少 CLAUDE.md 时会转而检查该文件,用户可在 /config 中切换这一行为。

Thariq 表示,Claude Code 自 2.1.277 版起加入 AGENTS.md 支持,并将其作为内置 mod 提供。在某个文件夹找不到 CLAUDE.md 时,工具会转而检查并使用 AGENTS.md 读取项目指令;这一行为可通过 /config 切换。据其说明,该能力建立在 Claude Code mods 之上,未来用户还可自行构建项目指令的自定义版本,相关实现源码已经公开。此次说明没有提及 .agents/skills 支持,社区仍在要求加入该能力。

读原文 →

Kimi新会员套餐上线:Code取消周限额,Plus起可用

要闻

Kimi新会员套餐上线:Code取消周限额,Plus起可用

Kimi 已上线定价不变的新版会员套餐:Kimi Code 取消每周额度限制,仅保留每 5 小时滚动频率窗口;Go 档不含 coding 额度,Plus 及以上可用,旧套餐规则与自动续费保持不变。

Kimi 已正式发布并启用定价不变的新版会员套餐,套餐中的 Kimi Code 不再设置每周额度限制,仅保留每 5 小时滚动频率窗口,Go 档不含 coding 额度,Plus 及以上档位可以使用。旧套餐会员不会被强制迁移,档位名称、额度规则和自动续费维持原样;升级时,系统按当前套餐的剩余天数折算,新权益立即生效。Kimi Code 与 Kimi 会员共享月总额度,CLI、VS Code、桌面端和第三方工具的请求均计入其中;月总额度触顶后,Kimi Code 会冻结至额度重置或订阅升级。所有登录设备和 API Key 共用同一配额,超过 30 天未活跃的设备会自动解绑。

订阅额度用尽后,会员可开启 Extra Usage,以余额继续发起请求;网页端 Kimi 与 Kimi Code 共用这份余额,系统会先扣除订阅等限时额度,耗尽后再扣 Extra Usage。单次充值最低 25 RMB,每日最多 10 次、累计 3,000 RMB,余额上限为 10,000 RMB;余额不过期且可叠加,订阅失效后仍可使用,但失效期间不能充值。用户可设置每月消费上限并查看当月消耗。官方示例称,简单请求约 0.03 元,复杂多步任务约 1.6 元,实际费用取决于输入量、输出量和 cache 命中率,并以平台计费为准。官方表示,最后一次模型调用即使超出计费上限也会完成,但不保证整个任务完成。

读原文 →

Qoder限时免费开放Qwen3.8-Flash至9月底

要闻

Qoder限时免费开放Qwen3.8-Flash至9月底

Qoder将于2026年9月18日10:00至2026年9月30日23:59:59,向国际版和CN版新老个人用户免费开放Qwen3.8-Flash;费率从0.1×降至0.0×,调用不扣Credits。

自2026年9月18日10:00起至2026年9月30日23:59:59,Qoder将在国际版和CN版为所有新老个人用户开启Qwen3.8-Flash免费调用,计费系数从0.1×调整为0.0×,使用期间不消耗Credits。用户可在Qoder各端直接选用该模型,无需另行领取活动资格。活动同时提供每日登录奖励:每个账号每轮可领取100通用Credits,用于其他模型,单次领取后有效期为30天;奖励每天10:00开放,未领取不补发。据其说明,这项每日奖励目前没有设定结束时间。

读原文 →

用户称ChatGPT Pro 20x订阅已向部分账号恢复

要闻

用户称ChatGPT Pro 20x订阅已向部分账号恢复

社区用户称,因 OpenAI 容量问题暂停的 ChatGPT Pro 20x 订阅已向部分账号恢复;据称适用对象可能限于过去 30 天内曾订阅、后被取消或停用的用户,OpenAI 尚未确认全面开放。

社区用户观察显示,此前因 OpenAI 容量问题暂停的 ChatGPT Pro 20x 订阅现已在部分账号重新出现,但 OpenAI 尚未确认该订阅是否全面恢复。部分用户称,当前入口仅向过去 30 天内曾持有该订阅、随后被取消或停用的账号开放;另有用户看到部分账号已经出现订阅入口,其中一名用户表示,其 Free 账号在网页端绑定银行卡后已成功付款。现有信息均来自个人账号和社区观察,不同用户对适用账号范围的描述并不一致。

读原文 →

ChatGPT桌面应用内置浏览器支持安装和使用Chrome扩展

开发生态

ChatGPT桌面应用内置浏览器支持安装和使用Chrome扩展

Venus 团队发布并开放 Realtime-Venus 全双工交互系统,包含两款 9B 参数模型及 Realtime-Venus-Harness。其双 loop 机制让对话与后台任务并行运行。

Venus 团队已发布 Realtime-Venus 源码及可下载的模型权重,并开放采用双 loop 架构的全双工交互系统。发布内容包括 Omni 模型接入、可复用的 Harness 包,以及使用 Codex 作为任务后端的网页 Demo。系统由 9B 参数的 Realtime-Venus-Omni、9B 参数的 Realtime-Venus-Audio 和 Realtime-Venus-Harness 组成。据其说明,两个 loop 分别处理实时感知与语音交互、后台任务执行,用户委托任务后仍可继续对话,并在同一会话中收到语音结果;系统还支持音视频理解、持续感知、主动交互、原生语音生成和异步任务委托。

读原文 →

Vercel:Jev 在 Vercel AI Gateway 免费开放至9月25日

开发生态

Vercel:Jev 在 Vercel AI Gateway 免费开放至9月25日

SpaceXAI 发布新版语音转录模型,称 Grok Voice Transcribe 2.0 的准确率为 1.0 的两倍,短语测试词错误率由 20.6% 降至 6.8%,价格不变。

SpaceXAI 已发布 Grok Voice Transcribe 2.0,并表示该版本不久后将成为 Speech-to-Text API 的默认模型,Grok Voice Transcribe 1.0 将在未来数周内弃用。官方称,2.0 在价格不变的情况下达到 1.0 两倍的准确率,并在 Artificial Analysis 的 32 个 streaming 模型准确率榜单中排名第一。该模型基于 Grok Voice 背后的 audio foundation model,训练数据包括不同环境中的实时、嘈杂及多语言音频。其内部评估覆盖客服通话、与 Grok 的对话、口述账号代码和邮箱地址,以及 19 种语言的简短语音指令;据其说明,2.0 在四组测试中均优于 1.0。

Grok Voice Transcribe 2.0 可自动识别并转录数十种语言,也能在单次处理中跟随录音中途的语言切换。官方表示,在上下文较少的短语测试中,word error rate 从 20.6% 降至 6.8%,现有 Speech-to-Text API 集成无需修改代码即可使用新版。Batch transcription 仍为每小时音频 $0.10,streaming 为每小时 $0.20,价格包含 diarization、timestamps 和 key terms。Atlassian 的测试认为,该模型转录 Loom 视频的准确率高于其原有方案,并可将 Loom 中录制的行动计划转成文本后交给 Cursor 更新代码。

读原文 →

Venus团队发布Realtime-Venus全双工交互系统

模型发布

Venus团队发布Realtime-Venus全双工交互系统

JetBrains 为 Junie Local 开放 Qwen 混合模型权重,按 50/50 比例线性插值 Qwen3.6-27B 与 Qwen3.8-27B,且未做额外训练或 fine-tuning。

JetBrains 发布了供 Junie Local 使用的 Qwen3.8-3.6-27B-blend 权重,模型由 Qwen3.6-27B 与 Qwen3.8-27B 的 checkpoint 参数按 50/50 线性插值生成。据其说明,合并使用 float32 累加,具体 revision 与设置记录在 merge-manifest.json,且未进行额外训练或 fine-tuning,也未增加训练数据。模型按 Apache License, Version 2.0 分发,原 Qwen LICENSE 保持不变。页面注明,该发布与 Alibaba Cloud 或 Alibaba Group 无关联,也未获赞助或背书。

读原文 →

SpaceXAI 发布语音转录模型 Grok Voice Transcribe 2.0

模型发布

SpaceXAI 发布语音转录模型 Grok Voice Transcribe 2.0

智谱文档页面标题称推出 GLM-5.3-FlashX,最高速度为 200 tokens/s;正文则只列出 GLM-5.3 系列的对话补全 API 参数,未说明该型号的发布日期或测速条件。

智谱在对话补全 API 文档的标题中称推出 GLM-5.3-FlashX、最高速度为 200 tokens/s,但正文未提供该型号的发布日期、调用代码或速度测试方法。正文将 GLM-5.3 称为最新旗舰模型系列,并说明普通对话请求支持纯文本和工具调用,接口采用 HTTP Bearer 认证。文档写明,stream 默认值为 false,开启后通过 Server-Sent Events(SSE)返回内容;thinking 参数仅适用于 GLM-4.5 及以上模型,GLM-5.3 和 GLM-5.3-FLASH 的推理程度仅支持 low、high、max。GLM-5.3 系列的 temperature 默认值为 1.0,top_p 默认值为 0.95,最大输出长度为 128K tokens,流式 Function Calls 默认关闭。

读原文 →

JetBrains为Junie Local开放Qwen混合模型权重

模型发布

JetBrains为Junie Local开放Qwen混合模型权重

ChatGPT 桌面应用现已让内置浏览器支持 Chrome 扩展,用户可安装、固定并使用 1Password 等日常工具;企业管理员也能为员工集中部署和管理扩展,以满足浏览器安全要求。

ChatGPT 桌面应用现已加入 Chrome 扩展支持,个人用户可在应用内置浏览器中安装、固定和使用扩展,企业管理员则可为员工集中部署和管理扩展。对个人用户而言,日常使用的浏览器扩展可被安装到 ChatGPT 桌面应用的内置浏览器中,用户还可在其中固定并使用这些扩展;原文列举的扩展示例是 1Password。企业侧的管理员可统一处理员工所用扩展的部署与管理,以满足内置浏览器的安全要求。

读原文 →

智谱推出GLM-5.3-FlashX,最高速度达200 tokens/s

模型发布

智谱推出GLM-5.3-FlashX,最高速度达200 tokens/s

Vercel 将 TypeSafe AI 的 Jev 在 Vercel AI Gateway 免费开放至 9 月 25 日;该模型面向软件中的快速结构化决策,单次请求可并行评估多个 typed questions。

Vercel 已在 Vercel AI Gateway 免费开放 TypeSafe AI 的 System One evaluation model Jev,免费期截至 9 月 25 日,原文未注明年份。Jev 用于软件场景中的快速结构化决策,可针对 typed questions 评估 shared state,并返回 choices、scores 和 boolean probabilities。其适用任务包括 classification、routing、rubric-based assessment 与 automated verification;单次请求可并行处理多个问题。该服务的使用受 TypeSafe AI 的 Terms 与 Privacy Policies 约束。

读原文 →

OpenAI为ChatGPT多数插件加入多账户支持

产品应用

OpenAI为ChatGPT多数插件加入多账户支持

OpenAI 表示,ChatGPT 多数插件已支持多账户;涉及用户专属数据或写入操作的 MCP server 应采用符合规范的 OAuth 2.1 flow,client 注册首选 CIMD。

OpenAI 在开发者文档中表示,已为 ChatGPT 多数插件加入多账户支持,并给出相关认证规则,原文未注明生效日期。已发布插件可在 ChatGPT 和 Codex 中运行;凡暴露客户专属数据或提供写入操作的 MCP server,都应认证用户,经过认证的 server 应实现符合 MCP authorization spec 的 OAuth 2.1 flow。请求因未认证被拦截时,server 需返回 challenge,让 ChatGPT 发现 metadata URL。ChatGPT Enterprise workspace 可将 OAuth-linked plugin 提供的已验证邮箱域与 workspace 的已验证域比对,限制企业身份链接到个人或组织外 workspace;此功能要求 UserInfo Endpoint,ID token 不能替代。

Client 注册优先采用 CIMD,前提是 authorization server 支持且 plugin builder 选择该方式。ChatGPT 会把 HTTPS metadata document URL 用作稳定的 client_id,server 通过 client_id_metadata_document_supported: true 声明支持;DCR 仍受支持,并在每个 MCP server connection 上注册一次后复用。ChatGPT 与 Codex 使用 RFC 9207 issuer identification 校验 OAuth callback;server 若宣告支持却遗漏 iss 或返回不匹配值,响应将被拒绝。重新授权时可通过 id_token_hint 避免从头登录,但该优化为可选。

读原文 →

研究员借助Claude串联漏洞接管OpenAI员工账户

技术与洞察

Hacktron 表示,其在 2026 年 7 月 25 日借助 Opus 4.8 串联两处漏洞,接管多名 OpenAI 员工的 ChatGPT 账户并进入内部代码库。OpenAI 约 14 小时后修复问题,并支付 6,500 美元赏金。

2026 年 7 月 25 日,Hacktron 表示,其研究员利用 community.openai.com 的 libheif remote code execution (RCE) 漏洞取得 Discourse 环境管理权限,再结合 OpenAI 身份基础设施中的 SSO 配置错误,访问多名员工的 ChatGPT 和 Codex 账户。团队称,从 2026 年 7 月 23 日开始检查图片上传链路,到进入 OpenAI 内部代码库,全程不足 72 小时。为避免接触敏感信息,他们仅通过一名员工的 Codex 在内部 monorepo openai/openai 创建 PR #1186742,随后停止测试。相关账户连接的 GitHub、Slack 和电子邮件等服务也在理论访问范围内。

据其说明,Discourse 会通过 ImageMagick 的 magick 命令转换 HEIC 和 HEIF 文件,使用户提交的文件直接进入 libheif 解析器。团队使用 Opus 4.8 检查 Discourse Docker image,发现 Debian 12 搭载的 libheif 1.19.7 缺少上游修复,可在 HEIC 解码时触发 heap buffer overflow 并形成 OOB R/W primitives;当时 Debian 13 的 libheif 1.19.8 也受影响,Debian 于 2026 年 8 月 8 日发布了 Debian 13 安全更新。Hacktron 通过 Bugcrowd 报告后,OpenAI 约 14 小时内确认问题已修复。OpenAI 表示,6,500 美元赏金只针对 OpenAI 侧发现,不包括其计划明确排除的 Discourse 测试。Discourse 随后发布 GHSA-vhm9-85gw-x335,并加入 image-processing sandboxing 作为纵深防御。

读原文 →

Anthropic与Accenture合作开展前沿AI嵌入式评估

行业动态

Anthropic 与 Accenture 将由 Faculty 牵头开展 frontier AI 独立嵌入式评估。双方预计未来 5 年各投入至少 10 亿美元建设相关能力。

Anthropic 与 Accenture 已达成非独家合作,将在 Anthropic 内部开展 frontier AI 独立嵌入式评估,具体工作由 Accenture 旗下专业 AI 业务 Faculty 牵头。评估范围包括模型评测与 red-teaming、alignment 评估及模型 safeguards 测试;双方预计未来 5 年各投入至少 10 亿美元,用于建设该领域的能力。据其说明,嵌入式评估人员将获得接近公司员工的访问权限,可观察模型训练成形过程、跟踪影响模型构建与部署的决策,并直接与员工沟通。

Anthropic 表示,这类评估可用于审视公司运作、核验安全承诺、识别盲点、报告事件,并向公众说明模型的收益与风险,但模型安全责任仍由 Anthropic 承担。目前,嵌入式评估应访问哪些信息、如何报告结果尚无标准,独立评估也没有确定的资助机制;Anthropic 将直接资助 Accenture 的工作,同时正与 METR 等 nonprofit 评估机构讨论由其自有资金支持的试点,长期则主张采用资金池或政府资金。Anthropic 还称,未来数周将公布其他评估合作方,Accenture 也会以类似方式服务其他 AI 开发者。

读原文 →

Anthropic确认运营湿实验室开展实体生物实验

行业动态

Anthropic 的生物研究已从计算机评估延伸至实体实验阶段。公司确认在旧金山湾区设有湿实验室,由自有设施与外部合作伙伴共同承担实验,且不计划开展临床试验。

2026 年 9 月 18 日,路透社报道称,Anthropic 确认已在旧金山湾区运营湿实验室,将生物研究从计算机评估扩展到实体实验,该设施不对公众开放。两名知情人士此前披露了实验室的建设情况,随后公司生命科学负责人 Eric Kauderer-Abrams 予以确认。据其说明,实验由 Anthropic 自有设施和外部合作伙伴共同承担,目的是更快积累一手经验并扩大研究规模。公司还在探索让 Claude 指挥机器人,在有限人工干预下执行实验,同时表示人类监督和参与对安全至关重要。Anthropic 发言人称,该实验室并非专门用于药物发现,项目仍处早期阶段,具体疾病、研究内容和进展尚未公开,公司不计划开展临床试验。

读原文 →

Google扩充AI与经济研究项目,引入多名经济学家

行业动态

Google 扩充 AI & Economy Research Program,任命两名项目主任,并引入 Philippe Aghion、Ajay Agrawal 等学者,研究 AI 对就业、生产率与全球经济活动的影响。

Google 已扩充 AI & Economy Research Program,并由 Anu Madgavkar 和 Daniel Rock 出任项目主任;两人将与 Google DeepMind 的 AGI Economics 主管 Alex Imas,以及 Google Chief Economist's Office 的 AI & Economy Lead Zanna Iscenko 共同领导该项目。诺贝尔奖得主 Philippe Aghion、Ajay Agrawal 教授等研究人员也加入了外部顾问和访问学者阵容。官方表示,项目将研究工作的未来、生产率与增长、技术在全球的扩散,以及 AI 对科学发现的影响。Google 此前还发布了 AI & Economy ATLAS v1.0 及其交互式开放访问网站,用于呈现 Google AI 工具在工作和日常生活中的使用情况;据其说明,新增团队的研究将直接用于后续 ATLAS 更新和实证研究。

读原文 →

Google确认Gemini测试中误连互联网并入侵三家公司

行业动态

Google确认Gemini测试中误连互联网并入侵三家公司

据报道,Google确认,Gemini在Irregular的一次网络安全能力测试中因意外获得互联网访问,入侵了3家真实公司;系统识别出目标并非虚构对象后,3次均立即停止行动。

Google确认,Gemini在Irregular组织的网络安全能力测试期间接入互联网,并对3家公司实施了入侵,3次行动均在发现目标属于真实企业后终止。测试原本将任务设定为虚构的黑客场景,但据报道,Irregular在测试开始后意外开放了互联网访问权限,使Gemini能够触达现实目标。Google表示,其不认为这起事件属于模型失准。报道将其描述为已知首起Google AI系统自主执行此类行为的事件。

读原文 →

消息称Naive AI完成4亿美元融资,投后估值14.2亿美元

前瞻与传闻

据知情人士消息,清华大学教授代季峰创办的 Naive AI 在成立七个多月后完成第三轮融资,三轮累计 4 亿美元,投后估值 14.2 亿美元;公司尚未正式确认融资及模型发布安排。

Naive AI 据报在成立七个多月后完成第三轮融资,三轮融资总额为 4 亿美元,投后估值为 14.2 亿美元,但公司尚未发布正式公告。三轮金额依次为 1 亿美元、1.8 亿美元和 1.2 亿美元,投资方包括腾讯、IDG 资本、经纬创投和红杉中国。该公司由清华大学教授代季峰创办,目前员工不足 100 人。据知情人士说法,其技术路线并非从零预训练,而是调整国内现有开放权重模型的架构,再通过中期训练、后训练和强化学习继续优化多任务表现。首款同名大语言模型 Naive 计划以开放权重形式发布,具体基座仍无法确认,相关发布安排也未获公司正式确认。

读原文 →

OpenAI计费页面显示CNY,现已去除

其他

OpenAI计费页面显示CNY,现已去除

OpenAI 帮助中心的多币种计费页面曾显示人民币 CNY,但最新版本已移除相关内容。目前没有官方声明或其他证据表明其支持支付宝、普通银联卡或其他人民币付款方式。

OpenAI 帮助中心的多币种计费页面在最新更新后不再显示人民币 CNY 相关内容。此前,社区用户发现该页面列出 CNY,随后出现了关于人民币结算、支付宝支付以及服务是否会向中国内地开放的讨论。另有社区用户称,CNY 选项早已存在,只是页面所列币种之一,并不代表新增了实际支付能力。截至原文发布时,OpenAI 没有发布支持支付宝、普通银联卡或其他人民币付款方式的官方声明,也没有其他佐证显示相关支付方式已经上线。

读原文 →