每日 AI 日报

2026-09-15

来源:橘鸦 AI 早报 · 17 条

2026-09-15
2026-09-16 2026-09-15 2026-09-14 2026-09-13 2026-09-12 2026-09-11 2026-09-10 2026-09-09 2026-09-08 2026-09-07 2026-09-06 2026-09-05

豆包手机助手消费者版发布

要闻

豆包手机助手消费者版发布

字节于 2026 年 9 月 14 日发布豆包手机助手消费者版,加入本地记忆、跨 App Agent 与自动指令。版本将搭载 2026 年 9 月 16 日发布的努比亚 NaviX Ultra,并同步推送努比亚 M153 老用户。

字节在 2026 年 9 月 14 日正式推出豆包手机助手消费者版;该版本将搭载于 2026 年 9 月 16 日发布的努比亚 NaviX Ultra,并从当天起向努比亚 M153 老用户推送。此前的技术预览版发布于 2025 年 12 月 1 日。据其说明,消费者版升级了 AI 键、语音唤醒和屏幕问答:AI 键加入指纹鉴权,验证本人后无需二次解锁即可调用助手;语音唤醒针对远场、内外噪声和快语速做了优化;屏幕信息既可用于问答,也可直接成为任务输入。官方展示的场景包括依据新房照片筛选尺寸 1.2 米以内、价格 1,000 元以内的柜子,把课表照片写入日历,以及通过语音移除照片中的白色瓶子。

新版还把个人 Context、本地记忆与 Agent 执行串联起来。据其说明,助手可检索本地相册、短信和便签,录音功能接入飞书妙记,支持语音转录、实时翻译、说话人区分和重点总结;用户也可通过语音、三指上滑,或同时按住 AI 键与音量键保存当前屏幕,形成可检索的本地记忆。Agent 扩展了第三方应用生态及可供模型调用的自有接口,可跨 App 将体检注意事项写入便签、打车并添加途经点、把车牌发给飞书同事,或控制卧室空调。系统另有任务排队和插队机制,以及快捷指令和经用户授权、按时间、地点或事件触发的自动指令。字节表示,隐私与安全遵循合理必要和用户自主控制,并对 Agent 操作范围分层分级;官方同时承认,GUI Agent、跨 App 生态和任务稳定性仍待完善。

读原文 →

苹果发布新一代 Apple Intelligence,重构 Siri AI

要闻

Apple 随 2027 年软件版本推出由新一代 Apple Intelligence 驱动的 Siri AI,英文 beta 率先上线,并将支持法语、日语、韩语、葡萄牙语和西班牙语。

Apple 随 2027 年软件版本发布新一代 Apple Intelligence,并开始以英文 beta 推出其驱动的全新 Siri AI。官方表示,Siri AI 可结合个人语境、屏幕内容和网络信息回答问题,并从消息、邮件、照片等内容中检索所需信息;它还能执行系统级 app 操作,例如从零起草邮件,或编辑、分享一组照片。用户可围绕回答继续追问,也可通过独立 Siri app 查看历史对话;对话记录经 iCloud 在 iPhone、Mac、iPad、Apple Watch 和 Apple Vision Pro 间私密同步。

在设备入口上,iPhone 用户可用侧边按钮或从 Dynamic Island 下滑调用 Siri AI;iPad 和 Mac 通过 Spotlight 访问,系统级菜单还支持针对屏幕上的图像、文件或文字提问。Apple Vision Pro 提供可置于空间中的 3D 界面。官方还称,AFM Core Advanced 将为兼容设备提供更具表现力的语音,以及可自动处理大小写、标点和格式的听写;Visual Intelligence 已覆盖 iPhone、iPad、Mac 和 Apple Vision Pro,其中 iPhone Camera app 新增 Siri mode,iPad 则将该能力接入截图流程。Photos、Safari 和 Image Playground 也分别增加编辑、智能浏览和写实图像生成功能。

读原文 →

ChatGPT 桌面端语音功能降价约 60%,可用量提升至 2.4 倍

要闻

ChatGPT 桌面端语音功能降价约 60%,可用量提升至 2.4 倍

ChatGPT 已将桌面端应用内 Codex 和 Work 的语音功能价格下调约 60%,调整现已生效;降价后,用户可使用的 ChatGPT Voice 用量增至此前的 2.4 倍。

ChatGPT 桌面端应用已完成语音功能调价,Codex 和 Work 中的语音价格下调约 60%,目前已经生效。调价范围限定在桌面端应用内的 Codex 与 Work 语音功能。调整后,用户可使用的 ChatGPT Voice 用量达到原来的 2.4 倍。据其说明,这将增加用户通过语音编排任务的时间,并为实际工作提供更多可用 token。

读原文 →

ChatGPT 礼品卡正式在美国上线

产品应用

ChatGPT 礼品卡正式在美国上线

ChatGPT 礼品卡已在美国上线,收卡人可将卡内金额充入账户钱包,用于符合条件的订阅、续费和使用额度购买;兑换仅在美国开放,且账户必须以美元计费。

ChatGPT 礼品卡现已在美国正式上线,兑换功能当前仅在美国开放,并仅适用于以美元计费的账户。收卡人可前往 ChatGPT 官方兑换页面,将卡内金额充入账户钱包,随后通过 ChatGPT 网页版支付符合条件的订阅、续费和使用额度购买。该礼品卡可用于向亲友分享 ChatGPT,并将在假日季到来前进入消费者日常选购礼品的零售渠道。

读原文 →

DeepSeek 网页端与 App 端全量推送回答朗读功能

产品应用

DeepSeek 网页端与 App 端全量推送回答朗读功能

DeepSeek 已向网页端和 App 端全量推送回答朗读(TTS)功能,覆盖两端用户;该功能提供贝壳、白浪、海星、暗潮 4 种音色供用户选择。

截至 2026 年 9 月 15 日,DeepSeek 的回答朗读(TTS)功能已完成网页端与 App 端的全量推送,两类客户端的用户均在覆盖范围内。该功能可将 DeepSeek 的文字回答转换为语音朗读,用户可在贝壳、白浪、海星、暗潮 4 种音色中选择。本次推送同时面向网页端和 App 端,并非仅在单一客户端提供;两端均已覆盖全部用户,功能范围包括回答朗读及上述音色选项。

读原文 →

Anthropic推出Claude for Financial Advisors

产品应用

Anthropic 推出 Claude for Financial Advisors,整合研究、会前准备和文档 workflow;plugin 支持 9 个合作方,投资建议等受监管活动仍须人工审核批准。

Anthropic 已推出 Claude for Financial Advisors,通过 connectors 和 workflow skills 帮助金融顾问完成研究、客户会议准备及文档工作。官方表示,其 plugin 可单次安装,并在引导式设置中选择连接 BlackRock、Charles Schwab、Addepar、Envestnet、iCapital、Orion、Wealthbox、Wealth.com 和 Zocks。新 connectors 覆盖 CRM、托管机构、投资组合报告、财务规划软件、遗产规划工具和会议记录,并可配合 Claude 已有的 Microsoft 365、Salesforce、DocuSign、Box、FactSet、S&P Global 和 Morningstar 等 connectors 使用。BlackRock 还将为 Advisor Center 推出自有 plugin,S&P Global 和 LSEG 已有各自的 plugin。

据其说明,plugin 内的 skills 可汇集资料、生成摘要和起草客户沟通内容,机构也可从 Claude for financial advisors skill repository 直接采用或调整这些 skills。Claude 可准备 brief、分析草稿及 CRM 更新,但投资建议、客户沟通、合规判定和其他受监管活动均须由人工审核批准。compliance skill 会依据 SEC Marketing Rule 筛查面向客户的表述、标记潜在问题,并协助记录审核活动和 AI 使用政策。Anthropic 引用的 Kitces 研究称,典型顾问机构只有六分之一的时间用于客户会议;EBRI 的 2026 Retirement Confidence Survey 显示,超过每 10 名美国劳动者中的 4 名不知道应向谁寻求可靠的财务或退休规划建议。

读原文 →

Bolt.new 发布Forge与每月9美元Lite订阅方案

开发生态

Bolt.new 发布Forge与每月9美元Lite订阅方案

Bolt.new 推出由 Forge 驱动的 Lite 订阅,月费 9 美元,访问资格从原文未注明年份的 9 月 14 日起分批开放。个人 Pro 用户在同样未注明年份的 10 月 14 日前可免费获得最高 50 倍 Forge 使用量。

Bolt.new 推出的 Lite 订阅方案将从原文未注明年份的 9 月 14 日起分批开放访问,作为底层引擎的 Forge 也计划于同日开始 rollout。Lite 标价为每月 9 美元,用户加入 waitlist 后,将在名额开放时通过电子邮件收到 access code;官方称按年计费最高可节省 28%。Bolt.new 将 Forge 定义为新的 open-source model mode,并表示会在新的 frontier open-source models 出现后,将其中表现最好的模型接入 Forge。据其说明,个人 Pro 用户无需等待或使用 access code,即可在同样未注明年份的 10 月 14 日前免费获得最高 50 倍 Forge 使用量,且不影响 Pro 原有功能;该 research preview 不包括 Teams 和 Enterprise。

读原文 →

Cline 推出 Cline Desktop 原生桌面应用

开发生态

Cline 已发布原生桌面版 coding agent Cline Desktop v0.0.27,无需打开 VS Code 即可直接载入 workspace,并支持 Apple Silicon、Intel Mac 与 Windows。

Cline 推出独立原生应用 Cline Desktop v0.0.27,现提供 macOS(Apple Silicon 与 Intel)和 Windows 版本,全部下载文件可从 GitHub 获取。据其说明,用户可直接指定 workspace,由 Agent 读取、编辑并运行代码,界面会显示完整 workspace 名称及 git branch,无需 VS Code 窗口。应用沿用 IDE 与 CLI 中的开源 Cline Agent,支持自带 API key,原生连接 Anthropic、OpenAI、Gemini、open-weight models 或 local endpoint,可在项目中途切换模型,也可登录 Cline 账户。

据其说明,任务执行期间可将后续指令加入队列,并进行编辑、排序、立即发送或删除;修改较早消息时,应用会 fork session、将 workspace 回退至对应 checkpoint,再按修改后的 prompt 重新运行。sidebar 可汇总 desktop app、CLI、extension 及 scheduled runs 的 sessions,并按来源筛选或加入收藏。官方表示新 build 会频繁发布,当前版本可能仍有不完善之处,Beta feedback 将影响后续功能。

读原文 →

ElevenLabs 推出 ElevenLabs MCP 连接器

开发生态

ElevenLabs 推出 ElevenLabs MCP 连接器。官方表示,一次安装即可覆盖 ElevenAgents 与 ElevenCreative,后者可调用超过 50 个模型生成配音、音乐、图像和视频。

ElevenLabs 已发布 ElevenLabs MCP 连接器;官方表示,该 MCP 同时为 ElevenLabs Agents 提供支持,一次安装即可使用 ElevenAgents 和 ElevenCreative 两部分功能。ElevenAgents 用于在现有工具中管理语音和对话 Agent,可查看近期表现、创建新 Agent、更新配置,并在改动上线前估算 LLM 成本。ElevenCreative 通过同一连接器访问超过 50 个模型,支持以自然语言生成配音、音乐、图像和视频。

读原文 →

上海人工智能实验室发布开源 Agentic 模型 Atria Dawn Preview

模型发布

上海人工智能实验室发布开源 Agentic 模型 Atria Dawn Preview

上海人工智能实验室已开源 Agentic 模型 Atria Dawn Preview;官方称其采用基于 GLM-5.2 的 744B 参数 MoE 架构,支持 256K 上下文,并可通过 API 在线调用。

上海人工智能实验室已发布新一代 Agentic 模型预览版 Atria Dawn Preview,模型权重现已开放,并提供 API 在线调用。该模型以 744B 参数 MoE 架构的 GLM-5.2 为基座。官方表示,它支持 256K 上下文,面向需要持续理解环境、使用工具并完成多步任务的科研与工程场景,能力覆盖发现、创建、交付和网络安全四个维度。模型权重采用 MIT 协议,发布于 Hugging Face 和 ModelScope,包含 Atria-Dawn-Preview 与 FP8 量化两个版本。

读原文 →

Anthropic 联合 Accenture 发布企业 AI 从试点到生产实践指南

技术与洞察

Anthropic 联合 Accenture 发布企业 AI 从试点到生产实践指南

Anthropic 与 Accenture 联合发布企业 AI 从试点走向生产的指南,列出 7 项考量。报告显示,仅 23% 的高管称 AI 已产生持续的全企业影响,42% 的组织没有单一负责人统筹 AI 成本与成效。

Anthropic 与 Accenture 联合发布了一份面向 CIO 和技术负责人的企业 AI 实践指南,围绕如何将项目从试点推进到生产列出 7 项考量,以及管理层需要作出的相关决策。Accenture 于 2026 年 7 月发布的《Pulse of Change》报告显示,仅 23% 的 C-suite 领导者称其 AI 项目已在全企业范围形成持续影响。指南指出,试点通常由经过挑选、积极性和能力较高的团队在明确范围与时间表内执行,预算也常受到保护,因此不能代表生产环境中的常态。Accenture 于 2026 年 9 月发布的 Tokenomics 研究显示,42% 的组织由 IT 与财务共同承担责任,却没有单一负责人对 AI 成本和结果负责。官方表示,该指南基于 Claude 企业部署中的观察,以及 Accenture 在不同行业和地区实施项目的经验。

读原文 →

Anthropic 发文介绍扩容测试影响分析服务

技术与洞察

Anthropic 发文介绍扩容测试影响分析服务

Anthropic 称,CI job 量在 6 个月内增长 25 倍,三次修补维持 70 天、29 天和不足 1 天。公司最终重构 test selection 服务,以 stateless worker 实现水平扩展。

Anthropic 发文表示,公司在 CI job 量于 6 个月内增长 25 倍后,重构了 test impact analysis 服务,把原先由单进程承担的大量内存处理转移到 in-memory data store,使 listener worker 能以 stateless 方式水平扩展。据其说明,工程师每季度平均交付的代码量为 2021 至 2025 年期间的 8 倍,其中 80% 由 Claude 编写;代码库中的测试数量增长 10 倍,而新增工程师数量有限。

据其说明,原有 v0 服务依据历史表现和 package 相关性,为每次变更确定要运行的测试;由于每个测试的历史记录由单一 writer 顺序写入,服务无法水平分片。多个 CI job 每秒运行时,listener 会落后于 PR 队列,20 分钟延迟可能导致数万条测试更新未进入 selector。团队先后将运行服务的 core 数量翻倍,并按 package 拆分带有独立 worker 的 shard;三次修补分别维持 70 天、29 天和不足 1 天。重构后,任意 listener worker 都可将结果追加到 in-memory store 的 journal 后继续处理,无需在本地保存状态。

读原文 →

Anthropic 介绍医疗组织用 Claude Tag 在 Slack 组建人机协作团队

技术与洞察

Insight Health 和 Tennr 在不接触 PHI 的 Slack 频道试用 Claude Tag;前者 97% 的关键告警无需工程师介入即关闭,后者约 1 个月完成 15 项以上工单。

Anthropic 表示,Insight Health 已在不含 PHI 的工程与支持 Slack 频道运行 Claude Tag 3 个月,Tennr 则于 2026 年 7 月将它设为内部招聘门户的主要维护者。Claude Tag 目前为 beta,尚未纳入 Anthropic 的 Business Associate Agreement;据其说明,已有医疗组织将其用于不接触 PHI 的频道与 connectors,管理员可限定它能够进入的频道和系统。在 Insight Health 的关键告警频道中,Claude Tag 读取代码库与 Linear,另一 Agent Zeus 通过受 BAA 覆盖的 Claude API 查询生产数据,并在信息进入 Slack 前遮蔽 PHI。两者调查告警、建立并去重工单、提交 draft PR 和监控测试,最终由工程师审核合并;Claude Tag 上线后,97% 的告警无需工程师介入即关闭。

Tennr 使用 Claude Code 构建 recruiting.tennr.com,并让招聘人员、People 团队、招聘经理和 RevOps 在专用 Slack 频道用英文或截图提交需求,由 Claude Tag 修改代码、部署并回报结果。约 1 个月内,该团队以此完成 15 项以上工单,包括从 PDF 资料生成福利说明、加入 Dropbox Sign 链接、target bonus 字段和自助管理控制。它还在对外暴露的 copy API 被标记后于当天限制访问,修复 Ashby import 导致已发出 offer 的股权数值重置的问题并同步更正数值,同时负责 onboarding 文档与权限管理。Enterprise 组织启用 Claude Tag 并连接 GitHub 可获 25,000 美元 credit;拥有 10 个以上 seat 的 Team 组织可获 2,500 美元,均于 2026 年 10 月 1 日到期。

读原文 →

Sam Altman 呼吁前沿实验室共建AI安全标准

行业动态

Sam Altman 呼吁前沿实验室共建AI安全标准

OpenAI CEO Sam Altman 表示,公司现将在预计显著提升能力的前沿强化学习运行前制定安全案例,并呼吁其他前沿 AI 实验室共建 misalignment、监控与安全标准。

OpenAI CEO Sam Altman 表示,OpenAI 现已增加一项前沿 AI 安全措施:凡预计将显著提高能力的前沿强化学习运行,均会在启动前建立明确的安全案例;这项工作是在公司长期执行的模型发布前安全流程之外新增的。他解释说,多年前制定的 Responsible Scaling Policies 和 Preparedness Frameworks 主要面向已完成模型的部署,而将重点转向开发过程中的安全与评估,需要采用新的工具。

在行业协作与监管方面,Altman 支持通过联邦层面的框架为前沿 AI 设定一致的安全要求,但认为相关行动无需等到反垄断豁免或立法完成,也对独立审计人等构想持欢迎态度。他希望其他公司参考 OpenAI 的做法并提出各自方案,以形成覆盖 misalignment、监控和安全的共享标准。据其说明,pacing 不等于 stopping:AI 进展仍会继续,但速度应低于原本可能达到的水平;国际协调则需要政府提供帮助。

读原文 →

马斯克展望 Grok 4.7 至 Grok 5

前瞻与传闻

马斯克展望 Grok 4.7 至 Grok 5

马斯克公布 Grok 后续路线:4.7 约等于 Opus 5.0,4.8 是用新 C++ 栈训练的 2.5T 模型,4.9 可能达到 Astra、Fable 同级,Grok 5 或优于所有其他模型。

马斯克通过个人 X 账号说明了 Grok 4.7 至 Grok 5 的定位和训练安排,并称 Grok 4.8 将在该帖发布当周完成训练并开始 RL。按其说法,Grok 4.7 整体应与 Opus 5.0 大致相当,而非 Opus 5.1,在不同方面各有优劣,SpaceXAI 仍需修复多模态性能。Grok 4.8 是一个 2.5T 模型,采用新的 C++ 软件栈训练;Grok 4.9 可能达到 Astra、Fable 同级水平,Grok 5 可能优于所有其他模型。关于训练过程,马斯克表示,本轮训练无疑优于此前使用 Jax 的 2.1T 训练,但部分错误直到训练中期才得到纠正。据其说明,过去几个月的数据质量已经改善,下一轮 3T 训练将使用改进的内部训练软件和更好的数据,表现会强得多。以上均为马斯克个人账号发布的前瞻性判断。

读原文 →

报道称 Anthropic、OpenAI 与 Google 讨论共建 AI 标准机构

前瞻与传闻

报道称 Anthropic、OpenAI 与 Google 讨论共建 AI 标准机构

The Information 报道称,Anthropic、OpenAI 与 Google 曾商议共建一个测试和审计 AI 技术的标准机构;该消息目前尚未获得三家公司的官方确认。

据 The Information 独家报道,Anthropic、OpenAI 与 Google 在 Anthropic CEO Dario Amodei 公开呼吁 AI 开发者加强协调之前,已讨论合作设立一个专门测试和审计 AI 技术的标准机构。报道未说明相关讨论目前推进到哪一阶段,也未交代拟议机构的组织形式和成立时间表。Anthropic、OpenAI 与 Google 尚未对该消息作出官方确认。

读原文 →

报道称 OpenAI 以超 3 亿美元收购手机相机公司 Glass Imaging

前瞻与传闻

《华尔街日报》报道称,OpenAI 已收购智能手机相机技术公司 Glass Imaging,交易金额超过 3 亿美元;OpenAI 尚未确认该交易,也未立即回应置评请求。

据《华尔街日报》报道,OpenAI 已收购智能手机相机技术公司 Glass Imaging,交易金额超过 3 亿美元;报道未披露交易完成日期。该交易目前尚未获得官方确认,OpenAI 也未立即回应置评请求。Glass Imaging 成立于 2019 年,由前 Apple 工程师 Ziv Attar 和 Tom Bishop 创办;据介绍,两人此前曾领导 Apple 人像模式的开发团队。另有消息称,OpenAI 正在开发自有硬件,涉及智能手机、耳机和 AI 伴侣设备。

读原文 →