Epoch 0
JA · EN
每日 AI 日报
2026-08-26
来源:橘鸦 AI 早报 · 27 条
阿里千问预告今日将开源Qwen3.8-Flash-Next
要闻
阿里千问预告,Qwen3.8-Flash-Next 预计于北京时间 8 月 26 日 23:00 开源。该多模态 MoE 模型基于下一代 Qwen4 架构,权重目前尚未发布。
阿里千问预计于北京时间 8 月 26 日 23:00 开源 Qwen3.8-Flash-Next,相关预告已发布在魔搭社区和 Hugging Face。目前发布仍处于倒计时阶段,模型权重尚未放出。据其说明,Qwen3.8-Flash-Next 是基于下一代 Qwen4 架构构建的多模态 MoE 模型。官方表示,提前公开这些架构改进,是为了帮助社区为后续推出的完整 Qwen4 模型家族做准备;更多细节暂未公布。
读原文 →
OpenAI公布Jalapeño推理芯片实测数据
要闻
OpenAI 公布首款自研定制推理芯片 Jalapeño 的首次实测结果:在三款模型的 InferenceX 测试中,其峰值每瓦性能为对比系统的 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。
OpenAI 已公布 Jalapeño 的首次实测性能数据,并计划于今年年底把这款首款自研定制推理芯片部署到其计算基础设施中。测试采用 InferenceX 基准,覆盖 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T;官方表示,Jalapeño 以单一架构提供更高吞吐量、更低延迟和更多每瓦 AI 算力,其峰值每瓦性能达到对比系统的 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。据其说明,第二代芯片已进入深入开发阶段,第三代芯片已初步成型;OpenAI 还将继续部署 NVIDIA 及其他合作伙伴的加速器。
读原文 →
Codex 重置付费用户用量,并恢复 Plus 和 Business 订阅5小时限额
要闻
OpenAI 调整 Codex 付费额度,重置 Plus、Team 和 Pro 用户的额度,并恢复 Plus 的 5 小时使用限额;社区称 Team 同样受限。桌面版还开始原生显示已配置的第三方模型。
OpenAI 已重置 Codex Plus、Team 和 Pro 用户的使用额度,并恢复 Plus 订阅的 5 小时使用限额;Codex 桌面版同时开始原生显示已配置的第三方模型。官方表示,恢复该限额是为了平滑算力负载,并避免用户过快耗尽每周额度。社区随后反馈,Team 订阅也受到相同限制。另有用户实测发现,桌面端会话已不再按 provider 隔离,但 CLI 中的会话仍按 provider 隔离。
读原文 →
OpenAI 正式推出每席 100 美元的 ChatGPT Business Premium 席位
开发生态
OpenAI 已在 ChatGPT 上线 Business Premium 席位,每席定价 100 美元;该席位取消 5 小时用量限制,并提供标准席位 5 倍的可用量。
OpenAI 宣布,ChatGPT Business Premium 席位现已可在 ChatGPT 中使用,每席价格为 100 美元。Greg Brockman 表示,此次上线源于大量用户提出的需求。据其说明,Premium 席位不再设置 5 小时用量限制,可用量为标准席位的 5 倍。Tibo 表示,该方案与价格为 100 美元的 Pro 方案相近,但面向团队和小公司设计。
读原文 →
ChatGPT Work 新增代用户登录网站能力
开发生态
ChatGPT Work 已面向 Plus、Pro 和 Business 用户逐步推出网站代登录功能,覆盖网页端和移动端。官方称,ChatGPT 登录时不会看到用户名或密码。
ChatGPT 官方账号宣布,ChatGPT Work 自公告发布当日起在网页端和移动端逐步开放网站代登录能力,适用对象为 Plus、Pro 和 Business 用户。该功能使用其 computer 和 browser 进入并登录网站;据官方说明,登录步骤由 ChatGPT Work 代为执行,ChatGPT 在整个过程中不会看到用户的用户名或密码。官方还表示,用户平时需要亲自打开浏览器并逐项点击完成的任务,也可以尝试交由 ChatGPT Work 处理。
读原文 →
ChatGPT 浏览器扩展新增支持 Edge、Brave、Opera 与 Vivaldi
开发生态
OpenAI 的 ChatGPT 浏览器扩展已支持 Edge、Brave、Opera 与 Vivaldi,可把标签页上下文交给桌面版和 Codex,并驱动浏览器执行网页任务;Opera 暂无 side chat。
OpenAI 的 ChatGPT 浏览器扩展现已新增对 Microsoft Edge、Brave、Opera 和 Vivaldi 的支持,并可把当前标签页的上下文带入 ChatGPT 桌面版任务。Codex 可基于用户正在查看的内容工作,扩展也能驱动浏览器完成取消订阅、向 CRM 录入数据等网页操作。用户还可在任意标签页通过 side chat 调用 ChatGPT 的完整能力;该功能目前尚未在 Opera 推出,官方表示将很快上线。
读原文 →
ChatGPT 定时任务更新:支持 Github 等应用变化触发
开发生态
ChatGPT 官方扩展网页端和移动端 ChatGPT Work 的定时任务:Plus 和 Pro 用户可由 Slack、Gmail、Github 的变化触发响应,免费用户将逐步获得最多三个任务的额度。
ChatGPT 官方宣布,网页端和移动端 ChatGPT Work 的定时任务现已更新:Plus 和 Pro 用户可将 Slack、Gmail 和 Github 中出现的变化设为触发条件,让任务自动响应,而非只能依据固定时间表执行。定时任务功能同时正陆续向 ChatGPT 免费用户推出,免费用户最多可创建三个任务。用户现在也可分享自己常用的任务,其他人获得后可以按自身需求定制并使用。
读原文 →
OpenAI 推出 WebMCP 支持及黑客松
开发生态
OpenAI 正为 ChatGPT 桌面浏览器和 ChatGPT Sites 接入 WebMCP,使其可调用兼容网站工具;同时与 6 个合作方启动为期 10 天的 WebMCP Challenge。
OpenAI Developers 宣布,ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 正在接入 WebMCP;OpenAI 同时与 Google Chrome、Cloudflare、Shopify、Vercel、Render 和 Netlify 推出为期 10 天的 WebMCP Challenge 黑客松。WebMCP 是一项实验性开放标准,网站可借此直接向 Agent 提供结构化工具。用户访问兼容网站时,ChatGPT 或 Codex 可自动使用该网站暴露的工具执行任务。
读原文 →
Cursor 调整计费方式和套餐额度
开发生态
Cursor 将 Auto 从统一定价改为按实际路由模型收费,多数请求价格将高于此前;同时上调自有模型套餐额度,并在此前翻倍后再次永久增加 Grok 模型包含额度。
Cursor 已结束 Auto 的统一定价,并提高自有模型套餐和 Grok 模型的可用额度,其中 Grok 部分为再次永久调整。新的 Auto 费用按照每次请求实际路由到的模型计算;官方表示,多数请求的价格会高于原先的统一价格。自有模型套餐的额度调整覆盖 Auto。Grok 方面,据其说明,Grok 4.6 使用需求上升,因此 Cursor 在此前已将 Grok 模型包含额度翻倍的基础上继续增加额度,并将本次增加设为永久调整。
读原文 →
Command Code 宣布支持支付宝支付
开发生态
Command Code 官方宣布为其产品加入 Alipay(支付宝)付款选项,确认该产品已支持这一支付方式。与此同时,多名社区用户提出增加中文界面和中文文档的诉求。
Command Code 官方宣布,其产品已新增对 Alipay(支付宝)的支付支持,该渠道现被列为产品新增加的付款方式。此次消息的核心是支付选项更新,发布内容以 Alipay 支持为明确的产品变更。与此同时,多名社区用户围绕中文本地化提出诉求,具体包括增加中文界面,以及为产品增加中文文档。支付支持来自 Command Code 官方公告,中文界面与中文文档则属于社区用户提出的需求,两者在消息中的状态不同。
读原文 →
商汤 SenseNova U1.5 Lite 生图模型接入 Token Plan
开发生态
商汤宣布 SenseNova U1.5 Lite 图片创作模型接入日日新 SenseNova Token Plan,公测期每 5 小时提供 1,500 次免费请求,并支持免费生成无水印高清原图。
商汤已在公测期间将新一代图片创作模型 SenseNova U1.5 Lite 正式接入日日新 SenseNova Token Plan,并为该模型开放免费调用额度。免费额度按每 5 小时 1,500 次请求计算;调用方在图片生成请求中将 watermark 参数设置为 false,即可免费获得无水印高清原图。官方表示,无水印高清原图生成能力后续将转为付费,但原文未说明公测结束时间、开始收费的具体日期及价格。
读原文 →
Grok 4.6 现已登陆 OpenCode Go
开发生态
OpenCode 通过官方账号确认,Grok 4.6 已在 OpenCode Go 上线并向订阅用户开放,目前处于可用状态。使用配额按 5 小时计算,每个周期可发起 169 次请求。
OpenCode 已通过官方账号宣布,Grok 4.6 现已在 OpenCode Go 上线,并向 OpenCode Go 订阅用户开放。该模型当前处于可用状态,开放范围限定为 OpenCode Go 的订阅用户。其使用额度以 5 小时为计算单位,在每个 5 小时区间内可提交 169 次请求。官方此次公布的信息包括模型名称、上线平台、可用状态、面向的用户范围和请求配额,分别为 Grok 4.6、OpenCode Go、当前可用、订阅用户,以及每 5 小时 169 次请求。
读原文 →
官方称 OpenCode 因遭滥用下架5美元入门优惠
开发生态
OpenCode 已取消首月 5 美元的入门优惠,当前起始价格改为每月 10 美元。官方人员 dax 表示,该方案吸引了大量滥用,后续将寻找更不易受滥用影响的新方案。
OpenCode 已移除首月 5 美元的入门优惠,当前起始价格调整为每月 10 美元。该价格变化最先由社区用户发现,之后 OpenCode 官方人员 dax 确认,首月优惠已经从定价方案中撤下。据 dax 说明,取消原因是这项优惠吸引了大量滥用。官方表示,仍然认可设置入门优惠这一想法,但后续需要寻找一种不易受滥用影响的新方案。当前公布的起始价格为每月 10 美元,首月 5 美元优惠已不再列入定价。
读原文 →
Anthropic 统一 Claude 对话与 Cowork 记忆
产品应用
Anthropic 已统一 Claude chat 与 Cowork 的 Memory,双方可共享并回写用户上下文;该功能在 Free、Pro、Max 的 web、desktop 和 mobile 端默认开启,敏感主题保存仍默认关闭。
Anthropic 已将 Claude chat 与 Cowork 使用的 Memory 合并为同一套,Cowork 在 cloud 执行任务时可读取 chat 中积累的上下文,任务产生的信息也会回到 chat。官方表示,Claude 现在会在对话进行时按 topic 写入 Memory,而不是等对话结束后再生成摘要,因此项目期限、工作偏好和指标定义等信息可用于后续对话与 Cowork 任务。用户可随时暂停或重置 Memory,并在 Settings > Memory 的 Topics 中逐项查看、编辑或删除短文件;修改一处后,之后的所有对话都会使用修正后的内容。
据其说明,个人或敏感主题默认不保存,包括健康、种族、族裔、宗教信仰、政治立场和性别认同。用户可开启“include sensitive topics in memory”,开启后 Claude 每次保存此类信息都会显示通知,只记录开启之后出现的内容,不会追溯写入此前信息,且该设置可随时关闭。即使开启,Claude 仍不会保存 SSN、government ID numbers 等敏感识别号码、criminal history、immigration status 或违反 AUP 的内容,并会在无法更新时告知用户。Memory 在 Free、Pro、Max 的 web、desktop 和 mobile 端默认开启;iOS 与 Android 需更新至最新版 app。Team 和 Enterprise 由 admin 决定组织是否可用,个人用户仍需自行开启。
读原文 →
豆包工作正式发布,下载电脑版可领 30 天订阅权益
产品应用
豆包正式推出面向生产力场景的 Agent 产品“豆包工作”;下载电脑版或将豆包电脑版升级至最新版,可领取 30 天订阅权益,现有订阅用户的有效期顺延 30 天。
豆包已正式发布生产力 Agent“豆包工作”,自发布之日起,用户下载豆包工作电脑版或把豆包电脑版更新至最新版本,均可获得 30 天订阅权益,已有豆包订阅的用户领取后,有效期再延长 30 天。官方表示,该产品可根据用户目标拆分任务、调用工具并持续执行复杂工作流程,支持文档、表格和 PPT 等办公任务;它还能操作电脑和浏览器,执行过程对用户可见,用户可随时接管。产品同时与飞书深度打通,据其说明,Agent 可利用企业上下文提高任务完成的准确性。
读原文 →
千问APP与PC端「工作助理」支持绑定阿里云Token Plan额度
产品应用
千问APP与PC端已接入阿里云Token Plan,用户绑定API Key后,可让「工作助理」使用订阅额度处理操作电脑和浏览器、调用skill交付office文档等复杂任务,所耗Token会直接从该额度扣除。
千问已在APP与PC端上线阿里云Token Plan接入功能,用户绑定API Key后即可调用Token Plan订阅额度,该功能现已可用。完成绑定后,千问「工作助理」处理复杂任务所产生的Token消耗,将直接计入并从用户的Token Plan订阅额度中扣除。原文列出的任务类型包括操作电脑和浏览器,以及调用skill交付office文档;上述任务均可通过这项接入功能使用用户已绑定的额度。
读原文 →
ChatGPT推出Stickers贴纸生成功能
产品应用
ChatGPT 官方上线 Stickers 功能,用户可借助 ChatGPT Images 将照片或创意制成带透明背景的自定义表情包,并分享到 iMessage 或 WhatsApp。
ChatGPT 官方宣布推出 Stickers,用户可在侧边栏选择“Images”,再点击“Stickers”进入制作流程。该功能通过 ChatGPT Images 将用户上传的照片或输入的创意转为自定义表情包,并支持为生成结果设置透明背景;完成后的贴纸可分享到 iMessage 或 WhatsApp。据官方说明,透明背景能力不只适用于 Stickers,用户也可以用它处理其他图片。
读原文 →
Google Labs 推出实时协作 vibe coding 工具 Play with Putty
产品应用
Google Labs 宣布推出协作式 vibe coding 实验工具 Play with Putty,并已开放候补名单。官方表示,该工具支持多人实时共同搭建工具和网站,目前仅限美国年满 18 岁的用户申请。
Google Labs 已宣布推出实验项目 Play with Putty,并同步开放候补名单,符合条件的用户可登记参与。Play with Putty 被定位为协作式 vibe coding 工具;官方表示,它允许多人实时共同搭建工具和网站。此次实验的使用范围限定为美国地区年满 18 岁的用户。Google Labs 还邀请加入候补名单的用户向项目团队分享反馈。
读原文 →
Perplexity 发布本地 Agent 应用 Portable Computer
产品应用
Perplexity 推出本地 AI Agent「Portable Computer」,首发适配 NVIDIA DGX Spark。该应用已向持有该设备的 Pro 和 Max 用户开放,可经授权调用云端模型,并将敏感文档保留在本地。
Perplexity 于 2026 年 8 月 26 日发布 Portable Computer,这是一款面向 NVIDIA DGX Spark 的本地 AI Agent,现已对拥有该设备的 Pro 和 Max 用户开放。应用内置 PPLX 27B,并支持 Qwen 3.8 27B;当任务需要更强的推理能力时,可在用户授权后调用云端前沿模型,而敏感文档仍存放在设备上。Perplexity 还公布了知识工作、网页研究和文档解析的一系列测试结果,官方以此说明产品在隐私、成本和本地执行效率方面的优势。据其说明,后续支持范围将扩展至更多 NVIDIA 硬件和模型。
读原文 →
Apodex 发布 Apodex 1.1 模型家族,开源 35B 的 mini 版本
模型发布
Apodex 推出 Apodex 1.1 模型家族,完整模型已接入在线工作台;35B 的 mini 版本开放权重并支持本地部署,开源 FrontierAgent 提供 ReAct 和 Agent Team 两种模式。
Apodex 已完成 Apodex 1.1 模型家族的发布,完整模型已用于官方在线工作台,35B 的 Apodex 1.1 mini 则开放权重并支持本地部署。官方表示,完整模型可在专业工作、科研、金融分析和深度搜索等复杂任务中提供前沿 Agentic 表现。配套开源的 FrontierAgent 是可本地部署的研究工作台,包含 ReAct 与 Agent Team 两种模式,可在 macOS 和 Linux 上通过一条命令运行,无需预装 Docker。裸模型 API 将陆续通过主要 API 平台推出;据其说明,模型权重、技术报告和开发者文档仍在推进中。
读原文 →
IBM 发布开源 Granite 4.2:面向企业 Agentic AI
模型发布
IBM 发布开源模型家族 Granite 4.2,提供 3B、8B、30B 三种参数规模,面向企业 Agentic AI 工作流,并配备 512K 上下文窗口与三种推理模式。
IBM 已发布面向企业 Agentic AI 工作流的开源模型家族 Granite 4.2,包含 3B、8B、30B 三种参数规模。根据官方模型卡,该系列提供完整思考、不思考和低努力三种模式,上下文窗口为 512K。语言模型采用 Apache 2.0 许可,据其说明可部署在云端、本地及边缘环境,并已上线 Hugging Face、Ollama 等平台。IBM 同步推出参数量为 470M 的 Granite Speech 5.0 Turbo CTC,以及该语音模型的非商用版本。
读原文 →
腾讯开源 WeMM-Embedding 多模态嵌入模型
模型发布
腾讯将微信视觉团队开发的 WeMM-Embedding 以开源方式发布,可统一编码文本、图像、视频、视觉文档及交错多模态输入;其 2B 模型在 256 维时保留 MMEB-v2 全维图像和视频表现的 98.7%。
腾讯已开源由微信视觉团队开发的 WeMM-Embedding 通用多模态嵌入模型家族,模型支持文本、图像、视频、视觉文档和交错多模态输入,目前不支持音频。其 embedding 取自最后一层 hidden state 中专用 <embedding> token 的位置,随后执行 L2 normalization。项目建议使用 transformers==5.2.0 进行推理和复现,据其说明,更新版本的预处理行为可能不同。SentenceTransformer 可直接载入本地路径或 Hugging Face model id,并通过 SentenceTransformer.encode() 处理文本、图像和视频;MRL 维度由 --dimension 选择,省略该参数则输出完整维度。
对于支持的维度 d,项目要求先截断完整 embedding,再次归一化。官方表示,2B 模型在 MMEB-v2 上使用 256 维时,图像和视频性能可保留全维版本的 98.7%。技术报告的 Table 1 汇总 78 个数据集,图像和视频任务采用 Hit@1,视觉文档任务采用 NDCG@5;Table 2 覆盖 190 项任务,其中 V3-All 包含 78 项 MMEB-v2、53 项文本、47 项 agent、11 项音频任务及 MCMR,不支持的任务按 0 分计。仓库提供基于 TIGER-AI-Lab/VLM2Vec pipeline 小幅修改的 MMEB-v3 评测代码,测试版本为 vLLM 0.27.0 和 SGLang 0.5.9;腾讯代码除另有说明外采用 Apache License 2.0,第三方组件沿用原许可证。
读原文 →
MiniMax发布H3生态集成索引仓库
模型发布
MiniMax 发布 H3 GitHub 集成索引仓库,追踪相关项目,覆盖 INT8、NVFP4、GGUF 与 8GB 显存限制下的量化指南,并收录推理加速、Agent 技能和 Apple Silicon 支持。
MiniMax 发布了名为“Awesome MiniMax H3 Integrations”的 GitHub 索引仓库,用于汇总和追踪围绕 H3 构建的项目。仓库中的量化指南涵盖 INT8、NVFP4 和 GGUF,并包含适配 8GB 显存限制的内容;推理加速部分收录加速 LoRA、Sol-Attn 等工具,开发者工具则包括原生 Agent 技能,以及支持 Apple Silicon 的 h3.c。官方表示,H3 生态系统正在快速发展。
读原文 →
苹果发布新款Mac mini与Mac Studio
行业动态
苹果为 Mac Studio 配置 M5 Max 或 M5 Ultra,最高提供 512GB unified memory,峰值 AI 计算性能为 M3 Ultra 的 4.3 倍。2026 年 9 月 22 日开售。
苹果宣布,搭载 M5 Max 和全新 M5 Ultra 的新款 Mac Studio 将于 2026 年 9 月 22 日开售。M5 Max 版本配备 18-core CPU 和最高 40-core GPU,GPU 每个核心内置 Neural Accelerators,并支持最高 128GB unified memory;M5 Ultra 版本则扩展至 36-core CPU、最高 80-core GPU 和最高 512GB unified memory。官方表示,M5 Ultra 的峰值 AI 计算性能最高为 M3 Ultra 的 4.3 倍、M1 Ultra 的 9.8 倍,内存带宽为 1.2TB/s,比上一代高 50%。
新款 Mac Studio 首次加入 Wi-Fi 7 和 Bluetooth 6,并提供 Thunderbolt 5。多台 Mac Studio 可借助 Thunderbolt 5 与 RDMA 组成集群;据官方说明,4 台 Mac Studio 的 AI inference 性能最高可达单机的 3 倍。软件方面,新的 Core AI framework 面向 Apple silicon 上 AI 模型的构建、运行和部署,可调用 unified memory、CPU、GPU 与 Neural Engine,并支持在本地部署完整规模的 LLM 和把自定义模型接入 app。Apple 的开源 MLX framework 则用于在 Mac 上运行、训练和 fine-tune 模型。
读原文 →
Anthropic 推出 500 万美元资助计划
行业动态
读原文 →
Stability AI 完成 7600 万美元 B 轮融资
行业动态
读原文 →
Claude Code 坚持 CLAUDE.md 引发争议
其他
读原文 →