每日 AI 日报

2026-08-20

来源:橘鸦 AI 早报 · 22 条

2026-08-20
2026-08-20 2026-08-19 2026-08-18 2026-08-17 2026-08-16 2026-08-15 2026-08-14 2026-08-13 2026-08-12 2026-08-11 2026-08-10 2026-08-09

Codex 团队称已上线多层防护,降低误删用户文件风险

开发生态

Codex 团队称已上线多层防护,降低误删用户文件风险

Codex 团队成员 Tibo 回顾称,已针对 GPT-5.6 误删用户文件风险上线多层防护。他建议保持Codex应用更新并使用沙箱模式。

Codex 团队成员 Tibo 回顾了过去几周上线的一系列改动,称其进一步降低了 Codex 在工作中执行潜在破坏性操作的风险。团队已为此加入多层防护:明确指示 Codex 在删除前检查目标、不复用系统环境变量,强化对高风险删除命令的执行检查并升级送审,提高 Full access 意外开启的难度并更新 Auto-review,同时构建针对性回放评估、增加强化学习任务并过滤训练数据中的破坏性操作。据其介绍,回放评估显示相关行为已大幅减少,同时 Codex 完成正常编码工作的能力得以保留。团队建议用户保持 Codex 应用更新,使用 Ask for approval 或 Approve for me 沙箱模式,仅在可信且可恢复的环境中使用 Full access。

读原文 →

OpenAI 称技术问题致部分用户 Daybreak Blue 访问失效,需重新验证

开发生态

OpenAI 称技术问题致部分用户 Daybreak Blue 访问失效,需重新验证

OpenAI 称技术问题导致部分用户 Daybreak Blue 访问失效,需重新验证。

OpenAI 开发者账号 OpenAIDevs 表示,一个技术问题导致部分用户的 Daybreak Blue 访问不再有效,需完成重新验证才能保留访问,受影响用户已收到含验证路径的邮件,团队待命协助,访问未中断的用户目前无需任何操作。

读原文 →

OpenCode Go 上线 Muse Spark 1.2 并为 Hy3 提供八倍用量

开发生态

OpenCode Go 上线 Muse Spark 1.2 并为 Hy3 提供八倍用量

OpenCode Go 上线 Muse Spark 1.2 Contributor 模型,该模型需授权数据训练且部分地区受限;同时 Hy3 提供 8 倍用量直至 8 月 30 日。

OpenCode Go 正式上线 Muse Spark 1.2 Contributor 模型,该模型因容量问题曾短暂下线后现已恢复。该模型需用户显式授权以用于数据训练,且在部分地区受限。官方称其提供极高额度。同时,OpenCode 宣布 Hy3 面向所有 Go 订阅者提供 8 倍正常用量至 8 月 30 日。

读原文 →

ZCode 新增 GLM Coding Plan 额度闲时重置权益,有用户称控制台发现重置卡

开发生态

ZCode 新增 GLM Coding Plan 额度闲时重置权益,有用户称控制台发现重置卡

智谱 ZCode 发布更新,更新日志提及 GLM Coding Plan 订阅用户在 ZCode 享有 5 小时额度到限后于算力闲时重置的权益。另有用户在智谱控制台发现重置卡,但也有多名用户跟帖表示未看到。重置卡相关信息未有官方说明。

智谱 ZCode 发布 v3.8.1 更新,根据更新日志,GLM Coding Plan 订阅用户在 ZCode 享有 5 小时额度到限后于算力闲时重置的权益。此外,社区用户在智谱控制台发现重置卡,但多名社区用户跟帖表示未看到。重置卡的具体发放范围和条件未见官方说明。

读原文 →

Google AI Studio Build 支持与 GitHub 双向同步

开发生态

Google AI Studio Build 支持与 GitHub 双向同步

Google AI Studio 官方宣布,Build 功能现已支持与 GitHub 双向同步,可从现有代码仓库推送和拉取改动。

Google AI Studio 官方宣布,AI Studio Build 现已支持与 GitHub 双向同步。开发者可以从现有仓库开始项目,在环境中推送和拉取改动,并在不同环境之间无缝协作。

读原文 →

Replit 上线 Free Mode,由 GPT-5.6 Luna 驱动

开发生态

Replit 上线 Free Mode,由 GPT-5.6 Luna 驱动

Replit 官方上线 Free Mode,由 OpenAI GPT-5.6 Luna 驱动。官方称订阅用户日常任务不再消耗额度,创造量最高提升 30 倍。

Replit 正式推出 Free Mode,这是使用 Replit Agent 的一种新模式,由 OpenAI GPT-5.6 Luna 提供支持,目前已上线 replit.com。官方称,Core 订阅用户每月支付 20 美元即可在 Free Mode 下创造最多 30 倍的内容,并获得每月最多 30 小时的聊天使用,日常任务不再消耗额度。Core 和 Pro 用户均可持续使用 Free Mode 直至达到用量上限,上限每 5 小时重置一次,Pro 用户拥有更高限额。

读原文 →

ClaudeDevs 宣布 Claude Managed Agents 三项更新上线

开发生态

ClaudeDevs 宣布 Claude Managed Agents 三项更新上线

ClaudeDevs 宣布,Claude Managed Agents 上线三项更新。更新涵盖沙箱记忆、搜索域名控制以及多 Agent 会话查看器改版。

Anthropic 旗下开发者账号 ClaudeDevs 宣布为 Claude Managed Agents 推出三项更新,目前均已上线。第一项更新让 Self-Hosted Sandbox 中完成的任何工作都可以保存到记忆;第二项为 web_search 和 web_fetch 增加 allowed_domains 与 blocked_domains 参数,用于控制 Agent 允许搜索和读取的内容;第三项重新设计了 Console 的多 Agent 会话查看器。新功能现已在 platform.claude.com 上提供。

读原文 →

小红书 dots studio 宣布 dots3-note preview 模型 API 限时免费

模型发布

小红书 dots studio 宣布 dots3-note preview 模型 API 限时免费

小红书 dots studio 宣布上线 dots3-note preview 模型 API。用户登录 dots.ai 开放平台注册后可限时免费调用。

小红书 dots studio 宣布上线 dots3-note preview 模型 API。用户登录 dots.ai 开放平台注册 API 后,可限时免费调用 dots3-note preview 模型。官方未说明免费的具体期限,也没有公布调用频率或数量限制。

读原文 →

Unsloth 发布 Qwen3.8-27B Dynamic v3.0 量化

模型发布

Unsloth 发布 Qwen3.8-27B Dynamic v3.0 量化

Unsloth 发布 Qwen3.8-27B Dynamic v3.0 量化GGUF,同步推出的 1-bit 量化可在 8GB 内存运行。

Unsloth 发布了采用 Dynamic v3.0 量化方法的 Qwen3.8-27B GGUF 量化文件,兼容 llama.cpp 和 Unsloth Desktop 等多数推理引擎。官方称新量化在同等体积下 top-1% 准确率比其他所有提供方高出超过 10%,并在 Divergence-300 与 KL Divergence 等基准上领先。另发布的 1-bit 量化可在 8GB 内存运行,Unsloth 团队成员 Daniel Han 表示其相对 BF16 保留约 77% 准确率。

读原文 →

蚂蚁百灵开源 Ling-3.0-tiny 与 Ling-3.0-flash 共 6 个 Base Model 检查点

模型发布

蚂蚁百灵开源 Ling-3.0-tiny 与 Ling-3.0-flash 共 6 个 Base Model 检查点

蚂蚁百灵宣布开源 Ling-3.0-tiny 与 Ling-3.0-flash 共 6 个 Base Model 检查点,覆盖预训练、中期训练和 WSM 合并三个阶段。

Ant Ling 宣布开源 Ling-3.0-tiny 与 Ling-3.0-flash 两款模型的 6 个 Base Model 检查点,覆盖预训练、中期训练与 WSM 合并三个阶段,全部未经过后训练。官方表示这批检查点可作为持续预训练、微调与研究的灵活起点,已完成对话后训练的版本另有 Ling-3.0-tiny 与 Ling-3.0-flash。

读原文 →

Liquid AI 发布 LFM2.5 四款模型 QAD Q4_0 检查点

模型发布

Liquid AI 发布 LFM2.5 四款模型 QAD Q4_0 检查点

Liquid AI 发布 LFM2.5 通过量化感知蒸馏训练的四款模型的量化检查点。

Liquid AI 发布通过量化感知蒸馏训练的 QAD Q4_0 GGUF 检查点,覆盖 LFM2.5-230M、LFM2.5-350M、LFM2.5-1.2B-Instruct 和 LFM2.5-2.6B 四款模型。官方称这些检查点保持原生 Q4_0 的低内存占用与高吞吐,恢复了约 97% 因量化损失的 BF16 平均精度。

读原文 →

Ornith 开源发布 Ornith-1.5 模型系列

模型发布

Ornith 开源发布 Ornith-1.5 模型系列

Ornith 开源发布 Ornith-1.5 模型系列,覆盖 9B 至 397B 三档规模。官方称 397B 版在相关基准上与 Opus 4.8 表现相当。

Ornith 正式发布开源模型家族 Ornith-1.5,包含 397B MoE、35B MoE 与 9B dense 三种规模,全部模型及 FP8、GGUF、MLX、NVFP4 量化版本均以 MIT 许可证发布。该系列把 Ornith-1.0 引入的 self-scaffolding 框架扩展为端到端自我改进循环,由模型自行提出新任务、生成任务专属脚手架并产出解题 rollout 用于强化学习。

读原文 →

谷歌学生优惠上线:Google AI Pro 或 Plus 免费用一年

产品应用

谷歌学生优惠上线:Google AI Pro 或 Plus 免费用一年

谷歌即日起为符合条件的大学生免费提供一年 Google AI 订阅,美国学生可领取 Google AI Pro,美国以外特定的 140 多个国家和地区的学生可领取 Google AI Plus。Gemini 应用同步上线学生中心,可使用各类学习工具

谷歌宣布即日起为符合条件的大学生免费提供一年 Google AI 订阅,美国学生可领取 Google AI Pro,美国以外 140 多个国家和地区的学生可领取 Google AI Plus,优惠持续至 2026 年 12 月 31 日。Gemini 应用同日新增学生中心,官方称这是专为学生打造的入口,用户可以在这里创建学习笔记本、制作闪卡、进行练习测验,后续新增的学习工具也将集中在该中心。

读原文 →

Google 为 Search 推出多项 AI 学习工具

产品应用

Google 为 Search 推出多项 AI 学习工具

Google 为 Search 推出多项 AI 学习工具,交互可视化已在全球英语版 AI Mode 上线并开始进入 AI Overviews,练习测验等功能同步免费开放。

Google 宣布为 Search 引入一批配合开学季的 AI 学习工具。生成式交互可视化能力已在全球英语版 AI Mode 上线,并已开始在 AI Overviews 中推出;练习测验已在全球英语版免费开放,覆盖 ACT、AP、GRE、SAT 等标准化考试。AI Mode 中的笔记本将在未来几天向超过 180 个国家的英语用户推出,Lens 交互学习体验也将在未来几周以英语版面向全球推出。自定义文件生成已在 AI Mode 全球英语版上线,初期支持文档、幻灯片、表格和文本文件等格式,后续将进入 AI Overviews。

读原文 →

MiniMax 发布 MiniMax Design 创作工具

产品应用

MiniMax 发布 MiniMax Design 创作工具

MiniMax 发布 MiniMax Design,把多模态模型能力变成可用的生产力。这款 Harness 围绕多模态视频模型 H3 构建,可完成从素材处理到成片交付的完整流程。

MiniMax 官方发布 MiniMax Design,一款围绕原生多模态视频模型 H3 构建的创作工具,定位是把多模态模型能力变成真实可用的生产力。官方介绍,它擅长目标明确、涉及多个制作环节且需要持续生成和修改的商业内容任务,例如品牌广告素材批量迭代、知识类视频制作以及 PV、MV、电影片头等创意短片。产品还提供 Agent 3D 导演台用于分镜阶段构图,支持自动剪辑和字幕添加,并接入 H3 开源生态,兼容 ComfyUI 原有本地部署和工作流。MiniMax Design 目前已开放下载,可从官网获取。

读原文 →

Meta 推出 Mac 版 Meta AI 应用测试版

产品应用

Meta 推出 Mac 版 Meta AI 应用测试版

据报道,Meta 推出 Mac 版 Meta AI 应用测试版,支持窗口共享和跨应用听写。应用免费使用,但与 Meta AI 的互动数据将用于训练模型。

据报道,Meta 推出了面向企业和内容创作者的 Mac 版 Meta AI 应用,目前以测试版形式提供,报道称其已在部分地区正式发布。Meta AI 可免费使用,Meta One 订阅方案可提高使用频率限制,但隐私政策指出,与 Meta AI 功能的互动将被用于训练其模型。

读原文 →

OpenAI 将于下周把 ChatGPT Ads 扩展至 31 个欧洲市场

产品应用

OpenAI 将于下周把 ChatGPT Ads 扩展至 31 个欧洲市场

OpenAI 宣布 ChatGPT的广告下周起将扩展至 31 个欧洲市场。

OpenAI 宣布 ChatGPT Ads 将于下周扩展至 31 个欧洲市场,包括德国、法国、西班牙、意大利等。广告仅向 Free 和 Go 订阅方案用户展示,Plus、Pro 和 Enterprise 订阅方案保持无广告。此前 OpenAI 已在美国以试点方式开始测试广告,并在过去六个月内扩展至另外八个市场。OpenAI 表示,广告用于支持免费和低价使用 ChatGPT,广告与回答明确标注区分,且不影响 ChatGPT 给出的回答。

读原文 →

OpenAI 宣布继续提供 Zero Data Retention,并将推出新安全机制

行业动态

OpenAI 宣布继续提供 Zero Data Retention,并将推出新安全机制

OpenAI 宣布将继续为符合条件的 API 客户提供 Zero Data Retention,并介绍新安全机制 Private Safety Processing。该机制能在不向 OpenAI 人员暴露客户内容的前提下,跨相关交互识别风险。

OpenAI 宣布将继续为符合条件的 API 客户提供前沿模型的 Zero Data Retention(ZDR),并介绍新的安全机制 Private Safety Processing。官方称,现有 ZDR 兼容安全系统只能逐条评估交互,新机制让自动化系统能跨相关交互识别滥用模式,只返回有限的安全信号,底层提示词和响应不会暴露给 OpenAI 人员。ZDR 部署中客户内容保留在客户控制的基础设施上,OpenAI 还在开发内容存于 OpenAI 基础设施、由客户控制密钥加密的选项。部分功能目前正与早期客户测试,官方计划 9 月开始推出并发布技术白皮书。

读原文 →

Stripe 宣布签署协议收购 OpenRouter

行业动态

Stripe 宣布签署协议收购 OpenRouter

Stripe 宣布已签署协议,收购 AI 模型网关与路由平台 OpenRouter。OpenRouter 方面表示,其名称、产品与路线图都将保持不变,继续照常运营。

Stripe 官方宣布,已签署协议收购 AI 模型网关与路由平台 OpenRouter。OpenRouter 联合创始人兼 CEO Alex Atallah 表示,OpenRouter 将照常运营,名称、产品、路线图和使命都不变,只是推进更快。Stripe 称,双方将共同帮助企业在 AI 时代同时管理收入与成本两端,通过智能路由请求和高效使用 token 提升盈利能力。

读原文 →

报道称 Anthropic 二季度收入首次超过 OpenAI

行业动态

报道称 Anthropic 二季度收入首次超过 OpenAI

据《华尔街日报》报道,Anthropic 二季度收入首次超过 OpenAI。当季两者收入分别为 116 亿美元和 67 亿美元。

据《华尔街日报》报道,Anthropic 首次在单季收入上超过 OpenAI:截至六月的第二季度,Anthropic 收入达 116 亿美元并实现小额营业利润,收入较第一季度翻倍;OpenAI 收入为 67 亿美元,环比增长 18%,但营业利润率进一步下滑,在预期中的 IPO 之前仍未盈利。

读原文 →

报道称字节 Seed 基础模型成立四个一级部门

行业动态

据晚点报道,字节跳动大模型部门 Seed 已完成新一轮组织调整,新设四个一级部门,调整意在集中资源、减少团队重叠。

据晚点报道,字节跳动大模型部门 Seed 已于近期完成新一轮组织调整,Seed 基础模型成立四个新的一级部门。四个部门负责人均向吴永辉汇报,Seed 还为 AI 安全及前沿探索方向分别任命了负责人。报道称,此次调整意在合并相似工作、减少团队重叠,背景是字节此前讨论训练参数规模超过 5 万亿的模型,并希望下一代模型直接走向全模态。

读原文 →

唐杰:Scaling 不止参数一个旋钮,GLM-5.3 是后训练对照实验

技术与洞察

唐杰:Scaling 不止参数一个旋钮,GLM-5.3 是后训练对照实验

智谱创始人唐杰发文阐述 Scaling Law,强调参数量需与数据、算力一同衡量。文中介绍 GLM-5.3 作为后训练对照实验,验证了后训练扩展的价值。

智谱创始人唐杰发文阐述对 Scaling Law 的看法,称参数量只有结合数据量、算力投入方向和运行条件才有意义,并在帖中介绍 GLM-5.3,称其为验证后训练扩展价值的对照实验。据其表述,GLM-5.3 与 GLM-5.2 采用相同基座、相同架构、相同的总参数量和激活参数量,仅经过一个月的长程环境与强化学习扩展,提升并非边际性。帖子回顾了参数与数据配比研究的多次修正,并称总参数量在达到足以容纳知识的阈值后,能力增长主要来自有效深度与后训练。唐杰表示基座规模、预训练数据和每次前向传播的算力投入仍在后续计划中,下次可能是 mid-training、pre-training。

提示:内容由AI辅助创作,可能存在幻觉和错误。

读原文 →