Epoch 0
JA · EN
每日 AI 日报
2026-08-27
来源:橘鸦 AI 早报 · 19 条
智谱正式发布并开源 GLM-5.3-Flash
要闻
智谱已发布并以 MIT License 开源 GLM-5.3-Flash,权重已上线 HuggingFace。模型含 320B 总参数、18B 激活参数,支持文本、图片、视频输入和 1M 上下文。
GLM-5.3-Flash 已由智谱正式推出,模型权重可在 HuggingFace 获取,授权采用 MIT License。模型包含 320B 总参数和 18B 激活参数,原生接收文本、图片与视频输入,上下文长度为 1M。据其说明,该模型是首个混合稀疏注意力与线性注意力架构的开源前沿模型,并以流形约束超连接增强 scaling;IndexPool 把索引器的 4 个缓存向量压缩为 1 个,以降低 1M 上下文下的时延与内存开销。视觉能力被纳入 Coding 循环,可协同代码、浏览器和图形界面,支持前端开发、游戏构建、Blender 3D 场景以及 BUA、CUA 驱动的真实环境操作。思考模式不可关闭,thinking.type 仅支持 enabled。
发布前,智谱曾以 Ox Alpha 为代号在 OpenCode 和 OpenRouter 测试该模型。官方表示,GLM-5.3-Flash 在 Artificial Analysis Intelligence Index v4.1.1 中获得 57 分,并在六项 coding 和 agentic 基准中超过 GLM-5.2。智谱称,其首次以国产芯片集群承载大规模流量,Ox Alpha 测试期间的全部流量也由国产芯片提供算力;相较同一硬件上的初始基线,端到端服务性能提高 3 倍,硬件效率和单 token 成本达到主流英伟达 GPU 的相当水平。在 GLM Coding Plan 中,该模型的可用额度是 GLM-5.3 的 3 倍,用户额度已被重置。国内 API 原价为 GLM-5.3 的十分之一,并提供限时两周五折折扣。
读原文 →
阿里发布 Qwen3.8-Flash 模型
要闻
阿里千问发布 Qwen3.8-Flash,并开放 Qwen3.8-Flash-Next 权重。模型每 Token 激活 6B 参数,原生支持 262K 上下文,输入、输出每百万 Tokens 分别为 1 元和 3 元。
阿里千问已将 Qwen3.8-Flash 上线千问 AI 平台,并同步在 Hugging Face 和 ModelScope 发布开源版本 Qwen3.8-Flash-Next 的权重,后者被定位为 Qwen4 新架构的先导预览。模型主干包含 125B 参数,另有 51B N-gram Embedding,每 Token 激活 6B 参数;原生上下文长度为 262K,并可借助 YaRN 扩展至 1M。架构调整覆盖 Attention、Residual、Embedding 和 Optimization,分别引入 GDN+QSA 混合注意力、Gated Residual、N-gram Embedding 和 Muon Optimizer。官方表示,其训练成本约为 Qwen3.7-Plus 的 1/9,在编码、办公和多模态 Agent 任务上的表现更强。平台输入和输出每百万 Tokens 的价格分别为 1 元和 3 元。
读原文 →
OpenAI 称误路由 5.5-mini 问题已修复并致歉
要闻
OpenAI 工作人员 Adam Fry 表示,一项路由回归问题曾使约 3% 的 Pro 和 Thinking 请求被错误分配到 5.5-mini。该问题现已修复,他也就此致歉。
Adam Fry 在发文说明这次异常时称,OpenAI 已完成相关路由回归的修复,他并为此道歉。据其说明,系统此前会在非预期情况下,将约 3% 的 Pro 和 Thinking 请求发送至 5.5-mini。此前,多名用户报告称,他们在 Chat 模式中选择较高推理力度后,系统会在不作提示的情况下把请求切换到 GPT-5.5-mini。
读原文 →
Google 发布 Gemini 3.5 Transcribe 语音转文本模型
模型发布
开发者现可通过 Google 的服务使用 Gemini 3.5 Transcribe 语音转文本模型;官方称,其最终转写耗时较 Chirp 3 缩短 70%。
Google 已发布 Gemini 3.5 Transcribe,并通过 Google AI Studio 中的 Gemini API 和 Gemini Enterprise Agent Platform 向开发者提供。该模型面向 voice agents、实时字幕及通话后分析,可把原始音频直接转换为经过整理和格式化的文本。据官方说明,它支持实时语言切换、streaming transcription、多人说话者归属、词级时间戳、自定义词汇识别和口语赘词清理。
官方援引 Artificial Analysis 的测量称,最终转写耗时较 Chirp 3 缩短 70%;在覆盖主要语言和地区的 FLEURS benchmark 上,streaming mode 的 WER 为 5.50%,non-streaming use-cases 为 5.04%。据其说明,该模型还用于 Gboard、Antigravity、Gemini app、Chrome、Android 的 Rambler 和 macOS 版 Gemini app。Agora、Fishjam、LangChain、LiveKit、Pipecat、Vercel 与 Vision Agents 通过 Gemini Live API 提供相关开发和部署能力。
读原文 →
Antigravity CLI 上线语音模式,可与 agent 对话
开发生态
Antigravity CLI 的最新版本加入语音模式,用户运行 /voice 或按 F5 即可与 agent 语音对话;该功能由 Gemini 3.5 Transcribe 驱动,并支持通过 SSH 使用本地麦克风。
最新版本的 Antigravity CLI 现已支持用户直接与 agent 进行语音对话,入口为 /voice 命令和 F5 键。官方表示,CLI 语音模式与 Antigravity 界面的麦克风按钮均采用新的语音转文字模型 Gemini 3.5 Transcribe,智能转录会自动删除“嗯”“啊”等填充词。/voice 同时新增 mic-serve 子命令,用于经 SSH 连接调用本地麦克风。
读原文 →
Claude Code 现可自动起草反馈报告,用户批准后发送
开发生态
Claude Code 现可在运行失败、自查出错或用户指出问题时自动起草反馈报告,并在用户审阅、修改和批准后发送给 Anthropic。用户也可通过 /config 关闭或调整该功能。
Claude Code 现已上线自动反馈起草功能,报告只会在用户完成审阅、修改并批准后发送给 Anthropic。触发情形包括运行失败、Claude 发现自身出错,以及用户明确指出问题;生成后,用户可以先检查报告内容并作出修改,再决定是否批准发送。据 Anthropic 工作人员 Thariq 说明,该能力由新的 SendFeedback 工具实现,因此用户不再需要先执行 /feedback,再手动撰写报告。相关自动起草与发送行为也可通过 /config 关闭或调整。
读原文 →
Claude in Chrome 正式面向所有付费订阅方案开放
产品应用
Claude 官方已将 Claude in Chrome 正式开放给全部 Claude 付费方案,用户可让其在浏览器内跨标签页自主执行操作;每项操作执行前都会由 safety classifier 核验安全性及是否符合原始请求。
所有 Claude 付费订阅用户均可通过 Chrome Web Store 安装 Claude in Chrome;该工具已进入 generally available 阶段,并新增浏览器操作自动批准机制。它可基于用户现有登录状态查看页面、读取和输入文本、点击链接、跨页面导航及填写表单,也能跨标签页处理任务,并在 desktop、mobile 和 web apps 中延续对话。用户可在设置中关闭自动批准,改为逐项手动确认;不符合原始请求的操作将被阻止。
防护链路还包括扫描 tool results 的 probes;若检测到疑似 prompt injection,Claude 会收到警告,并在需要时向用户确认。官方表示,在当前采用专业 red-teamers 所提供更强攻击的评估中,未加额外防护时,到达模型的攻击对 Claude Opus 4.5 和 Claude Opus 5 的成功率分别为 17.6% 和 3.8%;启用 probes 与 safety classifier 后,对 Claude Sonnet 5、Claude Opus 5 和 Claude Mythos 5 均为 0%,对 Claude Fable 5 为 0.3%。据其说明,人工核验确认成功突破均属低严重度场景。Enterprise 管理员可在 Organization Settings 限制获批域名;处理本地文件或其他应用仍需 Claude desktop app,该工具不支持其他 Chromium 浏览器。
读原文 →
Claude 在 Cowork 中推出内置浏览器,未来一周内上线
产品应用
Claude Cowork 正在推出内置浏览器,并将在未来一周内覆盖桌面端所有付费订阅方案。它可在侧边面板中代用户导航网站、填写表单并完成整个任务,且无需另行安装。
Claude Cowork 正在分批推出内置浏览器,并将在未来一周内向桌面端所有付费订阅方案开放。任务涉及网站时,该浏览器会直接显示在 Cowork 的侧边面板中;据官方说明,Claude 可在其中完成页面导航、表单填写及整个任务的执行。该功能已集成于桌面应用,不要求用户额外安装浏览器,同时与用户自己的浏览器及其登录状态相互独立。
读原文 →
Grok Bot 向 SuperGrok 和 Cursor Pro 订阅用户开放并重置每周用量
产品应用
SuperGrok 和 Cursor Pro 的全部订阅用户现可使用 Grok Bot,所有用户的每周用量限制也已重置;Michael Truell 称,该产品增速超过他见过的任何产品。
Grok Bot 官方账号宣布,该服务现已向全部 SuperGrok 和 Cursor Pro 订阅用户开放,同时为所有用户重置每周用量限制。Michael Truell 表示,Grok Bot 的增长速度超过他见过的任何产品。据其说明,用户委派给 Grok Bot 的任务覆盖多个实际工作场景,包括运营小型电商、协调客户活动、测试生产软件,以及完成日常枯燥工作。
读原文 →
谷歌为 Gemini Live 推出重大生产力升级
产品应用
Google 开始为 Gemini Live 推出生产力升级,加入 Spark 多步任务、Daily Brief、语音管理 Gmail 和 Personal Intelligence;官方表示,63% 的用户会通过语音与 Gemini 交互。
Google 现已开始为 Gemini Live 推送一组语音生产力功能,包括 Spark 集成、Daily Brief、Gmail 收件箱操作和 Personal Intelligence。用户可用自然语言创建复杂的多步骤任务,由 Spark 在后台跨 Google Docs、Sheets、Drive 和网页执行,并在数天或数周内处理持续或定时工作;Daily Brief 则汇总 Gmail 与 Calendar 中当天的重要更新,以语音生成待办摘要。官方表示,63% 的用户会开口与 Gemini 交互。
在 Gmail 场景中,Gemini Live 可根据语音搜索、总结、加星、归档或删除邮件,也能回答是否有新邮件或特定来源的紧急邮件。Personal Intelligence 会结合过往对话,以及已连接的 Gmail、Photos、Search 和 YouTube 信息回答问题。连续对话中,Gemini Live 还可把从邮件提取活动邀请、创建家庭日历事件并加入驾驶时间等请求交给 Spark 后台处理。用户需先在 Gemini Personal Intelligence 设置中选择连接应用,再点击 Gemini app 内的 Live 图标开始使用。
读原文 →
OpenAI 推介 $visualize:可在 ChatGPT Work 和 Codex 中生成可视化图表
产品应用
OpenAI Developers 转发产品演示,介绍 ChatGPT Work 和 Codex 中的 $visualize 功能。据其说明,用户输入该指令即可把信息转换为可视化内容。
OpenAI Developers 通过转帖引用工作人员 Katia Gil Guzman 的演示,介绍了 ChatGPT Work 和 Codex 中的 $visualize 功能。该演示称,用户输入 $visualize 指令后,可将信息转换为可视化内容。相关展示同时覆盖 ChatGPT Work 与 Codex,说明中的核心操作均为调用同一条 $visualize 指令;原文没有提供具体上线日期,也未列出可生成的图表类型。
读原文 →
Manus 开放数据恢复,服务恢复正常稳定运行
产品应用
Manus 宣布已开放数据恢复功能,其服务目前已恢复正常并保持稳定运行。已备份数据的用户可自行选择恢复时间,官方未设置截止期限,受影响账户还将获得 Welcome Back Bonus。
Manus 现已启用数据恢复功能,并通过官方账号表示,其服务已经恢复正常且保持稳定运行。恢复操作面向此前已备份数据的用户,用户可以根据自己的时间安排自行发起,不需要在某个指定日期前完成;据其说明,数据恢复没有截止期限,任何方便的时间都可以操作。对于此次服务中受到影响的账户,Manus 还将提供名为 Welcome Back Bonus 的欢迎回归奖励。
读原文 →
OpenAI 公布 Hugging Face 入侵事件技术报告
技术与洞察
读原文 →
Anthropic 开放 Claude 聚合对话研究
技术与洞察
读原文 →
爆料称 Fable 5.1 或最快周四发布,已在网页版灰度
前瞻与传闻
读原文 →
月之暗面传与三云巨头洽 Kimi K3 分成
前瞻与传闻
读原文 →
MiniMax:M3 Pro 参数规模预计提升至约 3T
前瞻与传闻
读原文 →
报道称 Anthropic 与 Nscale 签署约 450 亿美元算力租用协议
前瞻与传闻
读原文 →
Altman 称 OpenAI 预计 2026 年底将拥有其可称为 AGI 的内部系统
前瞻与传闻
读原文 →