每日 AI 日报

2026-07-30

来源:橘鸦 AI 早报 · 19 条

2026-07-30
2026-08-04 2026-08-03 2026-08-02 2026-08-01 2026-07-31 2026-07-30 2026-07-29 2026-07-28 2026-07-27 2026-07-26

OpenAI 上线 GPT-5.6 Sol 效率改进并重置 Codex 用量限制

要闻

OpenAI 上线 GPT-5.6 Sol 效率改进并重置 Codex 用量限制

Codex 负责人 Tibo 于北京时间 7 月 29 日中午宣布,已为所有ChatGPT Work和Codex用户重置额度,并上线效率改进。针对Sol消耗额度过快的问题,此次改进优化了工具等待和网页搜索场景,预计典型使用时长延长约18%。与此同时,此前暂停的五小时限制即将恢复。值得注意的是,Tibo 随后又回复一名社区用户的请求,暗示将于当地时间 7 月 31 日再次执行用量重置。

Codex 负责人 Tibo 于北京时间 7 月 29 日中午宣布,已为所有ChatGPT Work和Codex用户重置额度,并上线效率改进。针对Sol消耗额度过快的问题。关于原因,Tibo说明了以下几点。GPT-5.6 Sol更愿意持续工作更长时间、发起更多工具调用,并协调跨工具和subagent的复杂工作流;在相同推理强度下比此前模型工作强度更大,High档位在Sol上消耗的token多于GPT-5.5上的High档位。编程式工具调用赋予Sol并行运行工具调用或在等待时继续工作的灵活性,但也导致每轮回复更多、缓存输入token更多、用量高于预期,这种情况在Sol等待工具调用完成或运行大量网页搜索时尤为明显。影响分布也不均匀:中位数用户实际认为Sol的token效率尚可,而一些处理更难任务的重度用户额度消耗快得多;团队在发布前过于关注平均和中位数用量,未充分考虑长尾情况。此次改进优化了工具等待和网页搜索场景,预计典型使用时长延长约18%。与此同时,此前暂停的五小时限制将于明日恢复。值得注意的是,Tibo 随后又回复一名社区用户的请求,暗示将于当地时间 7 月 31 日再次执行用量重置。

读原文 →

SpaceXAI 推出 Grok Voice Think Fast 2.0 语音模型

模型发布

SpaceXAI 推出 Grok Voice Think Fast 2.0 语音模型

SpaceXAI 推出新一代语音模型 Grok Voice Think Fast 2.0,官方称其在多项语音基准测试中得分显著提升。目前该模型已在 API 和 Voice Agent Builder 中可用。

SpaceXAI 发布新一代语音模型 Grok Voice Think Fast 2.0,重点改进了智能、转写准确率和会话能力。根据官方公布的数据,该模型在多项语音基准测试中得分显著提升,官方称其在嘈杂环境中的转写准确率表现优于专用语音转文本模型。该模型目前已在 API 和 Voice Agent Builder 中提供,定价为每分钟音频 0.08 美元。

读原文 →

Google DeepMind 发布音乐模型 Lyria 3.5

模型发布

Google DeepMind发布音乐生成模型Lyria 3.5并接入Google Flow Music平台。新版本提升了歌词质量与人声表现力,支持更复杂的旋律。

Google DeepMind 发布最新音乐生成模型 Lyria 3.5,目前该模型已正式接入 Google Flow Music 平台供用户使用。官方称,Lyria 3.5 带来了更丰富的编曲和复杂的旋律结构,生成更高质量的歌词,并显著提升了人声的表现力、情感细腻度与发音的自然度。在创作控制方面,新模型更好地遵循用户的创作指令,支持设定精确的 BPM 与控制时长,并允许导出完整歌曲的 stems。

读原文 →

SKT 发布 688B 参数开源大模型 A.X K2 及音频版本

模型发布

SKT 发布 688B 参数开源大模型 A.X K2 及音频版本

SKT发布了开源大语言模型A.X K2,总参数量688B,激活参数33B,采用原生FP8训练。同时推出A.X K2 ALM音频语言模型,其权重计划后续发布。

SKT发布了开源大语言模型A.X K2及其音频版本A.X K2 ALM。A.X K2采用MoE架构,总参数量达688B,激活参数量为33B,使用原生FP8精度进行训练,并支持最长256K上下文。官方称该模型在数学和韩语领域表现突出,并在IMO 2025测试中达到金牌门槛。目前,A.X K2的权重已在Hugging Face上以Apache-2.0协议开源。A.X K2 ALM音频模型基于冻结的A.X K2 Light骨干构建,目前尚未公开权重,官方称计划后续发布。

读原文 →

Cursor 官方宣布 Cursor 登陆 iPad

开发生态

Cursor 官方宣布 Cursor 登陆 iPad

Cursor 官方宣布 Cursor 已上线 iPad,具备 iPhone 版全部功能。iPhone 和 iPad 版同步新增 inbox 和完整 PR review 体验。

Cursor 官方宣布,Cursor 现已上线 iPad。iPad 版提供了与 iPhone 版相同的全部功能,并为用户提供了更多空间与 agents 进行协作。同时,iPhone 和 iPad 版均新增了用于保持条理的 inbox 功能,以及涵盖完整 PR 的 review 体验,该 review 体验支持查看评论、检查和批准。

读原文 →

支付宝升级AI支付开发者激励计划

开发生态

支付宝升级AI支付开发者激励计划

支付宝升级AI支付开发者激励计划,提供最高5660元Token专项补贴。即日起至8月21日,个人开发者集成指定收款产品即可参与。

支付宝宣布升级AI支付开发者激励计划,继续为AI开发者提供最高5660元的Token专项补贴,并进一步扩展激励享受范围与降低参与门槛。即日起至8月21日,个人开发者Vibe Coding时集成支付宝AI按量付费、AI网页应用收款或AI移动应用收款任一款收款产品,即可按累计有效交易用户数解锁分档激励。此外,个人开发者使用AI按量付费还能享受0费率优惠至2026年12月31日。

读原文 →

Qoder 开源 AI 编程 Agent 评估工具 Better Harness

开发生态

Qoder开源了AI编程Agent评估工具Better Harness。它从任务理解等五个维度审查Agent工作流,生成带证据的报告和修复建议。

Better Harness 是 QoderAI 开发的 AI 编程 Agent 工作流评估工具,目前已在 GitHub 上以 MIT 协议开源。该工具通过任务理解、受控执行、变更验证、可靠交付和学习捕获五个维度审查项目,生成带证据的报告并将发现转化为优先修复建议。Better Harness 支持 Claude Code、Codex Desktop、Codex CLI、Cursor 和 Qoder。

读原文 →

Perplexity 开源 Numbat:面向客户端终端的 Agent 安全检测与响应套件

开发生态

Perplexity 开源 Numbat:面向客户端终端的 Agent 安全检测与响应套件

Perplexity 开源了 Numbat,一个跨 Agent 框架的安全检测与响应层,支持安全团队实时监控 Agent 行为并在危险动作执行前拦截。

Perplexity 正式开源了 Numbat,一个面向客户端终端的 Agent 检测与响应安全套件。Numbat 跨桌面端、命令行、IDE 和网关 Agent 框架运行,通过集成 Agent 钩子子系统、会话产物和 OTLP 遥测数据,为安全团队提供实时监控、本地检测、执行前拦截和取证重建能力。Numbat 内置 52 条检测规则,覆盖 11 类行为,包括机密访问、数据外泄、权限提升和横向移动等多步骤序列检测。Perplexity 内部已使用 Numbat 保护工程师使用的 Claude Code、Codex、OpenCode 和 Pi 等编码 Agent。Numbat 目前在 Apache 2.0 许可下以单个 Go 二进制文件提供,支持 macOS、Linux 和 Windows。

读原文 →

OpenAI推出ChatGPT for Academic Researchers计划

产品应用

OpenAI推出ChatGPT for Academic Researchers计划,向科学家、数学家和工程师免费提供其前沿模型的使用权限。该计划首批面向一万名研究人员,预计到2027年扩展至十万人。

OpenAI宣布推出名为“ChatGPT for Academic Researchers”的计划,旨在为科学、数学和工程领域的研究人员提供免费访问其前沿模型的机会。根据官方信息,该计划首批将覆盖一万名研究人员,并计划在2027年将规模扩大至十万人,主要针对选定学术机构的用户。官方表示,此举旨在帮助研究人员处理高级问题、加速科学发现并提高生产力。

读原文 →

Google为macOS版Gemini应用推出全新自然语言语音功能

产品应用

Google为macOS版Gemini应用推出全新自然语言语音功能

macOS版Gemini上线全新语音功能。用户长按Fn键即可进行智能听写,开启设置后还能结合屏幕上下文执行复杂任务,目前正面向全球英语用户推出。

Google正式宣布Gemini for macOS应用上线全新自然语言语音交互能力,允许用户通过语音进行内容创建、编辑和总结。在桌面任意窗口长按Fn键即可使用默认的智能听写功能,应用会自动过滤语气词并捕捉中途纠正,将格式化文本直接输出至光标处。若用户在设置中手动开启Gemini推理能力,应用便能理解当前屏幕上的上下文,并根据语音指令执行提取与总结本地文件、重写文本以及生成和编辑图像等复杂任务。该功能目前已向全球所有Gemini for macOS应用用户推出,当前仅支持英语,后续将增加更多语言支持。

读原文 →

Replit 推出全新 Replit Design AI 设计工具

产品应用

Replit 推出全新 Replit Design AI 设计工具

Replit 推出 AI 设计工具 Replit Design,现已向所有用户开放。该套件内置 Ambient Intelligence,支持一键应用品牌系统。

Replit 官方发布了全新的 AI 设计创意套件 Replit Design,目前该工具已全面上线。Replit Design 内置名为 Ambient Intelligence 的功能,在设计的每一步为用户提供可一键采纳的建议版本,用户无需输入提示词或掌握专业设计语言。在模型支持上,用户可以自由选择多款模型,并对比不同模型的输出结果。此外,该套件直接整合了 Mobbin 拥有的超过 60 万个真实应用 UI 界面,用户无需单独注册 Mobbin 账号即可调用。

读原文 →

Hermes Agent 新增 Hey Hermes 语音唤醒词

产品应用

Hermes Agent 推出本地语音唤醒功能。用户说出唤醒词即可免手启动新会话。该功能检测全程在本地进行,默认关闭。

Hermes Agent 正式推出语音唤醒功能,允许用户通过说出特定短语来免手启动新的语音会话。该功能支持命令行界面(CLI)、TUI 界面以及桌面应用。为确保隐私,唤醒词的检测过程完全在本地设备上运行,在用户说出实际指令前不会有任何音频离开设备。该功能目前默认关闭,且仅限于具备本地麦克风的界面使用。

读原文 →

OpenAI称两项API设置使GPT-5.6基准得分提升三倍

技术与洞察

OpenAI称两项API设置使GPT-5.6基准得分提升三倍

OpenAI发文称,启用保留推理和压缩两项API设置,使GPT-5.6 Sol在ARC-AGI-3基准测试的得分提高三倍至38.3%,且输出Token减少6倍。

OpenAI官方博客说明,通过为GPT-5.6 Sol启用保留推理和压缩两项设置,其在ARC-AGI-3基准测试的表现大幅提升。根据官方数据,该模型在最高配置下的得分从原先的13.3%升至38.3%,提升约三倍,输出Token减少6倍。OpenAI指出,此前测试工具的丢弃推理和滚动截断机制导致了低分。官方建议API开发者使用其Responses API中的相同设置以最大化性能。

读原文 →

OpenAI称应用GPT-5.6 Sol优化自身运行:服务成本降20%

技术与洞察

OpenAI称应用GPT-5.6 Sol优化自身运行:服务成本降20%

OpenAI 发文介绍其应用GPT-5.6 Sol优化自身运行基础设施的过程,通过重写生产核心和改进推测解码,服务成本降低20%,token生成效率提升超15%。目前优化已用于推理堆栈和Agentic harness。

OpenAI发布了关于GPT-5.6模型家族的效率更新的文章。官方表示,他们已在Codex中应用旗舰模型GPT-5.6 Sol来优化自身的基础设施和性能。根据官方数据,通过使用Triton和Gluon语言重写生产核心,该模型使端到端服务成本降低了20%;通过改进推测解码,使token生成效率提升了15%以上。目前这些优化已应用于OpenAI的推理堆栈和由Codex及ChatGPT Work使用的Agentic harness中。

读原文 →

腾讯混元开源 AngelSpec 推测解码框架

技术与洞察

腾讯混元开源 AngelSpec 推测解码框架

腾讯混元团队开源了 AngelSpec 推测解码框架,支持训练与部署。官方称其在 Hy3-A21B 上可实现最高 2.4 倍的端到端加速。

腾讯混元团队宣布开源端到端推测解码框架 AngelSpec,并发布了 v0.1.0 版本。该框架基于 torch-native,支持 MTP 和 block-parallel 推测解码训练,统一了 DFly、DFlash 等 6 种草稿架构的训练管线。官方数据显示,在 Hy3-A21B 模型和并发级别 4 到 64 的测试中,DFly 架构相比自回归解码实现了 1.98 至 2.40 倍的端到端加速,吞吐量比 DFlash 高出 10.5% 到 11.8%。

读原文 →

MiniMax 与 Fireworks AI 联合开源 M3 稀疏注意力 GPU 内核

技术与洞察

MiniMax 与 Fireworks AI 联合开源 M3 稀疏注意力 GPU 内核

MiniMax 与 Fireworks AI 联合开源了两个面向 MiniMax M3 块稀疏注意力的 GPU 内核仓库。

MiniMax 与 Fireworks AI 将双方合作开发的 MiniMax M3 块稀疏注意力 GPU 内核代码开源,两个仓库现已公开。fw-ai/minimax-kernels 由 Fireworks AI 开发,基于 NVIDIA Blackwell(SM100)CuTe-DSL 实现 KV-outer 块稀疏注意力,采用 Apache 2.0 许可证。MiniMax-AI/MSA 的 fireworks-msa 分支在原有 MSA 内核基础上集成了 Fireworks 的 KV-outer 稀疏预填充后端,采用 MIT 许可证。

读原文 →

月之暗面完成35亿美元融资,投后估值达350亿美元

行业动态

据报道,月之暗面已完成35亿美元融资,投后估值达350亿美元。报道称,该公司正以500亿美元投前估值接触投资者,计划最快今年赴港上市。

据彭博社报道,月之暗面已完成35亿美元融资,远超原定10亿至20亿美元目标,投后估值达350亿美元。报道指出,本轮融资得益于月之暗面Kimi K3模型在硅谷引发的轰动效应。知情人士还表示,公司目前已开始接触潜在投资者,寻求以500亿美元投前估值进行新一轮融资,这将是其赴港上市前的最后一轮融资,IPO最快有望于今年完成。

读原文 →

AlphaFold 团队遭解散,近四分之一研究人员离开 Google DeepMind

行业动态

据报道,Google DeepMind解散了AlphaFold团队,近四分之一研究员离职,多数人转入Gemini项目或Isomorphic Labs。

据媒体报道,Google DeepMind 已经解散了负责蛋白质折叠的 AlphaFold 团队。在过去一年中,大多数原论文作者被重新分配到围绕 Gemini 大语言模型的项目,或者转入专注于药物发现的 Isomorphic Labs。Google DeepMind 研究副总裁 Pushmeet Kohli 证实实验室战略已发生演变,目前正转向开发能协助科学家的系统,并与 OpenAI 和 Anthropic 竞争构建前沿 AI 智能体。此外,近四分之一的原作者已完全离职,其中包括加入 Anthropic 的核心成员 John Jumper。

读原文 →

SpaceXAI起诉要求阻止限制AI"裸化"技术新法生效

行业动态

据报道,SpaceXAI在美国联邦法院起诉明尼苏达州总检察长,要求阻止限制AI"裸化"技术的新法生效。该公司认为法律范围过宽,未提供免责机制。将迫使其限制Grok Imagine功能。

据报道,SpaceXAI已在美国联邦法院起诉明尼苏达州总检察长基思·埃里森,要求阻止该州限制人工智能"裸化"技术(nudification technology)的新法律生效。该法律即众议院第1606号法案(H.F. 1606),定于2026年8月1日生效,禁止网站、应用等服务的所有者允许用户使用裸化功能,违规者每次行为最高面临50万美元民事罚款及私人诉讼责任。SpaceXAI表示不反对禁止色情深伪影像,但认为法律范围过宽,未为采取合理措施的平台提供免责机制,可能覆盖经过同意或具有表达价值的影像。公司称该法将迫使其限制Grok Imagine的图像生成和编辑功能,主张该法违反美国宪法第一修正案。

提示:内容由AI辅助创作,可能存在幻觉和错误。

读原文 →