每日 AI 日报

2026-09-07

来源:橘鸦 AI 早报 · 5 条

2026-09-07
2026-09-08 2026-09-07 2026-09-06 2026-09-05 2026-09-04 2026-09-03 2026-09-02 2026-09-01 2026-08-31 2026-08-30 2026-08-29 2026-08-28

OpenAI 称已达成自动化研究实习员目标

要闻

OpenAI 称已达成自动化研究实习员目标

OpenAI 称其 AI 系统已达到“自动化研究实习员”目标,可在人类指导下完成熟练研究人员需数日处理的明确任务;公司计划在 2028 年 3 月前开发出自动化 AI 研究员。

OpenAI 在博客《Research acceleration: The view inside OpenAI》中宣布完成“自动化研究实习员”阶段目标,并把自动化 AI 研究员的开发期限设为 2028 年 3 月前。据其说明,现有系统可在人类指导下处理边界明确的研究任务,而熟练研究人员完成同类工作通常需要数天。截至其披露的 8 月中旬,内部研究团队按 API 价格折算的编程 Agent 日均推理费用中位数超过 600 美元,第 90 百分位超过 7,000 美元;以每天 8 小时计算,Agent 总运行时长相当于人类总工时的 3.1 倍。该团队提交代码和执行实验的速度均有提高,8 月每名活跃实验人员的实验次数达到自 2025 年 1 月开始记录以来的最高值。

Agent 在日常研究中的职责已由编写代码延伸至技术排障和实验监控,官方表示任务成功率也在上升,但高层规划在其输出中仍只占极小比例。在 OpenAI 所述的此前 6 个月内,Agent 成功完成且预计需要人类投入 4–8 小时的任务中,超过一半至少发生过一次人工干预。OpenAI 同时表示,算力以及难以自动化的环节仍会限制研究,因此上述使用量和产出指标的增长不能直接等同于整体研究进度同比加快。

读原文 →

OpenAI 称思维链监控可靠性下降且需建立安全标准

要闻

OpenAI 称思维链监控可靠性下降且需建立安全标准

OpenAI 首席科学家 Jakub Pachocki 称,尽管 GPT‑6 Astra 的对齐表现优于 GPT‑5.6 Sol,思维链监控的可靠性仍在下降,并主张建立由外部机构监督执行的强制性安全标准。

OpenAI 首席科学家 Jakub Pachocki 在《An Alien Mind》中表示,OpenAI 正把研究重点转向递归自我改进和自动化对齐,并将继续研究对齐、监控与防御系统,必要时主动暂停进一步扩大模型规模。他认为,当前 AI 的进步速度很可能持续到递归自我改进阶段,届时 AI 将更多参与并推动自身研发;同时,目前没有实验室在对齐和监控方面取得足以在确保安全的前提下长期维持最高速度扩张的进展。

据 Pachocki 说明,GPT‑6 Astra 的对齐表现优于 GPT‑5.6 Sol,但评测显示思维链监控正变得更不可靠。原因包括模型推理与外部交互日益交织、模型更擅长操纵自身推理过程,以及无需显式推理即可完成更复杂的任务。他主张为后续研发制定具有强制约束力的安全标准,由第三方审计机构、政府或国际组织监督执行;在共同标准形成前,各实验室应主动放缓研发并加强国际协调,使人类持续参与 AI 的自我改进过程并保留未来决定权。

读原文 →

OpenAI Codex 完成 Astra 用量改进,质量保持不变

要闻

OpenAI Codex 完成 Astra 用量改进,质量保持不变

OpenAI Codex 负责人 Tibo 宣布,团队已改进 Astra;据其说法,使用 ChatGPT 账号登录的高级用户在长尾场景下,订阅用量消耗最低约为原来的四分之一,质量不变。

OpenAI Codex 团队已完成 Astra 的多项用量改进,适用于使用 ChatGPT 账号登录的高级用户,Codex 负责人 Tibo 已通过个人账号公布这一消息。据其说明,这些调整针对长尾场景,不会改变质量,订阅用量消耗最低可降至原来的约四分之一,对应最多 3 到 4 倍的节省;这一数字仅为长尾场景下的上限,并非所有使用情况都能达到。Tibo 此前还给出推理强度的校准建议:GPT-6 Astra 在 low 档的表现优于 GPT-5.6 Sol 在 high 档的表现,因此,原先以 high 强度使用 Sol 且对结果满意的用户可改用 Astra 的 low 或 medium 档。

读原文 →

黄仁勋透露 GPT-6 Astra 训练用约 10 万个以上 GB200 NVL72

行业动态

黄仁勋透露 GPT-6 Astra 训练用约 10 万个以上 GB200 NVL72

黄仁勋称,GPT-6 Astra 使用约 10 万个以上 NVIDIA Grace Blackwell NVLink72 完成训练;OpenAI 位于得州阿比林的 Stargate 数据中心还计划容纳最多约 40 万块先进 AI 芯片。

黄仁勋在社交平台发帖披露,GPT-6 Astra 的训练由大约 10 万个以上 NVIDIA Grace Blackwell NVLink72 支撑,OpenAI 接下来还将投入使用 40 万块 GPU。他以从 ChatGPT、o1 到 Astra 仅历时 4 年为由,宣称 AGI 已经到来,并向 OpenAI 团队表示祝贺。据其说明,这批后续算力对应 OpenAI 位于美国得克萨斯州阿比林的 Stargate 数据中心,该中心规划最多可容纳约 40 万块 NVIDIA 先进 AI 芯片。

读原文 →

研究团队提出“AI相关精神病”概念

技术与洞察

arXiv 编号 2608.23937v1 的页面标题称,研究团队提出了 AI 相关精神病概念;但所给原文未披露团队成员、概念定义、研究方法或结论,只介绍了 arXivLabs 的功能与合作原则。

arXiv 编号 2608.23937v1 的页面以“研究团队提出‘AI 相关精神病’概念”为题,但所给原文没有提供论文摘要、作者、发布日期、方法、样本、数据或结论,因此无法从原文确认该概念的定义及研究依据。页面中的文字仅说明,arXivLabs 是一个让协作者直接在 arXiv 网站开发和分享新功能的框架。官方表示,参与 arXivLabs 的个人与组织接受开放、社区、卓越和用户数据隐私等价值观,arXiv 仅与遵守这些价值观的合作方合作。页面还邀请有意为 arXiv 社区创造价值的项目进一步了解 arXivLabs。

读原文 →