Epoch 0
JA · EN
每日 AI 日报
2026-09-04
来源:橘鸦 AI 早报 · 27 条
OpenAI 发布 GPT-6 Astra
要闻
OpenAI 发布 GPT-6 Astra,已向少量机构开放,未来几天将覆盖 ChatGPT 付费用户,并上线 OpenAI API 与 AWS。API 标准价为输入 10 美元/百万 token、输出 50 美元/百万 token。
OpenAI 已启动 GPT-6 Astra 的分批发布,首批访问对象为少量机构;未来几天,ChatGPT Plus、Pro、Business 和 Enterprise 用户也将获得访问权限,开发者可通过 gpt-6-astra 调用。官方称其覆盖电脑操作、网页浏览、软件工程、科研、网络安全及专业办公,并公布 FrontierMath Tier 4 约 98%、ARC-AGI-3 99.9%、ExploitBench 100%。在 OSWorld 2.0 延迟模拟中,Astra 得分 72.6%,每项任务约耗时 40 分钟;GPT-5.6 Sol 得分 65.7%,约耗时 75 分钟。配合更新后的 Codex,其 Mind2Web 任务完成速度为 Sol 的 1.9 倍。模型还可操作专业软件,处理表单、CRM、日历、研究、摘要、科学数据、图表、网站、前端测试及软件安装测试,并按既有模板、布局和文风处理文档、电子表格与演示文稿。
据 OpenAI 说明,Astra 是其首个达到 Preparedness Framework 网络安全“Critical”能力阈值的模型。无生产安全措施时,它在 ExploitBench 得分 100%,GPT-5.6 Sol 为 78.5%;在针对 2026 年 6 月至 8 月新漏洞的内部评测中,它发现并利用了 2 个此前未知的零日漏洞。OpenAI 表示,正式版本会拒绝更高级的漏洞利用 PoC 等请求,目前主要支持安全代码审查和补丁,高级防御能力将经 Daybreak 逐步开放。无生产安全措施的对齐评测中,GPT-5.6 Sol 有 48% 的情况超出授权目标,Astra 为 0%;Astra 也未在内部测试中尝试绕过 Codex Auto-review 的拒绝,但在被要求规避监控的测试中,其书面推理比 GPT-5.6 Sol 更难监控。Codex 中的跨上下文窗口笔记与历史搜索目前为实验性功能,计划未来几周默认启用。API 标准价为每百万输入 token 10 美元、输出 token 50 美元;Fast 模式速度最高约为标准处理的 2 倍,价格也是 2 倍。
读原文 →
OpenAI Astra 访问补偿政策:按天发放 banked reset
要闻
付费 ChatGPT 订阅用户将按 Astra 不可用天数获得补偿,每缺少 1 天访问权限即可获得 1 次 banked reset。Codex 负责人 Tibo 称该安排自发文之日起实施。
Codex 负责人 Tibo 宣布,针对 Astra 无法访问的补偿政策自公告发布之日起执行:付费 ChatGPT 订阅方案用户每有 1 天无法使用 Astra,就会获得 1 次 banked reset。该安排按无法使用的天数计算,补偿条件和数量一一对应,即 1 天对应 1 次 banked reset。据 Tibo 说明,团队正在全力推进 Astra 访问权限的提供,以便用户尽快获得访问。
读原文 →
英伟达宣布以约129亿美元收购Hugging Face
要闻
NVIDIA 已同意以 12,930,300,000 美元收购 Hugging Face。NVIDIA 官方表示,收购后平台仍将开放,开发者通过该平台构建或部署时无需使用 NVIDIA compute。
NVIDIA 宣布达成收购 Hugging Face 的协议,交易金额为 12,930,300,000 美元。NVIDIA 表示,Hugging Face 目前有超过 18,000,000 名开发者、研究人员和创作者,平台上共享超过 3,000,000 个模型、500,000 个数据集和 1,000,000 个应用。另有超过 200,000 家公司使用该平台发现、评估、定制和部署 AI。
据 NVIDIA 说明,收购后 Hugging Face 将继续面向整个 AI 生态保持开放,开发者仍可自行选择模型、framework、cloud、inference service provider 和 computing platform,通过该平台构建或部署时不必使用 NVIDIA compute。平台还将继续支持各类模型开发者提供的 open source 与 open weight 模型,以及 multi-cloud、multi-accelerator 的开发和部署。NVIDIA 表示,其基础设施、工程能力和全球覆盖可帮助改善平台可靠性、安全、模型评估、inference 与部署能力,同时保留现有开放生态。
读原文 →
智谱 GLM Coding Plan 推出夜间畅用活动
要闻
智谱表示,GLM Coding Plan付费用户可在2026年9月3日至9月20日每晚23:00至次日09:00使用GLM-5.3-Flash:ZCode额度消耗为0,套餐支持的其他Agent可用额度按标准规则×2。
智谱表示,GLM Coding Plan夜间畅用活动将于2026年9月3日至9月20日生效,覆盖所有付费套餐用户。据其说明,活动按北京时间(UTC+8)计算,每晚23:00开始,至次日09:00结束;用户进入指定时段后自动获得活动权益,无需手动开启。该活动仅适用于GLM-5.3-Flash:在ZCode中调用该模型时,套餐额度消耗为0;在套餐支持的其他Agent中调用时,可用额度在标准规则基础上×2。若用户在该时段选择GLM-5.3,额度仍按套餐标准规则消耗。
读原文 →
Qoder 国际版宣布 Efficient 模型层级即日起对所有订阅用户免费
要闻
Qoder 宣布,国际版 Efficient 模型层级即日起向所有付费订阅用户免费开放,积分消耗由 0.3 倍降至 0 倍。更新客户端后,用户可直接选择该层级使用,无需另行注册。
Qoder 即日起将国际版 Efficient 模型层级面向所有 Qoder 付费订阅用户设为免费,积分消耗标准从原来的 0.3 倍调整为 0 倍。用户需要先更新 Qoder,再从模型选择器中选取 Efficient;完成上述操作后,无需额外注册,即可在日常代码生成、测试、问答以及重复性编辑等场景中以零积分使用该模型层级。该消息由 Qoder 通过官方账号发布。
读原文 →
阿里Qoder上线眼镜版,首批接入千问AI眼镜和乐奇AI眼镜
开发生态
阿里 Qoder 已推出眼镜版,首批接入千问 AI 眼镜和乐奇 AI 眼镜,并通过全双工语音与摄像头支持无需打开手机或触屏的任务交互。千问 AI 眼镜版已开启定向邀测,完整功能将在 2026 云栖大会发布。
阿里 Qoder 已上线 Qoder 眼镜版,首批适配千问 AI 眼镜和乐奇 AI 眼镜;千问 AI 眼镜版现已开启定向邀测,完整功能将在 2026 云栖大会正式发布。据其说明,眼镜版集成全双工语音方案,用户不打开手机或触碰屏幕即可布置任务、查询进度和补充要求。高风险操作或任务关键节点会以卡片显示在视野边角,用户可通过语音确认或轻触镜腿完成审批;摄像头可采集第一视角画面,由 Qoder 识别代码报错、设备状态、白板草图和屏幕信息。桌面端、移动端和眼镜版将分别承担深度执行、随身掌控和第一视角感知,并保持协同。
读原文 →
Responses API 新功能:异步函数调用、中途转向与缓存保留
开发生态
OpenAI 员工 Nikunj Handa 宣布,Responses API 随 GPT-6 Astra 增加 3 项功能:模型在工具运行时继续执行、推理中途改向,以及调整 reasoning effort 后保留缓存。
OpenAI 员工 Nikunj Handa 宣布,Responses API 随 GPT-6 Astra 推出时加入 3 项功能。按其说明,async function calling 让模型在工具运行期间继续执行;mid-turn steering 可在模型推理过程中注入消息以改变方向,其中包括向异步函数调用注入工具输出;更改 reasoning effort 则不再破坏缓存。
读原文 →
Varun Mohan:Antigravity 的 Gemini 配额正在重置
开发生态
Antigravity 工作人员 Varun Mohan 表示,平台已重置 Gemini 配额;他称 3.8 Flash 的使用量让 TPU“正在融化”,但仍希望用户继续构建。
Antigravity 工作人员 Varun Mohan 已重置平台上的 Gemini 配额,并在 X 发帖公布这一变更。此次处理对象是 Antigravity 中的 Gemini 使用额度,帖子没有给出重置后的具体额度,也未说明该配额后续将按何种周期计算。据 Mohan 说明,3.8 Flash 的使用量已让 TPU“正在融化”;他在提及这一运行压力的同时,仍表示希望大家继续构建。
读原文 →
Google 推出 WeatherNext 3 气象模型
模型发布
Google 发布 WeatherNext 3,利用实时卫星数据每小时生成预报,关键地表变量分辨率最高为 5 公里;模型现已接入 Search、Gemini、Maps、Google Maps Platform 和 Cloud。
Google DeepMind 与 Google Research 已推出 WeatherNext 3,并已将其预报能力接入 Search、Gemini、Maps、Google Maps Platform 和 Cloud。该模型每小时生成一次全球预报,可将温度、湿度等关键地表变量细化至 5 公里,其他地表变量至 10 公里,风速等大气变量至 25 公里;WeatherNext 2 则以 25 公里网格、每 6 小时输出一次预报。据其说明,Brightband 的独立实时评估将 WeatherNext 3 评为其迄今最先进且最准确的全球气象模型。
WeatherNext 3 将每小时更新的全球地球同步卫星拼接数据与传统历史分析一并输入 Functional Generative Network (FGN) mesh transformer,并直接利用稀疏气象站观测进行训练,以生成网格化场、离散气旋路径和站点级坐标预报。官方表示,传统 NWP 模型依赖超级计算机物理模拟并存在 6 小时数据延迟,而新模型可依据最新卫星观测提供最高 5 公里分辨率的局地预报,并改善降水等快速变化变量的预测。模型还新增面向清洁能源的变量,包括用于估算风电产出的 100 米高度风速。
读原文 →
蚂蚁百灵开源金融增强模型 Ling-3.0-flash-Fin
模型发布
蚂蚁集团 Ant Ling 团队开源 124B 总参数金融模型 Ling-3.0-flash-Fin 及含 123 个任务的 Agent 基准 FinFIRST,模型权重已在 Hugging Face 开放。
蚂蚁集团 Ant Ling 团队已开源金融增强模型 Ling-3.0-flash-Fin 与金融搜索 Agent 基准 FinFIRST,模型权重已在 Hugging Face 开放。Ling-3.0-flash-Fin 是 Ant Ling 家族首个金融增强模型,采用 124B 总参数、5.1B 激活参数的 MoE 架构;据其说明,该模型由 Ling-3.0-flash 在高质量金融数据上继续训练而来,面向长周期 Agent 工作流。FinFIRST V1 由蚂蚁集团在中金公司(CICC)投资银行团队的专业支持下构建,包含 123 个由专家编写的任务、701 条原子标准和 12300 个评分点。
读原文 →
Microsoft 发布 MAI-Transcribe-2 语音转文字模型
模型发布
微软发布 MAI-Transcribe-2,并开放三种渠道试用。官方称其在 60 种语言的 FLEURS 测试中平均 WER 为 5.2%,限时价格为每小时 0.10 美元。
Microsoft 发布了语音转文字模型 MAI-Transcribe-2,并在发布时即通过 Microsoft Foundry、MAI Playground 和 Open Router 提供演示。该模型支持 diarization、可配置的转录风格和词级时间戳,面向临床记录、法律文档、无障碍和 closed captioning 等场景。据 Microsoft 说明,MAI-Transcribe-2 在覆盖 60 种语言的 FLEURS benchmark 上平均 Word-Error-Rate 为 5.2%,位列第一;在 Artificial Analysis 的 accuracy-latency Pareto frontier 上居首,在其 Word-Error-Rate leaderboard 上排名第二。基于 Artificial Analysis 的 evals,官方称其速度分别是 GPT-Transcribe 的 10 倍、Scribe v2 的 7 倍和 Gemini 3.5 Transcribe 的 5 倍,且准确率更高。发布时的限时价格为每小时 0.10 美元,优惠持续至发布当年年底。
读原文 →
Qwen 团队开源自动驾驶视觉-语言基础模型 Qwen-Drive-1.0
模型发布
Qwen 团队以 Apache 2.0 许可开源 Qwen-Drive-1.0。官方称,该模型基于 Qwen3.5-4B,在不改 VLM 架构下统一 3D 感知、视觉问答与未来 5 秒运动规划。
Qwen 团队发布了自动驾驶视觉-语言基础模型 Qwen-Drive-1.0,并同步公开代码库与论文,采用 Apache 2.0 许可。其基座为原生多模态 Qwen3.5-4B,预训练 VLM 架构保持不变,能力通过两个外接模块扩展:BEV 感知头联合执行 3D 目标检测、语义 Occupancy 预测和 BEV 地图分割;基于流匹配的规划专家生成覆盖未来 5 秒的自车轨迹。据其说明,这是首个在预训练阶段统一 3D 感知与视觉问答、并进一步延伸至运动规划的此类模型。
读原文 →
IFM 发布开源模型家族 K2 Horizon,六款模型覆盖 0.9B 至 375B
模型发布
读原文 →
HUMAIN 发布阿拉伯语大模型 HUMAIN-M3
模型发布
读原文 →
腾讯WorkBuddy正式上线银河麒麟和统信UOS
产品应用
读原文 →
NVIDIA 发布 PAIR beta:把局域网设备组成私有 AI 推理集群
产品应用
读原文 →
Arena.ai 限时开放 Claude Fable 5.1 Direct Mode 测试
产品应用
读原文 →
ChatGPT Site 现已支持私密分享,可邀请特定人员访问
产品应用
读原文 →
Google 为 Gmail、Docs、Keep 推出三项 Gemini 语音对话功能
产品应用
读原文 →
SpaceXAI 上线 Grok Bot 企业版
产品应用
读原文 →
千问联合淘天开源 E-Commerce Bench
技术与洞察
读原文 →
Google等机构绘出成年雄性果蝇完整大脑与中枢神经系统连接组
技术与洞察
读原文 →
OpenAI 推出 Daybreak for Frontline Defenders
行业动态
读原文 →
多家 AI 服务同一时段中断
行业动态
读原文 →
Anthropic 公开 Claude Code 扩展提案 Function Hooks
前瞻与传闻
读原文 →
奥特曼首次明确表态:OpenAI将自研人形机器人
前瞻与传闻
读原文 →
据报道:Thinking Machines Lab 洽谈按 400 亿美元估值融资 10 亿美元
前瞻与传闻
读原文 →