Epoch 0
JA · EN
每日 AI 日报
2026-08-28
来源:橘鸦 AI 早报 · 22 条
Gemini Omni 1.1 Flash 上线:新增首尾帧控制与 4K 放大
要闻
Google 推出面向开发者的 Gemini Omni 1.1 Flash。官方表示,该版本支持场景续写、首尾帧控制及 1080p 或 4K 输出,360p 预览最多快 60%,成本为标准 720p 的三分之一。
Google 已推出 Gemini Omni 1.1 Flash,并表示该版本已可用于生产环境,开发者现可通过 Google AI Studio 中的 Gemini API 或 Gemini Enterprise Agent Platform 使用。据官方说明,新版本续写场景时最多可分析此前 10 秒的上下文,此前模型仅参考最后 1 秒;视频可按每次 10 秒延长,累计最长 40 秒。开发者还可指定镜头的起始帧和结束帧,由模型生成两个关键帧之间的连续视频,用于相机环绕、变焦过渡或无缝循环。360p 轻量预览相较标准 720p,按系统吞吐计算的生成速度最多提高 60%,成本为三分之一;成片可输出 1080p 或 4K。
读原文 →
Tibo称所有ChatGPT Work与Codex用户额度已重置
要闻
Codex 负责人 Tibo 表示,所有 ChatGPT Work 与 Codex 用户的用量额度均已重置,覆盖两项服务的全部用户;有用户同时要求取消此前的 5 小时使用限制。
Codex 负责人 Tibo 宣布,ChatGPT Work 和 Codex 的全部用户额度已完成重置,该次操作已经覆盖上述两项服务的所有用户。用户反馈则聚焦于此前存在的 5 小时使用限制:有用户表示,这一限制导致其无法在重置发生前消耗完剩余用量,因此希望平台移除该限制。Tibo 的公告确认的是额度重置已经完成,原文没有提到 5 小时限制是否会被取消,也没有提供相关调整时间。
读原文 →
OpenAI 推出 Luna Reserve 备用额度
要闻
OpenAI 向部分个人 ChatGPT Plus 和 Pro 账户开放 Luna Reserve。常规额度用尽后,它会提供独立计量且有上限的备用额度,仅可用于 GPT-5.6 Luna。
OpenAI 目前已在 Codex 和 ChatGPT Work 中为部分个人 ChatGPT Plus 和 Pro 账户引入 Luna Reserve 备用机制,该机制在账户的常规额度耗尽后提供额外使用额度。Luna Reserve 的额度与常规额度分开计算,并设有上限,且只能用于 GPT-5.6 Luna;它不会恢复已经耗尽的常规额度,也不会解锁更强的模型。该机制当前不面向 ChatGPT Business 与 Enterprise 工作区,也不适用于普通 Chat 和 API。
读原文 →
ChatGPT临时聊天更新:可调用记忆与插件,支持转为常规聊天
要闻
OpenAI 宣布为 ChatGPT 临时聊天增加控制选项,用户可在创建对话时启用个性化,调用现有记忆、自定义指令和插件,也可保存对话并将其转为遵循账户设置的常规聊天。
OpenAI 官方表示,ChatGPT 正在推出临时聊天控制功能,用户可在创建临时聊天时选择启用个性化或保存对话,保存后该对话会转换为遵循账户级别设置的常规聊天。启用个性化后,临时聊天可以调用账户中已有的记忆、自定义指令和插件,但不会在交互过程中生成新的记忆。个性化选项只能在创建临时聊天时设定,对话开始后无法更改。启用个性化的临时聊天在保存前不会显示在侧边栏和聊天历史中,执行保存操作后才会作为常规聊天出现。
读原文 →
OpenAI 联合 Anthropic 等呼吁加强网络防御
要闻
OpenAI 联合 Anthropic、AWS、Google、Microsoft 和 Oracle 等公司发起网络防御集体行动呼吁,提出 3 项原则,并要求前沿 AI 公司确保 Agentic 身份可追溯、可问责。
OpenAI、Anthropic、AWS、Google、Microsoft、Oracle 等公司共同发布了强化网络防御的行动倡议,OpenAI 表示,应对 AI 驱动网络攻击的行动窗口有限。倡议列出 3 项原则,包括承认当前安全措施不足、用具备网络能力的 AI 为防御者赋能,以及推动全球集体响应。据 OpenAI 说明,相关行动建议面向各类组织、网络安全公司、政府和前沿 AI 公司;其中,前沿 AI 公司应保证 Agentic 身份可追溯、可问责,并向资源不足的关键基础设施防御者提供模型访问权限和资金支持。
读原文 →
Anthropic 推出 Model Hardware Standard 研究预览版
要闻
Anthropic 向首批科研实验室和先进制造商开放 MHS 研究预览版。官方称,该规范使 AI Agent 可并行操作显微镜、液体处理器和机械臂,并将设备集成由数周或数月降至数小时或数分钟。
Anthropic 已将 Model Hardware Standard(MHS)的早期版本提供给科学、机器人、电子和制造领域的首批合作伙伴,用于测试 AI Agent 对物理设备的操作,并在开源前共同制定安全评估和最佳实践。MHS 最初由 Anthropic 与 HHMI Janelia Research Campus 合作开发,适用于任何带可编程接口的设备,且不绑定特定模型;Agent harness 可通过 Model Context Protocol 等标准协议接入。官方表示,它可让 Agent 并行控制显微镜、液体处理器和机械臂等设备,覆盖药物发现实验和量子计算机激光校准等任务,并将通常需要数周或数月的硬件集成压缩至数小时或数分钟。
MHS 以标准化 driver 统一不同设备接口,通过 read 和 write 等 primitives 读取或设置参数,并以统一格式发布设备信息,使设备和 Agent 无需定制 translator 即可跨网络发现和通信。用户可用自然语言 tags 补充重量、可测量项目、可调参数和安全限制等信息,driver 据此自动生成 reference file。设备可由 MCP、command line interface 和 code files(APIs)三种机制控制;Agent 能编排步骤、监控结果并实时调整参数,也可把长时或高速任务写入 code files。Anthropic 表示,测试中的 Claude 曾反复调整激光并通过相机观察结果,随后生成 deterministic script,以单条命令完成激光对准。
读原文 →
蚂蚁百灵发布金融增强模型 Ling-3.0-flash-Fin
模型发布
蚂蚁百灵发布金融增强模型 Ling-3.0-flash-Fin,总参数量为 124B、激活参数为 5.1B。模型已通过两个平台限时免费开放,权重计划在发布后的下一周开源。
蚂蚁百灵已发布金融增强模型 Ling-3.0-flash-Fin,原文未注明具体发布日期。该模型基于 Ling-3.0-flash 开发,总参数量为 124B,每次激活 5.1B 参数。官方表示,该模型在多项金融基准测试中表现突出,通用能力评分也有所提升。模型目前已上线 Vercel AI Gateway 和 OpenRouter,其中 Vercel AI Gateway 的免费期截至原文所称的 9 月 25 日,原文未注明年份;OpenRouter 提供一个月免费体验。官方还表示,模型权重计划在发布后的下一周开源。
读原文 →
fal 推出基于 MiniMax H3 的后训练模型 H3 Max
模型发布
fal 发布了基于 MiniMax H3 的后训练视频模型 H3 Max;官方称其不到 3 秒可生成 5 秒视频,吞吐量约为官方 H3 endpoint 的 35 倍,并在三项人工偏好评测中均排名第 1。
fal 现已通过其平台提供 H3 Max,这是一款由 fal Research 基于 open-weights MiniMax H3 开发、并由其 inference 团队优化的后训练视频模型。fal 表示,团队在 post-training 阶段加入新数据,重点改善 prompt adherence 与视觉质量,同时让模型开发和 inference stack 共同迭代;模型的训练与服务均使用 NVIDIA GB200 NVL72,单芯片性能最高可达此前所用上一代加速器的 2 倍。H3 Max 也使用 fal Serverless 训练。
fal 的质量评测以人工两两偏好比较为主,覆盖 overall quality、prompt understanding 和 aesthetics,并以带 95% confidence intervals 的 Bayesian Elo 汇总结果;参测的 12 款视频模型包括官方 MiniMax H3 endpoint、Gemini Omni Flash、Wan 3.0、Seedance 2.5、Kling 3 和 Veo 3.1。官方表示,H3 Max 在三个维度均排名第 1,对每个参测模型的多数两两比较获胜,Artificial Analysis 与 Design Arena 的独立榜单也将其排在第 1。据其说明,该模型生成 5 秒视频用时不到 3 秒,吞吐量约为官方 H3 endpoint 的 35 倍,平均比质量相当的模型快 15 倍。该模型可通过 Playground、fal Agent 和 API 使用,首周价格优惠 50%。
读原文 →
Midjourney V8.2图像编辑模型开启测试
模型发布
Midjourney 已向所有用户开放首个 V8.2 image edit model 测试,并更新主站与 alpha 站 UI。官方正征集异常案例和界面反馈,后续将快速连续迭代。
Midjourney 的首个 V8.2 image edit model 现已进入面向所有用户的测试阶段,midjourney.com 和 alpha.midjourney.com 的 UI 也已更新。官方表示,alpha 端将围绕该模型的界面重构持续开展实验,测试中预计会出现未按预期工作的边缘案例。用户遇到图像效果不佳时,可点击 lightbox 右侧的 sad face emoji,或在图像仍于 lightbox 中打开时提交对应的 jobid 或 URL;界面改进意见和模型边缘案例可发送至 #ideas-and-features,使用成果可在 #edit-showcase 交流或展示。据其说明,后续将快速连续推出更新,本轮测试将由更大范围的社区参与。
读原文 →
BreezeBlue 开源 Breeze TTS 2 语音模型
模型发布
BreezeBlue 发布面向实时交互的开放权重语音模型 Breeze TTS 2;官方称其在 Artificial Analysis TTS 排行榜的开放权重模型中位列第 1,并支持 24 kHz 流式 PCM 输出。
BreezeBlue 已推出用于实时交互的开放权重 text-to-speech 模型 Breeze TTS 2。官方表示,该模型在 Artificial Analysis TTS leaderboard 的开放权重模型中排名第 1,并超过 frontier proprietary systems。它可通过自然语言 instruction 在没有参考音频时设计声音,也可结合参考音频控制说话者的语气、情绪、语速和表达;使用 --cfg-scale 4 可加强 instruction-following。克隆说话者时,参考音频应为背景噪声尽可能少的清晰语音,并附带准确 transcript。
Breeze TTS 2 的 CLI 与单并发 streaming API 默认使用 PyTorch eager streaming,并跳过 graph warmup;API 返回单声道 24 kHz signed 16-bit little-endian PCM,--fast-all 可为全部推理阶段启用最佳配置,但会增加 cold-start 时间。默认 Docker image 面向 H100/Hopper(sm90),另有 A100 构建方式,所需模型组件均包含在 checkpoint 中。source code 采用 Apache License 2.0,模型权重、checkpoint、adapter、衍生模型和 self-hosted 输出另受 BreezeBlue Research and Non-Commercial License 约束;商业使用须获得 RESONIA, INC. 书面授权,联系邮箱为 contact@breeze.blue。
读原文 →
Cohere 发布文档解析模型 Parse 5
模型发布
Cohere 已正式上线文档解析模型 Cohere Parse 5,可处理文本、表格、表单和图像;官方称其 ParseBench 得分为 79.2,价格为每千页 1.50 美元。
Cohere 正式发布并上线 Cohere Parse 5,模型面向 RAG 系统构建和自动化文档处理,可从文档中识别文本、表格、表单与图像,并生成带有边界框的机器可读文档。官方表示,该模型在 ParseBench 评测中取得 79.2 分,成绩高于 Mistral OCR 4 等竞品。Cohere 将服务定价为每千页 1.50 美元;据其说明,这一价格相比前沿大模型最高便宜 95%。
读原文 →
全新Qoder发布:推编程与通用双模式及桌面端
开发生态
Qoder 发布全新 Agent 工作台及桌面应用,提供 Coding 与通用双模式,国际版和中国版现已开放下载。其全球用户已超过 600 万,系统可接入超过 40 个连接器和 70 余个插件。
Qoder 现已上线新一代 Agent 工作台和桌面端,并同步开放国际版与中国版下载。该产品以 Coding 能力为底座,包含编程模式和通用模式;官方表示,系统内置全球顶尖模型与 Auto 智能调度引擎,并使用 Harness 技术支持复杂的长链路自治任务。据其说明,平台可通过超过 40 个连接器和 70 余个插件接入工作系统,同时新增语音唤起和主动提醒功能。Qoder 的全球累计用户已超过 600 万,官方还同步推出专属 Credits、模型折扣等限时福利。
读原文 →
阿里云百炼下调 Qwen3.8-Flash 模型价格
开发生态
读原文 →
AISI 发布开源工具 optstop 以动态优化 LLM 评估算力
开发生态
读原文 →
Hugging Face 发布开源双足机器人 Microduck
产品应用
读原文 →
Google搜索AI Mode升级旅游规划功能
产品应用
读原文 →
Gemini Notebook支持导入已购Google Play电子书
产品应用
读原文 →
谷歌DeepMind试运行前沿AI模型双盲评估
技术与洞察
读原文 →
Anthropic推出科学家专属Claude订阅方案,提供一万免费席位
行业动态
读原文 →
消息称英伟达同意129亿美元收购Hugging Face
前瞻与传闻
读原文 →
消息称英伟达暂停与AI云服务商的收益分成交易
前瞻与传闻
读原文 →
Google 员工回应 Ox Alpha 暗示争议
其他
读原文 →