每日 AI 日报

2026-08-04

来源:橘鸦 AI 早报 · 16 条

2026-08-04
2026-08-04 2026-08-03 2026-08-02 2026-08-01 2026-07-31 2026-07-30 2026-07-29 2026-07-28 2026-07-27 2026-07-26

阿里千问发布 Qwen3.8-Max 正式版并计划下周开源模型权重

要闻

阿里千问发布 Qwen3.8-Max 正式版并计划下周开源模型权重

阿里千问发布Qwen3.8-Max模型正式版。该模型基于 Qwen 3.5 的架构基础构建,总参数达2.4T,激活参数95B。目前已在官方API平台和Token Plan、Qwen Studio、Qoder系列等产品上线。官方称该模型在编程、办公、长周期任务及多模态智能体等方面实现了全面提升。根据官方测试,该模型能够独立完成长达约 16 天的长程自动编程。该模型权重将于下周公开,Qwen3.8-27B 模型也将开放权重。

阿里今日发布 Qwen3.8-Max 模型,已上线千问 AI 平台 API 服务及 Token Plan、Qoder 系列等产品。该模型基于 Qwen 3.5 架构构建,总参数 2.4 万亿,激活参数 95B,支持 100 万上下文。定价方面,国内每百万 Tokens 输入 12 元、输出 36 元;海外分别为 2 美元、6 美元。

官方称该模型在编程、办公、长周期任务及多模态智能体等方面实现全面提升。据官方测试,其能独立完成长达约 16 天的长程自动编程。据 Arena.ai 榜单数据,该模型视觉与编程能力分列第二和第四。

官方宣布该模型权重将于下周公开,这也是 Qwen 首个 Max 规模的开源权重模型,Qwen3.8-27B 模型也将开放权重。模型兼容 OpenAI 与 Anthropic 接口,支持集成至主流智能体框架。

读原文 →

MiniMax-H3正式发布权重,ComfyUI原生支持

要闻

MiniMax-H3正式发布权重,ComfyUI原生支持

MiniMax正式开源全模态生成系统 MiniMax-H3。此次发布的模型权重包括H3-Base的FL2VA和 Ref2VA两个checkpoint。相关权重已获ComfyUI原生支持。其许可证禁止在美国和欧盟等国家和地区使用。

MiniMax正式开源全模态生成系统MiniMax-H3,在HuggingFace发布模型权重,支持文本、图像、音频与视频的统一理解,可生成最高2K分辨率、15秒时长、24FPS、32kHz立体声视频。本次开放的模型权重主要为 H3-Base-FL2VA 和 H3-Base-Ref2VA 两个任务专用 checkpoint。H3-Context-IR 与 H3-Regenerate-2K 的官方实现暂未开源,目前可通过官方 API 接入;其中 H3-Context-IR 还提供了自建替代处理流程的指导。ComfyUI在权重发布当日即原生支持。许可证禁止美国、欧盟、英国、韩国使用,MiniMax员工RyanLee称美国限制源于与好莱坞制片公司的生成式视频版权诉讼,美国用户可提交正式授权申请。

读原文 →

Qoder一周年:Qwen3.8-Max全端上线,新老用户可领免费调用

开发生态

Qoder一周年:Qwen3.8-Max全端上线,新老用户可领免费调用

Qoder 宣布 Qwen3.8-Max 正式上线Qoder全端。8月3日至9月3日期间,新用户和付费用戶可领取800次免费调用,下单可再叠加2000次。此外,每天错峰时段享5折计费,个人版与企业版同享,中国版还推出了邀请福利活动。

Qoder宣布,为庆祝一周年及Qwen3.8-Max正式上线Qoder国际版和中国版全端。8月3日至9月3日期间,新注册用户和老付费用户可领取800次Qwen3.8-Max免费调用,活动期间下单可再叠加2000次,调用次数有效期至9月30日。此外,每天22:00至次日08:00(UTC+8)错峰时段享5折计费,个人版与企业版同享。中国版同时推出邀请好友赚积分活动。

读原文 →

阿里云百炼 Token Plan 上线 Qwen3.8-Max 正式版, 重置周限

开发生态

阿里云百炼 Token Plan 上线 Qwen3.8-Max 正式版, 重置周限

阿里云百炼 Token Plan 宣布上线 Qwen3.8-Max 正式版,原 Qwen3.8-Max-Preview 版本将于8月5日下线,有生效订阅的用户可获一次7天额度重置权益。

阿里云百炼平台宣布 Qwen3.8-Max 正式版已上线,个人版 Token Plan 已同步支持该模型。官方将于北京时间8月5日开始为所有在此前订阅的用户发放一次7天额度重置权益,用户可在权益有效期内按需重置可用额度。原 Qwen3.8-Max-Preview 版本将于8月5日下线,官方建议用户尽快完成切换,以免影响线上服务。关于 Qwen3.8-Max 的 Credits 消耗标准,官方建议用户在控制台关注用量统计,合理规划使用节奏。

读原文 →

Ant Ling 延长 OpenRouter 平台 Ling-3.0-flash 免费期限

开发生态

Ant Ling 延长 OpenRouter 平台 Ling-3.0-flash 免费期限

Ant Ling 宣布,在 OpenRouter 平台免费使用 Ling-3.0-flash 模型的期限已延长至太平洋时间8月6日上午8点。用户目前可继续免费体验该模型。

Ant Ling 官方宣布,旗下 Ling-3.0-flash 模型在 OpenRouter 平台的免费访问期限已获得延长。用户目前可以在该平台上继续免费使用 Ling-3.0-flash,此次免费期限将一直持续至太平洋时间8月6日上午8点。

读原文 →

TRAE 为老用户加送积分并推进多项功能升级

开发生态

TRAE 为老用户加送积分并推进多项功能升级

TRAE在积分体系上线后宣布为老付费用户额外加送通用积分,并将未升级用户的迁移加赠积分翻倍。官方同时表示正推进调整生图生视频限额和支持更大上下文窗口等功能以回应用户诉求。

TRAE 在积分体系上线后宣布为老用户增加两项福利。已升级到全新积分体系的付费用户于 8 月 3 日按会员档位额外获得一份通用积分,有效期为 31 天。尚未升级的速通用户一次性迁移加赠积分上调至原来的两倍,自切换到积分体系之日起 31 天内有效。两份福利均为通用积分,TRAE Work 与 TRAE IDE 全端通用,到账后无需任何操作即可使用。官方同时表示,调整生图生视频限额、支持更大上下文窗口、支持选择模型思考强度、增加 Deepseek-V4-Flash 正式版模型资源量以覆盖更多用户等功能正在推进中。

读原文 →

Kiro 推出统一 Kiro agent harness,已上线全部四个客户端

开发生态

Kiro 推出统一 Kiro agent harness,已上线全部四个客户端

Kiro 推出统一的 Kiro agent harness,取代各客户端独立架构。新套件已在 Kiro IDE、CLI、Web 和 iOS 全面上线,实现跨平台一致配置。

Kiro 官方宣布将此前的三个独立代理套件整合为单一的 Kiro agent harness,目前该套件已在 Kiro IDE、CLI、Web 和 iOS 四个客户端全面上线。新架构作为独立服务器进程运行,通过 Agent Client Protocol (ACP) 及其扩展与客户端通信,使规范化驱动开发、自定义代理和 Hooks 在所有客户端保持一致的行为和配置格式。此外,Kiro 引入了基于 Cedar 的单一能力级权限模型,取代了以往各客户端互不兼容的权限系统。

读原文 →

OpenRouter发布Ori Eval,支持对比模型并给出量化推荐

开发生态

OpenRouter发布Ori Eval,支持对比模型并给出量化推荐

OpenRouter 推出 Ori Eval 评估工具,帮助开发者为项目选择最合适的模型。Ori Eval 通过编程 Agent 自动扫描代码库并运行跨提供商的模型比较。

OpenRouter 推出 Ori Eval,这是一款 CLI 工具和评估框架,目前可用。Ori Eval 让开发者通过在真实提示词上测试 Agent 来寻找最适合项目的模型,自动扫描代码库、编写评估文件、运行跨提供商模型比较并给出带分数的推荐;每次运行固定 harness 和模型以确保结果可复现。开发者可通过编程 Agent 运行 curl 命令启动,或手动安装 CLI,需要 Bun 运行时和 OpenRouter 登录凭证;评估会调用真实模型并产生费用。

读原文 →

Interconnects AI上线Artifacts Hub与Adoption Dashboard,分析开源模型趋势与采用

开发生态

Interconnects AI上线Artifacts Hub与Adoption Dashboard,分析开源模型趋势与采用

Interconnects AI宣布推出两个免费工具帮助洞察开源模型生态,Artifacts Hub用于追踪开源模型趋势,Adoption Dashboard展示按地区和机构的模型采用数据。

Interconnects AI 宣布推出两个免费资源:The Artifacts Hub和Adoption Dashboard。Artifacts Hub是一个精选视图,整合Open Router推理token数据、Artificial Analysis模型智能评分以及基于Hugging Face数据构建的自定义采用指标,目前覆盖近两年发布的792个模型。Adoption Dashboard是动态仪表板,按地理区域和组织展示下载量与衍生模型数量,突出中美差距及开源生态中的新兴参与者。

读原文 →

Cloudflare 推出开源 Agent 运行时 @cloudflare/computer

开发生态

Cloudflare 推出开源 Agent 运行时 @cloudflare/computer

Cloudflare推出开源Agent运行时@cloudflare/computer早期预览版。它为Agent提供独立计算环境,依托SQLite虚拟文件系统,动态编排isolates与Linux容器执行任务。

Cloudflare 推出开源的 agent runtime 早期预览版 @cloudflare/computer,旨在为每个 Agent 提供独立的“计算机”环境。其核心提供基于 SQLite 的虚拟文件系统,并能根据任务需求,动态编排快速的 isolates 和完整的 Linux 容器。官方表示,这种设计旨在优化性能和成本,目标是让 Agent 处理大部分工作时使用 isolates,仅在不到 10% 的任务中才需要容器。开发者目前可通过 npm 安装该库并进行试用。

读原文 →

Cloudflare 发布 Billable Usage API,自助服务账户可程序化查询成本与用量

开发生态

Cloudflare 发布 Billable Usage API,自助服务账户可程序化查询成本与用量

Cloudflare 推出全新 Billable Usage API,面向自助服务账户开放,单端点即可按产品查询全部用量与成本。

Cloudflare 发布 Billable Usage API,为自助服务账户提供单端点程序化成本与用量查询能力,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images、Stream 等全部按量计费产品。API 字段对齐 FinOps 开放成本与用量规范 FOCUS,返回按产品和计费周期的明细行。目前用量与成本数据每日更新,企业级合同支持仍在开发中。

读原文 →

NousResearch 发布 Hermes Agent v0.20.0

产品应用

NousResearch 发布 Hermes Agent v0.20.0。该版本新增流式对话语音、Agent-to-Agent协议与桌面应用插件 SDK等功能。

NousResearch 发布 Hermes Agent v0.20.0。相比上版,该版本包含约 3,650 次提交与约 1,400 个合并 PR。 本次更新核心新增支持流式合成与可中途打断的实时对话语音模式,覆盖 CLI、桌面应用及飞书等多平台。同时引入 Agent-to-Agent v1.0 协议、出站 webhooks、事实检查技能,以及桌面应用 plugin SDK 与 artifacts 沙盒预览。 工具调用默认迭代上限从 90 提升至 500,引入上下文微压缩机制,冷启动降至约 1.8 秒。

读原文 →

据报道美国已完成AI监管框架,邀请主要科技公司审阅

行业动态

据报道美国已完成AI监管框架,邀请主要科技公司审阅

据报道,美国政府已邀请OpenAI、Google、Anthropic等AI公司,于周二审阅一份已完成的自愿AI监管框架。该框架将建立前沿模型发布前向政府提交的流程。

据The Information独家报道,美国政府已邀请OpenAI、Google和Anthropic等主要科技公司员工于周二前往白宫,审阅一份已完成的AI监管框架最终版本。该框架为自愿性质,将建立一套流程,要求各实验室在发布前沿模型前向政府提交。

读原文 →

OpenAI 发文详解 GPT-Live 架构:全双工模型与异步委派

技术与洞察

OpenAI 发文详解 GPT-Live 架构:全双工模型与异步委派

OpenAI发文详解其第三代语音系统GPT-Live。它采用全双工模型,移除轮次检测器,支持同时听与说。需深度推理或用工具时,它能不中断语音流异步调用GPT-5.5。

OpenAI发文详解第三代语音系统GPT-Live的底层架构。该系统采用全双工模型支持同时听与说,移除传统轮次检测器以降低延迟。需深度推理或调用工具时,系统可异步调用GPT-5.5等前沿模型,且核心语音流不中断。

为实现该体验,OpenAI耗时六个月重构系统,将核心媒体流与业务逻辑分离。系统改用Go语言取代Python,使新系统p95帧流畅度媲美旧系统p50。团队开发WARP协议与Instant Connect技术,将网络启动往返次数从六次降至一次。系统支持无缝切换实例与动态上下文压缩,发布前曾路由部分真实流量进行静默测试。

目前,GPT-Live已为ChatGPT Voice提供支持,包含控制电脑及协调Agent等功能,其专属API即将推出。

读原文 →

Google Agent Skills 团队分享项目构建、测试与质量控制机制

技术与洞察

Google Agent Skills 团队分享项目构建、测试与质量控制机制

Google Agent Skills 团队发文分享了该项目 Skills 构建与质量机制,项目要求 Skill 通过自动化检查与持续评估,以保证规模化扩展时的质量。

Google Agent Skills 团队详细介绍了该项目在构建、测试和规模化过程中的质量控制机制。该项目旨在将 Google Cloud 领域知识编码为结构化的开源指令,以减少 AI Agent 幻觉并强制执行最佳实践。为保证规模化扩展时的质量,团队为每个 Skill 制定了标准化的仓库布局,在设计上优先引用远程 MCP 工具。所有 Skill 在公开发布前,必须通过包含链接检查在内的自动化 CI/CD 管道,并在提交时和每周接受基于准确性与效率的持续评估。

读原文 →

智谱GitHub仓库及ZCode文档出现GLM-5.3相关内容

前瞻与传闻

智谱GitHub仓库及ZCode文档出现GLM-5.3相关内容

据社区用户发现,智谱ZCode文档短暂出现 GLM-5.3 相关字样。同时智谱官方GitHub仓库也出现相关字符,但官方尚未透露有关GLM-5.3的更多信息。

社区用户发现智谱官方 GitHub 仓库 zai-org/z-ai-sdk-java 出现了 glm-5.3 分支,ZCode 文档页面也短暂出现了 GLM-5.3 相关字样,该模型疑似即将上线。上述信息均来自社区用户对官方仓库和文档的观察,智谱尚未正式宣布 GLM-5.3 的发布时间或可用范围。

提示:内容由AI辅助创作,可能存在幻觉和错误。

读原文 →