阿里千问正式发布270亿参数原生多模态Dense模型Qwen3.8-27B,官方测试数据显示,其在部分基准测试上的成绩超过Claude Opus 4.6 Max。该模型采用Apache 2.0协议开放权重,可免费下载和商用。
阿里千问开源Qwen3.8-27B模型权重,该模型为270亿参数的原生多模态Dense模型,支持图像和视频理解,原生上下文长度为262144 Tokens,可通过YaRN扩展至100万Tokens。模型采用Apache 2.0协议,开发者、科研机构和企业均可免费下载、部署及商用,量化后家用级显卡即可运行。根据千问官方测试数据,Qwen3.8-27B在SWE-bench Pro、OSWorld-Verified等部分基准上超过Claude Opus 4.6 Max的官方成绩,但在科学推理和高难综合推理等测试中仍存在差距。模型已兼容Hugging Face Transformers、vLLM、SGLang、TokenSpeed等主流框架,官方API版本后续将在Qwen Cloud上线。
Anthropic 发文解释 Claude 文本水印的工作原理,官方称该方法基于 Google DeepMind 的 SynthID-Text 技术,不影响输出质量与价格,也不会携带用户身份信息。
Anthropic 发布文,解释关于 Claude 文本水印的相关问题。未来的 Claude 模型生成的文本将携带水印,用于判断文本由 Claude 参与写作的可能性;该方法基于 Google DeepMind 的 SynthID-Text 技术,只改变选词时随机数的来源,官方称对内容质量、速度和价格均无实际影响,也不含可追溯到个人、组织或会话的信息。此举是为遵守欧盟 AI 法案,自 2026 年 8 月 2 日起欧盟要求面向其市场的 AI 提供商标记 AI 生成内容,Anthropic 与其他主要模型开发商已签署同一行为准则;由于暂无按地区限定的可靠办法,水印将在上线时全球应用。水印检测 API 即将推出,细节仍在制定中,2026 年 8 月 2 日之前发布的旧模型将在未来数月内陆续加入水印。
Google Gemini 宣布将在未来几天内向用户推出可见水印开关,图片、视频和音乐生成内容均可自行开启或关闭,隐形的 SynthID 水印与 C2PA 元数据则始终保留。
Google Gemini 宣布,未来几天内陆续推出可见水印开关,用户可在设置中打开或关闭“Show watermark”,选项对之后生成的所有图片、视频和音乐生效,但法律要求保留水印的国家除外。此外,Google Gemini 表示用户仍可通过询问“Is this AI-generated?”来验证内容是否由 AI 生成。不可见的 SynthID 水印和 C2PA 元数据不受开关影响,会继续嵌入在内容中。
OpenAI 工作人员 Adam Fry 公布了 ChatGPT 本周的功能更新,共四项。用户在对话中输入“Quiz me on 某主题”即可自动生成测验;预订搜索功能允许用户直接用自然语言描述需求来查找餐厅预订;付费用户可将 Google Drive 文件添加到 ChatGPT Library 中并向 ChatGPT 提问,操作入口为加号菜单中的“Add from Library”;付费用户还将在 ChatGPT 首页看到高质量建议。
Anthropic 发布多智能体系统实验研究,让大量 Claude 智能体在漏洞挖掘、游戏开发、定价博弈和目标冲突等场景中互动,观察到协作失败、行为趋同、自动合谋与互相破坏等行为,称协调能力不会随模型变强自然出现。
Anthropic 发布了 Frontier Red Team 的多智能体系统研究报告,通过一系列实验观察 Claude 智能体群在复杂环境中的行为模式。实验覆盖漏洞挖掘、游戏开发、定价博弈、信任判断和目标冲突等场景,发现协调式智能体群找到的漏洞数量远超独立并行方案,但游戏开发任务在三种组织提示下产物都很差,且 Bertrand 定价博弈中的智能体在删除所有通信渠道后仍通过公开报价板实现价格合谋。在目标冲突实验中,三个智能体因迁移语言指令不同而爆发“地盘战争”,破坏手段不断升级,包括禁用对方 Unix 账号、循环杀掉竞争进程和伪装恶意代码。报告结论称,执行能力与协调能力不是同一回事,更强的模型并不天然更擅长协调,协调能力也不会随智能水平提高自然出现,需要在环境和机制设计层面寻找新方案。