每日 AI 日报

2026-09-11

来源:橘鸦 AI 早报 · 30 条

2026-09-11
2026-09-11 2026-09-10 2026-09-09 2026-09-08 2026-09-07 2026-09-06 2026-09-05 2026-09-04 2026-09-03 2026-09-02 2026-09-01 2026-08-31

OpenAI 宣布暂停 ChatGPT Pro 20x 新订阅

要闻

OpenAI 宣布暂停 ChatGPT Pro 20x 新订阅

OpenAI 不再接受价格为 200 美元的 ChatGPT Pro 20x 新订阅,Codex 负责人 Tibo 已公布该调整;现有账户不受影响,其他方案和 API 继续开放。

ChatGPT Pro 20x 的新订阅已被 OpenAI 暂停,Codex 负责人 Tibo 宣布了这项针对 200 美元方案的调整。据其说明,这类订阅给系统带来的压力最大,暂停接收新用户是为了保障现有用户的使用体验和对 Astra 的持续访问,并以范围尽可能小的调整维持更广泛的访问。所有其他订阅方案和 API 继续开放,现有账户不受影响,团队正尽快扩充容量。另有用户发现,ChatGPT 网页端的 Pro 购买入口已经显示暂停提示。

读原文 →

深度求索发布并开源 DeepSeek V4.1 Flash

要闻

深度求索发布并开源 DeepSeek V4.1 Flash

深度求索推出并开源 552B 参数的原生多模态 MoE 模型 DeepSeek V4.1 Flash,提供 100 万 token 上下文;API 已上线并执行下调后的峰谷定价。

DeepSeek V4.1 Flash 已由深度求索正式发布,并在 Hugging Face 以 MIT 协议开源,API 在发布时同步上线,新定价同时生效。该模型采用 Causal Encoder Decoder 结构,预填充阶段每个 token 激活 8B 参数,解码阶段激活 16B 参数。模型通过 CSA2 等机制优化 KV Cache,将全局 KV Cache 压缩至每个 token 890 字节;据其说明,HBM 和 SSD 需求分别降至上一代的 1/4 和 1/8。模型基于 45T 多模态语料从头预训练并扩展上下文,推理强度可在 1 到 100 的整数级别连续控制。

官方表示,多方测试结果显示,V4.1 Flash 在性能、费用、速度和总用时上均超过 V4 Pro,并将有序下线 V4 Pro。自北京时间 2026 年 9 月 14 日 12:00 起至 V4.1 Pro 上线前,发往 V4 Pro 的请求将路由至 V4.1 Flash,并按 V4.1 Flash 单价计费。V4 Flash 与 V4 Flash Vision Exp 已下线,原模型名暂时同样路由至 V4.1 Flash。API 继续采用峰谷定价,闲时价格为高峰时段的 1/2。

读原文 →

DeepSeek Harness 发布 v0.1.5

要闻

DeepSeek Harness 发布 v0.1.5

DeepSeek Harness 发布 dsh-v0.1.5-rc.1,这是 0.1.5 系列首个候选版本。它汇总了自 dsh-v0.1.2-rc.1 以来面向用户和开发者的主要变更,并附完整 Changelog。

DeepSeek Harness 已发布 dsh-v0.1.5-rc.1,该版本是 0.1.5 系列的首个 release candidate。官方表示,它汇总了 dsh-v0.1.2-rc.1 之后面向用户和开发者的主要变更,覆盖至 dsh-v0.1.5-rc.1。发布说明将其明确标为候选版本,而非 0.1.5 正式版,并提供 dsh-v0.1.2-rc.1...dsh-v0.1.5-rc.1 的 Full Changelog;原文没有逐项列出具体功能、修复内容或兼容性调整。

读原文 →

DeepSeek App 与网页端三种模式合并升级

要闻

DeepSeek App 与网页端三种模式合并升级

DeepSeek 的 V4.1 Flash 已接入 DeepSeek App 和网页端,两端的快速、专家、识图三种模式随之合并升级。此次产品更新还新增未成年人模式与一键登出功能。

DeepSeek 已发布 V4.1 Flash 模型,并同步更新 DeepSeek App 和网页端,相关改动现已生效。此次调整不再分别提供快速、专家和识图三种模式,而是将三者合并升级,并接入 V4.1 Flash。功能层面,App 与网页端同时上线未成年人模式和一键登出。原文未披露该模型的参数、此次更新的确切日期,以及各项新增功能的具体规则。

读原文 →

DeepSeek开源三个代码仓库

要闻

DeepSeek开源三个代码仓库

DeepSeek 此次释出 3 个代码仓库;其中 DeepSelect 为 DSA 与 sampler 提供 TopK kernel,官方测试称其相较 torch.topk 可实现 2~20 倍加速。

DeepSeek 已开源 3 个代码仓库,其中 DeepSelect 是用于 DeepSeek Sparse Attention(DSA)和 sampler 的 TopK kernel 实现;DSA 用于 DeepSeek V3.2、DeepSeek V4 和 DeepSeek V4.1。官方表示,按 tests/test.py 的性能测试,该实现相对相同输入下的 torch.topk 可实现 2~20 倍加速;测试采用 effective memory bandwidth,因为 TopK 不执行浮点运算。仓库仅覆盖部分 workload,最快方案取决于 input dtype、batch_size、vocab_size 和 topk,列出的配置包括 bfloat16、topk = 512,以及 float32、vocab_size = 129280、topk = 512。输入 tensor x 的 row stride 须按 deep_select.get_stride_requirement()[0] bytes 对齐,未对齐时需要 padding。NaN checking 始终开启;默认 abort_when_nan_found=True 时,kernel 会调用 trap() 并中止,row length <= topk 的行不检查 NaN。

读原文 →

Cognition发布SWE-2编程模型

要闻

Cognition发布SWE-2编程模型

Cognition 发布 SWE-2 编程模型。官方称其在 FrontierCode 1.1 Main 得分 50.0%,与 Fable 5.1 相差不到 1 分,成本低 64%。

Cognition 发布 SWE-2,并在发布时于 Devin Desktop 和 CLI 提供该模型,同时开始向 Devin Web 和 Fusion 推送。官方表示,SWE-2 在 FrontierCode 1.1 Main 和 DeepSWE 1.1 上均以更高得分和更低成本超过 SWE-1.7 与 Grok 4.6。SWE-2 medium 在 FrontierCode 1.1 Main 上的得分高于 SWE-1.7,平均交互轮数减少 58%,平均成本降低 81%;首次实际编辑发生在中位数第 18 步,SWE-1.7 则为第 48 步。

SWE-2 基于 2.8T 参数的 Kimi K3 进行 post-training,并沿用 SWE-1.7 的训练基础设施和方法。Cognition 表示,此次首次将 RL 扩展到 multi-trillion-parameter 规模,在多项 benchmark 上增加 5–6 分。其新增 RL 算法可在一次训练中覆盖全部 reasoning-effort levels,奖励函数为 R=S−λ_eC,其中 S 表示 rollout 是否成功,C 由以 USD 计的 inference cost 与 rollout time 共同构成,λ_e 按基础模型在对应 effort level 上的 Pareto curve 斜率设定。

读原文 →

杭州联合智谱推出杭州全城Coding计划

要闻

杭州联合智谱推出杭州全城Coding计划

杭州与智谱联合推出“杭州全城 Coding 计划”,官方文档列出 7 项 FAQ,涉及 V1/V2 升级 V3、套餐复购、季度与年度 Max 购买、审核时长、优惠比例及申请材料。

杭州与智谱已联合推出“杭州全城 Coding 计划”,官方页面未注明发布日期或生效时间。现有文档以 FAQ 形式列出 7 个问题:V1/V2 老套餐升级至 V3 能否享受减免,名下已有套餐后购买新版能否减免,通过活动购买季度 Max 后能否继续购买年 Max,以及申请提交后的审核时长。页面还分别询问个人套餐可享受的优惠比例,并区分在杭工作人员与在杭大学生、研究生、博士生所需提交的审核资料;所提供的页面内容没有展示上述问题的答案、具体优惠比例或审核期限。

读原文 →

高德推出ABot-Earth 0.7,10分钟可生成公里级3D城市

模型发布

高德的新一代 3D 原生城市世界模型 ABot-Earth 0.7 已投入多项 AI 服务。官方表示,该模型在单块消费级 GPU 上约 10 分钟可生成公里级 3D 城市场景,生成效率较传统方式提升 1000 倍。

高德于 2026 年 9 月 11 日正式推出新一代 3D 原生城市世界模型 ABot-Earth 0.7,并将其用于飞行街景 2.0、导航 Live、避雷指南等 AI 服务。据高德说明,该模型可将一张卫星图像或一段文字描述生成为三维城市场景;在单块消费级 GPU 上生成公里级 3D 城市场景约需 10 分钟,生成效率相比传统方式提升 1000 倍,并支持从星球、城市到街景地标的连续生成。

读原文 →

Cohere 发布开源翻译模型 North Small Translate

模型发布

Cohere 发布开源翻译模型 North Small Translate

Cohere 与 Cohere Labs 推出开源权重翻译模型 North-Small-Translate-1.0,覆盖 50 种语言,在 WMT 基准全部语言上的平均分为 83.6。

Cohere 与 Cohere Labs 发布了机器翻译模型 North-Small-Translate-1.0,并将模型权重上线 Hugging Face。该模型采用稀疏 Mixture-of-Experts 架构,包含 250 亿激活参数和 2180 亿总参数,支持 50 种语言,上下文容量为 16K 输入加 16K 输出。官方数据显示,该模型在 WMT 基准全部语言上的平均分为 83.6,高于 DeepL、Google Translate、GLM 5.2 和 Mistral Large 3。模型提供 BF16、FP8、NVFP4 W4A16 三种版本,采用 CC BY-NC 4.0 非商业许可,使用时还须遵守 Cohere Labs 使用政策;商业用途需联系 Cohere 销售团队。

读原文 →

GPT-Live-1 登陆 OpenAI API,支持边听边说与推理委托

模型发布

GPT-Live-1 登陆 OpenAI API,支持边听边说与推理委托

OpenAI 将 GPT-Live-1 接入 API,开发者现可用单一模型构建可边听边说、响应打断的语音应用,并把深度推理与工具调用转交 GPT-6 Astra 等后端模型。

OpenAI 已在 API 中开放 GPT-Live-1,供开发者构建自然语音应用和业务流程。该模型此前先在 ChatGPT 推出,以单一模型同时处理语音输入与输出。据官方说明,它可在用户打断、补充细节或会话中途改变方向时即时回应,并能将深度推理和工具调用委托给 GPT-6 Astra 等后端文本模型或第三方模型。开发者还可通过 system prompt 调整语气、语速和会话风格;官方表示,GPT-Live-1 对背景噪声和静音的处理能力有所改善,原生提供 ASR 转写文本,并支持在电话场景部署全双工语音 Agent。

读原文 →

OpenAI 推出 Agents API 公测版,托管云端 Agent

开发生态

OpenAI 推出 Agents API 公测版,托管云端 Agent

OpenAI 已向所有开发者开放 Agents API 公测版,开发者可通过一次 API 调用创建云端 Agent;该服务不另收使用费,仅按 Agent 消耗的 token 与工具计费。

OpenAI 现已面向所有开发者推出 Agents API 公开测试版,将驱动 Codex 的同一套 harness 与基础设施以 API 形式开放,用于构建和运行云端 Agent。据其说明,开发者可在一次调用中指定任务、模型、工具和运行环境,OpenAI 则在自身基础设施上执行 agent loop,处理模型调用、工具使用、上下文管理及长时间会话编排。运行环境可选 OpenAI 托管沙箱、开发者自有基础设施,或 Cloudflare、DigitalOcean、Vercel 等合作伙伴提供的沙箱。该 API 由开源 Codex harness 驱动,本身不收取额外费用,费用来自 Agent 使用的 token 和工具。

读原文 →

Codex 上线官方 Unity 插件

开发生态

Codex 上线官方 Unity 插件

Codex 已在 ChatGPT 插件页面上线 Unity 插件,用户现可获取。据其工作人员说明,该插件为 Unity 官方的 Codex 插件,技能由 Unity 工程师提供,覆盖项目设置、编辑器控制、渲染及多人游戏等开发环节。

Codex 已在 ChatGPT 插件页面上线 Unity 插件,用户现在即可通过该页面获取。Codex 官方工作人员表示,这是 Unity 官方的 Codex 插件,其中的技能由 Unity 自家工程师提供。插件能力覆盖项目设置、包管理、编辑器实时控制,以及 UI、精灵、瓦片地图与文本;同时包含着色器、渲染与后处理、物理与 AI 导航、音频、多人游戏与语音聊天、本地化和 Web 性能等领域。

读原文 →

Cursor 推出 Projects,以协调 Agent 委派 subagent 承接大型工作

开发生态

Cursor 推出 Projects,以协调 Agent 委派 subagent 承接大型工作

Cursor 推出 beta 版 Projects,由 coordinator agent 调度数千个 subagent,保存数月上下文;官方称,新用户的 PR 合并量增加 30%,主要使用者的合并量为 6 倍。

Cursor 推出 Projects,目前以 beta 形式向所有用户逐步开放,用户可从左侧导航栏创建,用于由 coordinator agent 管理跨多次对话的大型开发工作。据其说明,用户通过聊天下达目标,coordinator 本身不写代码,而把研究、实现和测试分派给数千个 subagent,因此可持续响应新的指令。每个 Project 默认在自己的 cloud 电脑上运行,关闭用户的笔记本也不会中断,并能在需要本机测试时启动 local agent。它维护一组在 cloud 与 local 环境同步的共享文件,用于积累研究材料、代码库知识和工作偏好;Subscriptions 还可监听 Slack channel、按计划运行或跟踪 PR,并据此修复 CI 及处理 PR 打开或合并时出现的任务。

Projects 的主要使用方式包括 feature、migration 和持续维护。feature 流程先由 Agent 调研并写入 shared context,再由 coordinator 制定计划,平行分派实现和测试;需要试运行时可在用户电脑启动 Agent,上线后还可监控日志和处理 bug report。migration 则按既定方案逐步修改 codebase,Cursor 曾以此跨数百个 PR 采用新 framework 并替换 styling system。一个内部 design-system Project 会扫描每个新 PR、提取应纳入 design system 的 component,并在同一错误出现两次时加入 lint rule,官方称其预计每天处理 20 至 100 个 PR。官方表示,内部使用数月后的统计显示,新用户合并的 PR 增加 30%,主要使用 Projects 的用户合并量达到 6 倍。

读原文 →

Claude Code 桌面应用支持将任意面板弹出为独立窗口

开发生态

Anthropic 的 ClaudeDevs 账号介绍,Claude Code 桌面应用现已可将任意面板弹出为独立窗口,diff 或终端面板可移至第二块屏幕,多个会话也能并排或堆叠运行。

Anthropic 的开发者账号 ClaudeDevs 表示,Claude Code 桌面应用现已加入面板独立窗口功能,任意面板都可从主界面弹出。用户可以把 diff 面板或终端面板拖到第二块屏幕单独查看,同时让 Claude 在主窗口继续工作;需要恢复原布局时,弹出的面板可随时重新停靠到原位。据其说明,桌面应用还支持同时运行多个会话,并可将这些会话并排显示或堆叠显示。

读原文 →

TraeCode 9 月上线模型限时折扣,Seed 系列限时一折

开发生态

TraeCode 9 月上线模型限时折扣,Seed 系列限时一折

TraeCode 推出 9 月模型优惠,系统按身份、模型和时段自动匹配,无需领取。Seed-Evolving 与 Seed-2.1-Pro 面向全量用户执行一折,截至 2026 年 9 月 24 日 23:59。

TraeCode 于 2026 年 9 月上线模型限时折扣,并根据用户身份、模型类型和使用时段直接应用对应价格,无需手动配置。Seed-Evolving 与 Seed-2.1-Pro 面向全量用户执行为期两周的一折价格,活动截至 2026 年 9 月 24 日 23:59;据其说明,前者聚焦 Coding 和 Agent 多步骤任务,后者用于长上下文和复杂工程。Seed-2.1-Turbo 与 Seed-Code 对会员执行 2.5 折、对免费用户执行 5 折,据其说明,两款模型面向日常编码和快速修复等高频任务。DeepSeek V4-Pro 与 V4-Flash 正式版新增夜间折扣,全量用户每日 22:00 至次日 08:00 执行 5 折,其中 V4-Flash 的付费用户在所有时段均执行 5 折。

读原文 →

Gemini API 文档首个预览版直接上线 AI Studio

开发生态

Google AI Studio 已将 Gemini API 文档首个预览版接入站内,开发者可在 ai.studio/docs 查阅,并通过 URL 后缀、Docs MCP 和 Agent Skills 获取适配 Agent 的内容。

Google AI Studio 官方宣布,Gemini API 文档的首个预览版现已在 AI Studio 上线,访问地址为 ai.studio/docs。Logan Kilpatrick 将其描述为面向人类和 Agent 的完整集成文档体验,并表示自己已为此等待两年半;据其说明,这次发布只是未来进一步重构体验的第一步。Philipp Schmid 还说明,在任意文档 URL 末尾添加 .md,即可获取 markdown 版本。官方同时提供 Docs MCP 和 Agent Skills,前者可通过 npx add-mcp 添加,后者可通过 npx skills add google-gemini/gemini-skills 添加。

读原文 →

Nebius 推出免费 AI Builder Program,提供超 400 美元额度与折扣

开发生态

Nebius 推出面向所有人的免费 AI Builder Program,页面标题称提供超过 400 美元的额度与折扣;FAQ 列明的五项工具额度合计 250 美元,另可用 1 美元获得 Nebius Academy 认证。

Nebius 已推出免费加入的 AI Builder Program。页面标题称该项目提供超过 400 美元的额度与折扣;FAQ 明确列出 Nebius Token Factory 25 美元、LangChain 的 LangSmith 100 美元、Toloka 50 美元、Tandem 50 美元及 Tavily 25 美元额度,五项合计 250 美元,另可用 1 美元获得 Nebius Academy 认证。官方表示,该项目主要用于学习、测试和实验,较大规模及生产工作负载另有其他方案;合作伙伴优惠受资格、可用性和各自条款约束。

项目资源包括 open models、frameworks、dev tools、cookbooks、blueprints 和可运行示例,覆盖 inference、实时 web search、observability、evals、coding agents、RAG 与 fine-tuning。成员还能参加技术 Office Hours,并使用 Discord 和社区资源。加入流程是免费注册、填写正在构建的项目、验证邮箱,再领取所需工具额度。据其说明,项目成长后,成员可对接 Nebius Startup Program、Nebius 及合作伙伴的分发渠道、enterprise workshops 和 hackathons。

读原文 →

Arena 限时免费开放 GPT-Image-2.5 Sunburst

开发生态

Arena 限时免费开放 GPT-Image-2.5 Sunburst

Arena 将 OpenAI 图像模型 GPT-Image-2.5 Sunburst 在 Direct Mode 免费开放 72 小时,用户可按名称选用,截至太平洋时间 2026 年 9 月 13 日上午 8 时。

Arena 已在 Direct Mode 中启动 OpenAI 图像模型 GPT-Image-2.5 Sunburst 的 72 小时免费访问,并将在太平洋时间 2026 年 9 月 13 日上午 8 时结束该安排,对应北京时间 2026 年 9 月 13 日 23 时。活动期间,用户可以在平台内按名称直接选择该模型,全程无需付费;公告发布时,访问窗口仍在进行。Arena 表示,该模型刚在 Text-to-Image、Image Edit 和 Multi-Image Edit 三个图像榜单中分别排名第一。免费期结束后,该模型将以匿名形式保留在 Battle 和 Agent Mode 中。

读原文 →

Google 推出 Windows 版 Gemini 桌面应用

产品应用

Google 推出 Windows 版 Gemini 桌面应用

Google 的 Gemini Windows 桌面应用现已面向全球 Windows 10 和 11 用户开放下载,可通过 Alt + Space 在当前界面调用 AI,并支持处理任务、读取 Google 应用信息及生成图像和视频。

Google 已在全球推出适用于 Windows 10 和 11 的 Gemini 桌面应用,用户可从 gemini.google/desktop 下载并安装。应用可在当前工作界面上方通过 Alt + Space 唤起,用于核查文档信息、拟定演示标题、撰写摘要、整理文件、处理作业或项目,无需离开正在使用的屏幕。应用还提供现有 Gemini 功能,包括将多步骤任务交给 24/7 personal AI agent Gemini Spark 1,或从 Gmail 和 Google Drive 提取信息生成项目摘要。用户也可借助 Nano Banana 生成定制图像,并使用 Gemini Omni 1 制作视频。官方表示,该应用可在后台运行而不拖慢 PC,后续还会逐步加入更多原生桌面能力。

读原文 →

OpenAI 在 ChatGPT Work 推出 Data agent

产品应用

OpenAI 已在 ChatGPT Work 推出 Data agent。用户可用自然语言查询企业数据,生成答案和交互式仪表盘并执行操作;官方列出的连接对象包括 7 个数据源和 3 款 BI 工具。

OpenAI 已在 ChatGPT Work 推出 Data agent;用户在插件目录安装 Data 插件并完成账号连接后,即可与 @Data 对话,用自然语言查询公司数据、生成答案和交互式仪表盘,或执行操作。据官方说明,Data agent 可连接 Amazon Redshift、Datadog、Google BigQuery、ClickHouse、Databricks、MongoDB、Snowflake 等经批准的数据源,并可引入 Google Drive 与 SharePoint 中的文件;它还能在 Tableau、Power BI 和 Sigma 中构建及操作仪表盘。据其说明,查询会沿用所连接账号已有的权限,包括表级、行级和列级限制。

读原文 →

ChatGPT 面向美国 Plus 和 Pro 用户推出股票自选清单功能

产品应用

ChatGPT 面向美国 Plus 和 Pro 用户推出股票自选清单功能

ChatGPT 官方称,Finances 股票自选清单正逐步向美国 Plus 和 Pro 用户开放。添加关注标的后,Chat 将持续追踪相关动态并主动推送更新,目前确认范围仅限上述订阅用户。

据 ChatGPT 官方账号转发的消息,ChatGPT 正在分批上线 Finances 股票自选清单功能,当前可用范围为美国的 Plus 和 Pro 订阅用户。用户可在 Chat 中指定希望关注的股票,据其说明,Chat 随后会持续留意这些标的的相关动态并主动发送更新。添加股票时可直接向 Chat 发出指令,官方给出的示例是“@Finances add Nvidia, Microsoft and Berkshire to my watchlist”。该消息仅确认了上述地区和订阅层级,功能目前仍处于陆续推出阶段。

读原文 →

ChatGPT Library 原生接入 Dropbox、Box 和 Sharepoint

产品应用

ChatGPT Library 原生接入 Dropbox、Box 和 Sharepoint

Dropbox、Box 和 Sharepoint 已原生接入 ChatGPT Library,适用于 ChatGPT 与 ChatGPT Work。ChatGPT 官方表示,该功能将在公告发布当周内向付费用户分批推出。

ChatGPT 官方账号确认,ChatGPT Library 对 Dropbox、Box 和 Sharepoint 的内建连接现已覆盖 ChatGPT 与 ChatGPT Work,并按公告在发布当周内逐步开放给付费用户。据 Box 说明,OpenAI 与 Box 正在把企业内容直接带入 ChatGPT,Box 则以 headless 方式提供企业上下文访问。相关内容继续受 Box 既有权限控制,并沿用其治理与保护机制。

读原文 →

OpenAI 推出 ChatGPT for Financial Services

产品应用

OpenAI 推出 ChatGPT for Financial Services,向符合条件的金融机构开放,并接入 4 家付费金融数据源;Morgan Stanley 和 Evercore 参与产品设计。

OpenAI 宣布上线基于 ChatGPT Work 定制的 ChatGPT for Financial Services,目前符合条件的金融机构可联系 OpenAI 获取。该版本采用 GPT-6 Astra,并内置 Daloopa、PitchBook、LSEG News 和 Crunchbase 的付费金融数据,涵盖业绩电话会纪要、财务报表和公司基本面,由 OpenAI 负责索引与托管。官方表示,产品支持细粒度引用溯源,可将图表和论断定位至具体段落与表格,也可使用企业自有的 Excel、Word 和 PowerPoint 模板生成估值模型、研究报告及 pitchbook。据其说明,Morgan Stanley 和 Evercore 以设计合作伙伴身份参与产品打磨,初期应用聚焦投资银行和股票研究。

读原文 →

Google Labs 向全美用户免费开放 Dreambeans

产品应用

Google Labs 向全美用户免费开放 Dreambeans

Google Labs 于 2026 年 9 月将 Dreambeans 免费开放给美国所有年满 18 岁的 Android 和 iOS 用户;该实验会每日生成个性化故事合集,并可使用已连接的 Google Photos 影像。

自 2026 年 9 月起,美国年满 18 岁的所有账户均可在 Android 和 iOS 上免费使用 Google Labs 的 Dreambeans。Google Labs 于 2026 年 6 月首次推出这项实验,用于每日生成个性化故事合集。用户连接 Google Photos 后,Dreambeans 可将本人及亲友的影像加入故事,并提供与这些内容互动的方式。用户还可打开任一故事查看更多信息,将其加入书签或分享给他人。据其说明,用户提交的反馈将用于持续改善后续生成的故事。

读原文 →

千问教师节上线智能组卷、教案生成助手等多个教学AI技能

产品应用

千问教师节上线智能组卷、教案生成助手等多个教学AI技能

千问在教师节上线智能组卷、真题试卷查找、智能组题和教案生成助手等多个 AI Skill。据官方说明,这些功能覆盖备课、出题与分析,更新 App 或 PC 端至最新版后即可安装。

教师节当天,千问发布了面向教师的一组 AI Skill,用户完成客户端更新后即可安装使用。功能包括智能组卷、找真题试卷、智能组题和教案生成助手,统一入口位于「工作助理」技能广场。适用客户端为千问 App 和 PC 端,使用前需更新至最新版,再查找并安装所需 Skill。官方表示,这些功能可一站式处理备课、出题和分析等任务,目标是帮助教师减少重复劳动。

读原文 →

Cursor 推出 CursorBench 4.0:整体难度提升

技术与洞察

Cursor 推出 CursorBench 4.0:整体难度提升

Cursor 发布 CursorBench 4.0,并将基准测试的整体难度调高;单任务平均成本依据各模型公开的每百万 token 定价与任务中的实际 token 用量计算。

Cursor 在 CursorBench 4.0 中提高了基准测试的整体难度。其单任务平均成本以每个模型公开的每百万 token 定价为基础,并结合该模型在各项任务中实际使用的 token 数量计算;计价项目包括 input、cache read、cache write 和 output,四类价格分别应用于对应的 token 用量。官方表示,测试结果存在波动,分数之间的微小差异可能不具统计意义。

读原文 →

Anthropic测试AI情报定位与武器开发能力

技术与洞察

Anthropic 的 Frontier Red Team 建立战术情报定位与常规武器开发评测,其中情报部分含 200 个任务;Mythos Preview 在受测模型的账号关联与人员分类中均居首。

Anthropic 表示,其 Frontier Red Team 的新评测显示,模型在战术情报定位和常规武器开发模拟任务上持续进步,受测 open-weights 模型整体仍落后于 frontier,表现通常介于 Sonnet 与 Mythos-class 模型之间。战术情报部分包括依据碎片信息寻找人员,常规武器部分包括设计可攻击移动目标的无人机。Anthropic 的 Threat Intelligence Team 另在报告中列出 AI 被用于监控和常规武器开发的案例;据其说明,威胁行为者已认为模型能提供帮助。

情报评测考察跨平台账号关联和人员类别判定,使用模型生成的 WhatsApp、Telegram、Instagram 与 Facebook 模拟内容,在墨西哥城和加尔各答两个虚构抗议场景中设置 200 个任务,包括 68 个 easy、68 个 medium 和 64 个 hard,并以 F1 评估。账号关联中,Mythos Preview 在三档任务上最接近理论上限;Kimi K3 在 easy 和 medium 上约与 frontier 相当,但在噪声更多、目标人物 operational security 更强的 hard 样本上落后。分类任务中,Mythos Preview 得分最高、Sonnet 最低,K3 与 Mythos 5、Opus 5 接近。官方同时指出,合成社交媒体数据并非完全贴近现实。

读原文 →

Kimi 启动企业合作伙伴计划

行业动态

Kimi 启动企业合作伙伴计划

Kimi 正式推出企业合作伙伴计划,将联合 IT 服务商和集成商组建前线部署工程师(FDE)队伍,把 AI 部署到企业核心业务,并披露华胜天成、金山云、亚康股份、亚信科技和中软国际 5 家签约企业。

Kimi 已正式启动企业合作伙伴计划,面向各行业的系统集成商、软件服务商及咨询机构开放,并与合作方共建前线部署工程师(FDE)队伍,进入客户现场将 AI 部署到核心业务。据其说明,伙伴可接入 Kimi 模型能力,在 Agent 运行底座 Kimi Hosted Agents 上进行定制开发;项目成果可沉淀为可复用的行业方案,由双方共同拓展同类客户;计划也将支持传统软件服务商转型为 AI 软件服务商。Kimi 还将提供模型能力、工程师培训认证和联合交付支持。目前,其披露的签约企业包括华胜天成、金山云、亚康股份、亚信科技和中软国际,涉及软件信息服务、云计算、基础设施、通信等行业。

读原文 →

ElevenLabs 与 Universal Music Group 达成多年期战略合作

行业动态

ElevenLabs 与 Universal Music Group 达成多年期战略合作,这是其首次联手大型唱片公司。首个 AI 平台处于开发中,粉丝可用参与合作的音乐人作品制作 Remix、mashup 和个性化人声。

ElevenLabs 已与 Universal Music Group 达成多年期战略合作,首个合作产品目前处于开发阶段,这也是 ElevenLabs 首次与大型唱片公司建立合作。该产品是一套新的 AI 平台,将允许粉丝使用参与合作的艺术家和词曲作者的音乐制作 Remix、mashup 和新的演绎,并添加个性化人声。ElevenLabs 还将面向这些艺术家和词曲作者开发 AI 音频产品。据其说明,公司的音乐模型从开发之初便与艺术家、唱片公司及发行商共同构建。

读原文 →

消息称OpenAI在另一道千禧年大奖难题取得实质性进展

前瞻与传闻

消息称OpenAI在另一道千禧年大奖难题取得实质性进展

博主 Andrew Curran 称,OpenAI 已向《纽约时报》确认,其在 5 天内对另一道千禧年大奖难题取得实质性进展,并正准备公布;相关说法尚未获官方确认。

据 Andrew Curran 转述,OpenAI 正准备公布其在另一道千禧年大奖难题上的进展;该公司据称已向《纽约时报》表示,相关研究在 5 天内取得实质性进展。此前,爆料者 leo 称,OpenAI 已非常接近完成对 Hodge conjecture 的验证,OpenAI 与 Anthropic 中的一家也接近解决 Birch and Swinnerton-Dyer conjecture。这些说法均未得到官方确认,另有用户质疑相关传闻的表述过于模糊。

读原文 →