每日 AI 日报

2026-10-08

来源:橘鸦 AI 早报 · 34 条

2026-10-08
2026-10-08 2026-10-07 2026-10-06 2026-10-05 2026-10-04 2026-10-03 2026-10-02 2026-10-01 2026-09-30 2026-09-29 2026-09-28 2026-09-27

Anthropic 发布 Claude Haiku 5.5:平均成本降约 75%

要闻

Anthropic 发布 Claude Haiku 5.5:平均成本降约 75%

Anthropic 发布 Claude Haiku 5.5,官方称其平均运行成本较 Haiku 4.5 降低约 75%,并同步将 Sonnet 5.5 的 cache reads 价格减半,为 Claude Max 和 Team 订阅用户推出每月 API credit。

Anthropic 在此次发布中推出 Claude Haiku 5.5,并同步调整 Sonnet 5.5 的价格及订阅用户的 API 权益。官方表示,Haiku 5.5 的平均运行成本比 Haiku 4.5 低约 75%;Sonnet 5.5 的 cache reads 价格减半后,多数 agentic 工作的运行成本降低约 20%。新增的每月 API credit 面向 Claude Max 和 Team 订阅用户,用于支持在 Claude Platform 上构建 agents 和应用,原文未列出额度。

据官方说明,Haiku 5.5 面向高调用量、成本敏感的任务,可处理摘要、上下文压缩、数据库查询和分类请求,也可作为 subagent 配合 Opus 5.5 和 Sonnet 5.5 完成 coding 工作。官方称它是其迄今速度最快的模型,适用于实时客服和 browser use 等对速度敏感的场景。它也是首个提供可调 effort 设置的 Haiku 系列模型,用户可选择优先优化成本或智能水平。

读原文 →

OpenAI 向全员推送 GPT-6,上线智能交互界面

要闻

OpenAI 向全员推送 GPT-6,上线智能交互界面

OpenAI 在 ChatGPT 推出 GPT-6 与 Intelligent UI,付费用户发布当天先获更新,Free 和 Go 次日跟进;据官方评测,网页搜索中 Instant 开始回答的时间提前 44%。

OpenAI 在发布当天向 ChatGPT 的 Plus、Pro、Business 和 Enterprise 用户推出 GPT-6 与 Intelligent UI,Free 和 Go 用户于次日获得更新,原文未给出具体日期。此次发布仅调整 Chat 体验,Work 和 Codex 所用模型不变;付费套餐使用 GPT-6 Sol,Free 和 Go 使用 GPT-6 Luna。据官方说明,GPT-6 能在继续思考时逐步输出回答。在其内部评测中,GPT-6 Extra High 开始回答所需时间与 GPT-5.6 Medium 相当,总体成绩高于 GPT-5.6 Extra High;涉及网页搜索时,GPT-6 Instant 平均比 GPT-5.6 Instant 提前 44% 开始回答。

交互层面的更新包括按问题组合文本、图片、图表、按钮、表单和交互组件,以及直接生成计算器、小游戏等任务工具。官方表示,Intelligent UI 采用支持流式输出的原生组件和编译器,界面能够随回答逐步生成,无需等待整段回复完成。模型安全训练也有调整,据其说明,此次加强了针对网络攻击、生物威胁和暴力等高风险滥用的训练。

读原文 →

Codex 昨日按投票重置额度,今日再送手动重置次数

要闻

Codex 昨日按投票重置额度,今日再送手动重置次数

OpenAI Codex 负责人 Tibo 宣布,所有付费账户将再获一次可留待使用的额度重置机会,预计在活动第三天太平洋时间结束前到账;此前,76% 的投票者支持重置,他已确认执行。

OpenAI Codex 负责人 Tibo 在 28 天更新活动第三天宣布,将向所有付费账户再发放一次可留待使用的额度重置机会,预计在太平洋时间当天结束前到账。据其说明,这项安排用于庆祝 GPT-6 登陆 Chat,以及 Codex 和 ChatGPT Work 的活跃用户合计达到 4000 万新高。此前,Tibo 在活动第二天上线四项更新后,就是否重置用量额度发起投票,76% 的投票者选择重置。他随后确认已执行重置,且四项改进全部保留。

读原文 →

Claude Sonnet 5.5 缓存读取价格减半

要闻

Claude Sonnet 5.5 缓存读取价格减半

Anthropic 将 Claude Sonnet 5.5 的缓存读取价格下调 50%,新价格为每百万 tokens 0.10 美元;官方估算,这项调整可使其在大多数长时间运行任务上的运行成本降低约 20%。

Anthropic 宣布将 Claude Sonnet 5.5 的缓存读取价格减半,调整后的价格为每百万 tokens 0.10 美元。此次公布的价格调整针对缓存读取,官方同时给出了这项调整对任务运行成本的估算:在大多数长时间运行任务中,Sonnet 5.5 的运行成本预计降低约 20%。这一成本降幅属于官方估算,适用范围是大多数长时间运行任务,而非所有任务。

读原文 →

Claude 为 Max 和 Team 订阅用户发放月度 API 额度

要闻

Claude 为 Max 和 Team 订阅用户发放月度 API 额度

Claude 的 Max 和 Team 订阅方案包含月度 API 额度,关联 Claude Console organization 后即可领取,无需添加支付方式;Team 全部席位的额度合并计算,每月上限为 500 美元。

Claude 已在 Max 和 Team 订阅方案中提供月度 Claude API 额度,用户需将订阅关联到一个 Claude Console organization 才能领取。官方表示,额度按账单周期发放,年度订阅则按月发放,可用于构建和运行自己的应用与 Agent,且无需向 Claude Platform 添加支付方式。Team 的额度取决于每个账单月开始时的席位配置,首次发放也按这一规则计算:3 个 Standard 席位和 2 个 Premium 席位每月获得 260 美元,增加 1 个 Premium 席位后,次月额度为 360 美元。额度仅限 Claude Platform 使用,不改变 rate limits 和 spend limits 的规则。领取后可在 Console 的 Settings > Billing 下查看 Promotional credits,再创建 API key 发起请求。

读原文 →

谷歌 SynthID 检测网站面向全球用户开放

要闻

谷歌 SynthID 检测网站面向全球用户开放

谷歌将此前仅向媒体专业人士提供的 SynthID Detector 开放给全球用户,目前只有英文版。用户可上传图片、视频或音频检查隐形水印,但检测结果并非 100% 准确。

谷歌宣布,AI 生成内容检测平台 SynthID Detector 已面向全球用户开放,目前提供英文版本,早期版本的使用范围则限于媒体专业人士。平台接受图片、视频和音频文件上传,检查文件是否带有谷歌或 OpenAI、英伟达、Kakao 等合作方的 SynthID 隐形水印,苹果也即将加入支持。据谷歌说明,SynthID 自 2023 年推出以来,已为超过 1800 亿张图片和视频、24 万年的音频内容添加水印;Search、Gemini 应用和 Chrome 内置的验证功能目前每天处理超过 100 万次请求。水印在添加滤镜等编辑后仍可识别,但该工具的检测结果并非 100% 准确。

读原文 →

Claude Code 团队成员推出 html-plan skill,开放试用

开发生态

Claude Code 团队成员推出 html-plan skill,开放试用

Anthropic 的 Claude Code 团队成员 Thariq 已将 html-plan skill 放入社区插件市场供用户试用,用于生成包含代码片段、待澄清问题和 mockup 的 HTML 计划页,并在大范围推出前收集反馈。

Anthropic 的 Claude Code 团队成员 Thariq 在 X 上宣布,自己开发的 html-plan skill 已通过社区插件市场开放安装。用户需先运行 `claude plugin marketplace add anthropics/claude-plugins-community` 添加市场,再运行 `claude plugin install html-plan@claude-community` 安装。据其说明,该 skill 会用简洁语言呈现方案,配合代码片段、待澄清问题和 mockup;配套 lint 机制用于减少 Claude 常见的失败情况,部分规则针对图表和流程图的生成。Thariq 表示,他尤其喜欢调用栈展示和代码片段标注功能,其中调用栈展示借鉴了开发者 @dillon_mulroy 的做法。他希望在大范围推出前收集用户反馈,并将其做成用 HTML 计划替代 Claude Code 默认计划模式的插件。

读原文 →

Claude SDK 内置 computer use 与 browser use 工具集

开发生态

Claude SDK 内置 computer use 与 browser use 工具集

Anthropic 在 GitHub 提供了 Claude computer toolset 的 Python 和 TypeScript 最小示例,通过 VNC 执行桌面操作,驱动实现 10 个工具;该示例用于展示接口,并非生产代码。

Anthropic 在 GitHub 的 claude-quickstarts 仓库中提供了 computer_toolset_20260801 的最小 VNC 示例,支持 Python 和 TypeScript。开发者只需在 tools 中声明一个 toolset 条目,模型就会将 screenshot、left_click、type 等桌面操作分别作为工具调用,由驱动执行。驱动代码有数百行,通过 VNC 的 RFB protocol 操作一个桌面,实现 10 个工具,涵盖截图、点击、鼠标移动、滚动、输入、按键和等待。SDK 提供工具 schema、未实现工具的拒绝处理以及 tool runner。据其说明,这份代码用于展示接口,不是生产代码。

运行安全与调用验证也是示例的一部分。据其说明,屏幕内容会影响模型的后续操作,获得焦点的 terminal 会执行模型输入,因此运行环境应是 sandbox 内可丢弃的桌面。VNC server 不设密码,连接须限制在 localhost,容器端口仅发布至主机 loopback。run 在执行 screenshot 以外的操作前,通过 confirm 要求用户输入 y;exercise 则自动批准调用,无需 API key。exercise 检查 6 次有效调用,并验证屏幕外 1 像素处的 left_click 和未实现的 zoom 均返回 is_error;任一结果不符时,以非零状态退出。

读原文 →

OpenRouter 上线 ElevenLabs 全线语音模型,限时 5 折

开发生态

OpenRouter 上线 ElevenLabs 全线语音模型,限时 5 折

OpenRouter 于 2026 年 10 月 7 日上线 ElevenLabs 的 9 个 Text to Speech 和 2 个 Speech to Text 模型,全部用户可在限时活动中按平台标价的 50% 使用这些模型。

OpenRouter 于 2026 年 10 月 7 日宣布接入 ElevenLabs 的 9 个 Text to Speech 和 2 个 Speech to Text 模型,全部 OpenRouter 用户的 50% 标价折扣持续至 2026 年 10 月 19 日太平洋时间上午 8 点。据官方说明,开发者无需另购 ElevenLabs 套餐,可用 OpenRouter API key 调用 POST /api/v1/audio/speech 和 POST /api/v1/audio/transcriptions。此次上线不包含通过 WebSocket 使用的 Realtime Scribe v2。已有 ElevenLabs 账户的用户可通过 BYOK 添加自己的 key,使用自有 cloned voices、pronunciation dictionaries 及 mp3_44100_192 等更高质量格式。

模型能力和请求限制各有不同。据官方说明,Eleven v4 和 v3 可将 audio tags 作为语气与表达指令处理,单次请求上限分别为 10,000 和 5,000 个字符;Flash v2.5 单次请求最多支持 40,000 个字符。Scribe v2 可输出带时间戳及 speaker 标签的转录,Scribe v2 Medical 针对医学术语进行了 fine-tuning。转录上传上限为 25 MB,约对应 27 分钟的 128 kbps MP3;提供公开 URL 可绕过该上传限制,但长文件仍可能触及 180 秒的上游请求超时。Text to Speech 按输入的 Unicode code points 计费,audio tags 也计入字符数;Scribe 按音频秒数计费,转录响应中的 usage.cost 提供该请求的费用。

读原文 →

GitHub Copilot 开放本地沙箱,混合推理将于月底预览

开发生态

GitHub Copilot 开放本地沙箱,混合推理将于月底预览

GitHub Copilot 将于月底预览本地与云端推理的自动调度,并允许开发者直接选择本地模型。微软表示,设备端 MAI Code 1.1 Flash 的量化版本大小为 53GB,比 Bfloat16 云端版本缩小 80%。

GitHub Copilot 将于月底提供本地与云端推理的自动调度体验,原文未注明具体年月。GitHub Copilot CLI、Copilot app 和 VS Code 将提供两种本地模型使用方式:由 Auto 决定任务使用本地还是云端推理,或由开发者直接指定本地模型。据官方说明,Auto 会在多轮会话中考虑任务上下文与缓存状态,在切换模型时保留可复用的缓存工作。直接选择模式支持通过 Windows ML provider 使用 MAI Code 1.1 Flash,也支持连接 OpenAI-compatible 本地 endpoints,并选择其提供的模型。执行权限另由沙箱约束;Copilot 使用 Windows 团队的开源库 Microsoft Execution Containers(MXC),控制 Agent 启动的进程与本地服务对文件、网络、凭据和系统能力等资源的访问。

本地模型由 Microsoft AI 开发,采用 mixture-of-experts 架构,总参数为 1370 亿,活跃参数为 68 亿,并使用 quantization 和 speculative decoding。微软表示,设备端量化版本大小为 53GB,较 Bfloat16 云端版本缩小 80%。其公布的 Surface Laptop Ultra 首个交付版本数据为:256k context 下峰值内存占用 75.5GB;64k 和 128k context 下,prompt-processing throughput 分别为每秒 923.5 和 769.8 tokens。该设备基于 NVIDIA RTX Spark,最多配备 128 GB unified memory,AI 算力最高为 1 petaflop。原文同时说明,内存还需供操作系统、应用、推理运行时和 key-value cache 使用,模型持续驻留也不能保证响应时间恒定。

读原文 →

微软 MXC 正式可用,为 AI 智能体划定执行权限

开发生态

微软 MXC 正式可用,为 AI 智能体划定执行权限

微软于 2026 年 10 月 7 日宣布 Microsoft Execution Containers(MXC)正式可用,让开发者和 IT 管理员通过策略限定 Agent 的文件与网络访问权限,Windows 365 支持也已正式可用。

微软于 2026 年 10 月 7 日宣布 Microsoft Execution Containers(MXC)及其 Windows 365 支持正式可用。MXC 面向不受信任的代码和动态生成的工作负载,可用于约束模型生成的输出、插件、工具、Agent harness 或整个 Agent。官方表示,开发者和 IT 管理员可以定义工作负载可访问的文件、网络目的地等资源,由 MXC 在运行时通过相应容器执行策略;策略不受 Agent 工作负载控制,Agent 或生成的代码不能自行增加访问权限。

开发者通过统一的 JSON 配置 schema 和多语言 SDK 接入 MXC,由其将所需控制映射到 Windows、macOS 或 Linux 的后端。轻量隔离分别使用 AppContainer、Seatbelt 和 Bubblewrap;session container 与 WSL container 仅支持 Windows 11,MicroVM 支持 Windows 11 和 Linux,仍属实验性功能。官方还表示,Windows 将支持通过 Microsoft Entra 区分 Agent 与用户活动,并将 Microsoft Agent 365 控制扩展至设备上的本地 Agent,使 IT 团队能够管理 MXC 容器、应用策略和监控 Agent 活动,原文未给出这些后续功能的具体上线日期。

读原文 →

Liquid AI 开源决策模型 d1-3B 和 d1-omni-600M

模型发布

Liquid AI 开源决策模型 d1-3B 和 d1-omni-600M

Liquid AI 发布开放权重决策模型 d1-3B 和 d1-omni-600M,均已上线 Hugging Face;官方报告前者在 Decision Index v0.2.1 公开集得分为 48.57,后者为 15.95。

Liquid AI 已在 Hugging Face 发布 d1-3B 和 d1-omni-600M 两款开放权重决策模型,并在发布时提供 llama.cpp 支持。据官方说明,d1 不生成输出 tokens,而是通过一次 forward pass 给出答案。d1-3B 的基础模型由 LFM2.5-2.6B 与 LFM2.5-VL-3B 的文本 backbone 权重平均得到,再经过微调与合并;d1-omni-600M 是实验性 checkpoint,以 LFM2.5-Encoder-350M 为基础,分阶段加入音频和视觉能力,支持文本、图像及音频输入,目前仍在开发中。

官方报告,d1-3B 在 Decision Index v0.2.1 公开集得分为 48.57,与 Decider 35B-A3B 相当;d1-omni-600M 得分为 15.95。在七项公开文本 benchmark 中,两者平均分分别为 82.9 和 78.4。官方以单次一个请求测量 d1-3B 从输入到输出的延迟:单个问题在 NVIDIA GeForce RTX 4090、Jetson AGX Thor、Jetson AGX Orin 和 Jetson Orin Nano 上分别耗时 8 ms、16 ms、26 ms 和 50 ms。本次未报告 Decision Index v0.3 的私有视觉集结果,也未提供 d1-omni-600M 的推理延迟数据。

读原文 →

Perplexity 发布两款多模态嵌入模型

模型发布

Perplexity 发布两款多模态嵌入模型

Perplexity 已在 Hugging Face 公开 pplx-embed-v2-late 的 0.6B 和 9B 两款多模态嵌入模型,支持文本、图像及视觉文档检索,两款模型共享嵌入空间,可跨模型查询索引。

Perplexity 发布的 pplx-embed-v2-late 系列包含 0.6B 和 9B 两款多模态 late-interaction 嵌入模型,目前已在 Hugging Face 公开。两款模型均基于 Qwen3.5,为每个 token 输出一个 128 维向量,使用 MaxSim 打分,支持检索文本、图像和视觉文档,处理 PDF、幻灯片和扫描件无需 OCR。两者由同一个内部 18B ColBERT 教师模型蒸馏而来,共享嵌入空间,因此 0.6B 模型可直接查询由 9B 模型建立的索引。据官方评测,9B 模型在 Q2D-Web 上的 Recall@1000 为 74.8%,nemotron-embed-8b 的对应结果为 69.3%。

读原文 →

生数科技发布旗舰视频模型 Vidu Q4 Preview

模型发布

生数科技发布旗舰视频模型 Vidu Q4 Preview

生数科技发布旗舰音视频模型 Vidu Q4 Preview,已通过网页产品和 API 开放,首发促销价每秒 0.014 美元起。模型支持最多 15 张图像、3 个音频参考,以及 2K、4K 输出。

生数科技于 2026 年 10 月 7 日推出下一代旗舰音视频模型的首个公开预览版 Vidu Q4 Preview,同日通过 Vidu 网页产品和 API 平台提供使用。首发促销价为每秒 0.014 美元起,输出分辨率包括 540p、720p、1080p、2K 和 4K,并支持最多 15 张图像参考、3 个音频参考及 10-bit 色深。官方表示,在可比的输出规格和计费条件下,相同预算可获得最多 5 倍的输出量;最终价格、支持的分辨率、功能可用性和使用条款可能因套餐及地区而异。

据官方说明,该模型着重改善角色表情、情绪、肢体动作与声音的协调,以及镜头运动、剪辑和画面动作之间的配合,同时让爆炸、烟花和粒子等效果更自然地融入场景。其目标用户包括独立创作者、小型工作室及参与叙事和商业项目的制作团队。此次预览版先于完整 Q4 模型发布,供创作者在实际项目中使用;有关表现、创作控制和日常制作需求的反馈将用于后续改进。

读原文 →

马斯克:Grok Bot 不再只用自家模型

产品应用

马斯克:Grok Bot 不再只用自家模型

马斯克宣布,SpaceXAI 旗下 Grok Bot 将不再只使用自研模型,而是按任务选择后端,可调用 Claude Opus 5.5、Midjourney、Suno 等第三方 API,并按问题复杂程度分配模型。

马斯克在 X 平台宣布,SpaceXAI 旗下 Grok Bot 今后将按任务选择后端模型,不再局限于自研的 Grok 系列;原文未提供具体生效日期。据其说明,可调用的第三方 API 包括 Claude Opus 5.5、Midjourney 和 Suno,选择依据是哪个模型最有可能为用户提供最佳结果。他随后补充,简单问题将交由小而快的模型处理,需要复杂答案的问题才会分配给大模型。

读原文 →

Grok Bot 0.68.1 发布:可制作幻灯片、发送格式化邮件

产品应用

Grok Bot 0.68.1 发布:可制作幻灯片、发送格式化邮件

SpaceXAI 发布 Grok Bot 0.68.1,新增幻灯片制作与格式化邮件发送功能,可交付 PowerPoint 文件或 Google Slides,并将电脑操作所用屏幕分辨率从 1280×800 提高到 1920×1200。

SpaceXAI 已发布 Grok Bot 0.68.1,更新涉及幻灯片、邮件和电脑操作。用户可与 Bot 一起制作幻灯片,从其展示的示例中选择,并以 PowerPoint 文件或 Google Slides 形式获取成果。邮件功能支持从草稿卡片发送包含标题、加粗和列表的格式化邮件,也支持搜索 Gmail 垃圾邮件文件夹,将邮件移回收件箱。据其说明,Bot 操作电脑的速度有所提升,使用的屏幕分辨率由 1280×800 改为 1920×1200。一对一聊天中的用户消息会采用该 Bot 的颜色,这项功能要求 Grok Bot 0.64.0 或更高版本;用户可在设置中将强调色设为黑色来关闭。

读原文 →

Grok Bot 现可搜索和读取 X,全员免配置开放

产品应用

Grok Bot 现可搜索和读取 X,全员免配置开放

Grok Bot 官方宣布向所有用户开放 X 内容搜索、读取和监控能力,无需设置 X connector;团队成员还演示了将产品反馈中的功能请求和 bug 报告分流到开发工具的工作流。

Grok Bot 官方宣布,X 内容搜索、读取和监控能力现已对所有用户开放,使用时无需设置 X connector。围绕产品反馈处理,团队成员 lauren 演示了一个工作流:由 Grok Bot 监控 X 上用户对其产品的反馈,将功能请求发送到 issue tracker,再把 bug 报告交给 Cursor cloud agent 或项目进行分类和修复。官方列举的用途还包括跟进突发新闻,以及按周汇总行业动态。

读原文 →

Grok 团队成员:X 平台 @bot 提及功能已上线

产品应用

Grok 团队成员:X 平台 @bot 提及功能已上线

SpaceXAI Grok Bot 团队成员 Larsen Cundric 表示,X 已上线 @bot 提及功能,可将帖子中的指令送入用户的 Grok Bot;使用前须绑定已开通 bots 的 grok.com 账号。

SpaceXAI Grok Bot 团队成员 Larsen Cundric 表示,X 平台的 @bot 提及功能已上线。据其说明,用户须先将 X 账号与已开通 bots 的 grok.com 账号绑定,之后可在回复、帖子或引用中提及 @bot 并附上指令,任务会直接进入用户的 Grok Bot。指令示例包括将内容加入 Notion 阅读清单、提醒日后阅读、总结帖子串,以及代拟回复。

读原文 →

OpenAI 将为 ChatGPT for Teens 推出大学申请规划工具

产品应用

OpenAI 将为 ChatGPT for Teens 推出大学申请规划工具

OpenAI 宣布将为自动适用于未满 18 岁账户的 ChatGPT for Teens 推出 College Planner,整合大学申请与助学金任务,首批服务美国十年级至十二年级、计划就读四年制大学的高中生。

OpenAI 公布了 ChatGPT for Teens 的更新,大学申请规划工具 College Planner 即将上线,具体上线日期未公布。该工具将学校申请要求、截止日期、待办任务和助学金申请步骤汇总为可持续更新的计划。首批适用对象是美国十年级至十二年级、准备申请四年制大学的高中生;据其说明,后续覆盖范围将扩大至更多国家,以及两年制大学、技术学院等。ChatGPT for Teens 自动应用于未满 18 岁的账户。

学习功能方面,iOS 已支持连续拍摄多页内容并合成为 PDF,Android 版本仍在开发,闪卡和更易创建的测验也同步推出。官方表示,青少年平均每天使用不足 15 分钟,一周内近 120 万青少年使用过学习可视化功能,超过 18 万人使用过学习模式。OpenAI 还将支持 College Advising Corps 向新的州扩展并设立 AI 奖学金项目,同时在未来三年支持波士顿儿童医院数字健康实验室的学生咨询委员会。

读原文 →

Codex Cloud 上线即支持 Tailscale

产品应用

Codex Cloud 上线即支持 Tailscale

OpenAI 的 Codex Cloud 上线即支持 Tailscale,后者是目前唯一的 VPN 提供方,双方并未开展合作集成。该功能让云端 Codex 访问 tailnet 内部资源,但仅支持特定连接方式。

OpenAI 在 Codex Cloud 上线时加入了 Tailscale 支持,并正向 ChatGPT Plus 及更高等级的付费账户逐步开放该产品。Codex Cloud 可在不绑定特定设备的环境中处理 GitHub 仓库,接入 Tailscale 后也能访问 tailnet 中的内部 API 和测试服务。据 Tailscale 说明,双方没有合作协议、定制 API 或集成项目,OpenAI 使用的是向所有用户提供的 Tailscale;目前它也是 Codex Cloud 唯一支持的 VPN 提供方。

配置入口位于云环境的 Advanced > VPN 设置,用户需在 Tailscale 管理控制台生成 auth key。OpenAI 的说明要求启用 Reusable 和 Ephemeral,并为 key 添加标签,使 Codex VM 以 tag:codex 加入网络并适用对应规则,而非继承生成 key 的用户权限。目前可访问 HTTP、HTTPS,以及通过 proxy:8088 上的 HTTP CONNECT 连接的任意 TCP 目标。Private IPv4 subnet routes 受支持,但必须使用 IPv4 地址或解析到 IPv4 的主机名;MagicDNS、split DNS、UDP、ICMP、入站连接、SSH 和 Tailscale SSH 均不受支持。Tailscale 表示,默认情况下 Codex 可访问 tailnet 中几乎所有资源。

读原文 →

Google推出实验性游戏生成平台Playground

产品应用

Google推出实验性游戏生成平台Playground

Google 已向美国 18 岁及以上用户推出实验性游戏生成平台 Playground,支持通过文字创建、试玩和分享游戏。创作权限将按 Google AI 订阅分层开放,Unity Spark 集成尚未上线。

Google 已在 playground.google 向美国 18 岁及以上用户推出 Playground,创作权限将依据 Google AI 订阅分层开放。据官方说明,该实验性平台无需编程经验,用户可通过对话界面输入文字,从空白项目、起始提示词或引导支持开始制作游戏,并立即测试,也可调整物理机制、规则、角色和环境。平台在浏览器中运行,用户可用手机或笔记本电脑游玩社区游戏。作品可保持私密、通过链接分享,或发布到 Playground Explore 展示区。

社区功能包括游戏内排行榜,以及部分游戏类型的多人游玩。用户通过 Play Games profile 可设置自定义昵称、点赞游戏、参与排名并关注创作者。官方表示,展示区依据玩家评分和游玩活动推荐游戏,所有发布的游戏都须接受符合 Community Guidelines 的安全筛查,并配有用户举报机制。Playground 后续将集成 Unity Spark;据官方说明,该工具提供专业级游戏机制、高保真 3D 能力和 Unity runtime 的灵活性。Unity Spark 目前仍在测试,封闭 beta 即将开放。

读原文 →

谷歌推出 AI Edge Foresight,Mac 端侧 AI 会议助手

产品应用

谷歌推出 AI Edge Foresight,Mac 端侧 AI 会议助手

Google 推出 Mac 端侧会议助手 AI Edge Foresight,使用 EmbeddingGemma 2 和 Gemma 4 处理会议与文件检索。前者拥有 740M 参数,官方表示其可将文本、图像、视频帧和音频映射到统一向量空间。

Google 已推出面向 Mac 的实验性会议助手 Google AI Edge Foresight,原文未注明具体发布日期。据官方说明,该应用由 EmbeddingGemma 2 和 Gemma 4 驱动,在设备本地完成笔记辅助、对话转录与私人文件的索引和检索。它直接接入系统音频和麦克风,可用于任何会议平台,也能完全离线运行。官方表示,Foresight 将文本、音频和视觉数据映射到统一向量空间,以检索个人知识库,敏感数据不会离开设备。Google DeepMind 同时发布的开放权重模型 EmbeddingGemma 2 拥有 740M 参数;据其说明,在 Google Pixel 11 Pro 上,仅文本权重所需的活跃 RAM 最低约为 191MB,完整多模态模型约为 567MB。

围绕同一模型,Google AI Edge Gallery 新增 Instant Media Search 和 Video Moments Finder。前者通过自然语言或示例图像检索本地图片和视频,将媒体向量存入本地 SQLite 数据库,并按 cosine similarity 返回结果;后者无需转录音频或生成中间文本描述,即可定位本地视频中的视觉片段。官方表示,未来数周将通过 ML Kit 在 Android 上提供该模型服务,支持可用设备上的 NPU 加速及自动模型更新。MediaPipe Tasks 正在为 Embedder 和 Semantic Retriever 添加 EmbeddingGemma 2 支持,以封装媒体预处理和数据转换;MediaPipe Decision Task 则可用该模型对图像、文本或音频进行无需 fine-tuning 的端侧分类。

读原文 →

DGX Station 将支持 Windows,可在本地运行万亿参数级模型

产品应用

DGX Station 将支持 Windows,可在本地运行万亿参数级模型

NVIDIA 与 Microsoft 预览了支持 Windows 的 DGX Station,官方称其配备 748GB 内存、最高 20 petaFLOPS 的 FP4 AI 算力,可在本地运行万亿参数级模型,让开发者在 Windows 环境处理大型 AI 工作负载。

NVIDIA 与 Microsoft 在旧金山举行的 Windows AI and Surface 活动上预览了 DGX Station for Windows,将此前运行于 Linux 的 DGX Station 引入 Windows 环境。该设备采用 GB300 Grace Blackwell Ultra Desktop Superchip,提供 748GB 一致性内存和最高 20 petaFLOPS 的 FP4 AI 算力;官方表示,这一配置可在本地运行最高万亿参数级模型。据其说明,开发者和研究人员可在主力机器上完成大型模型的微调与推理,并运行持续在线、直接连接现有 Windows 应用与基础设施的 AI Agent,需要时仍可通过 WSL 使用 Linux AI 工具链。原有部署方式要求企业开发者分别维护处理重型 AI 工作负载的 Linux 环境,以及承载生产力工具、应用和工作流程的 Windows 环境。

读原文 →

Surface Laptop Ultra 开启预售,2599 美元起

产品应用

Surface Laptop Ultra 开启预售,2599 美元起

微软开启 Surface Laptop Ultra 和 Surface RTX Spark Dev Box 预售,其中笔记本起价为 2599 美元。官方表示,两款设备均采用 NVIDIA RTX Spark,支持在本地运行 AI 工作负载。

微软于 2026 年 10 月 7 日开放 Surface Laptop Ultra 和 Surface RTX Spark Dev Box 预售,前者起价为 2599 美元。两款设备均基于 NVIDIA RTX Spark Superchip,统一内存最高为 128 GB。Laptop Ultra 配备最高 6,144 核的 NVIDIA Blackwell RTX GPU 和最高 20 核的 NVIDIA Grace CPU。官方表示,该笔记本可在本地运行超过 120B 参数的 AI 模型,AI 性能最高为 1 petaflop,并支持通过本地模型与 GitHub Copilot 运行 Agent 编码任务。其屏幕为 15 英寸 PixelSense Ultra 触控屏,存储可由用户拆卸。面向桌面开发的 Dev Box 属于 Project Zenith 设备系列,预装工具和环境包括 Visual Studio Code、Git、GitHub CLI、GitHub Copilot、WSL、Python 和 Node。

读原文 →

Windows 上的 Copilot 将能读取本地上下文并代办电脑任务

产品应用

Windows 上的 Copilot 将能读取本地上下文并代办电脑任务

读原文 →

像对同事说话:Claude Code成员谈提示词心得

技术与洞察

像对同事说话:Claude Code成员谈提示词心得

读原文 →

Artificial Analysis 发布音乐模型评测榜单

技术与洞察

Artificial Analysis 发布音乐模型评测榜单

读原文 →

Unsloth:本地4GB显存训练Decision模型

技术与洞察

Unsloth:本地4GB显存训练Decision模型

读原文 →

韩国宣布 35 亿美元前沿 AI 项目,对标中国开源模型

行业动态

读原文 →

Biohub 联合美国能源部、NIH 投 18 亿美元扩建 AI 生物数据计划

行业动态

Biohub 联合美国能源部、NIH 投 18 亿美元扩建 AI 生物数据计划

读原文 →

Google 与 Constellation Energy 签订20年核电采购协议

行业动态

Google 与 Constellation Energy 签订20年核电采购协议

读原文 →

Nous Research获9000万美元B轮融资

行业动态

Nous Research获9000万美元B轮融资

读原文 →

据报道 SpaceX 洽借 400 亿美元采购 Nvidia 芯片

前瞻与传闻

据报道 SpaceX 洽借 400 亿美元采购 Nvidia 芯片

读原文 →

16岁少年照 Claude 指引下山被困,获救援队救出

其他

16岁少年照 Claude 指引下山被困,获救援队救出

读原文 →