每日 AI 日报

2026-08-06

来源:橘鸦 AI 早报 · 19 条

2026-08-06
2026-08-06 2026-08-05 2026-08-04 2026-08-03 2026-08-02 2026-08-01 2026-07-31 2026-07-30 2026-07-29 2026-07-28

DeepSeek 开放平台提示 API 即将涨价,预计涨幅较大

要闻

DeepSeek 开放平台提示 API 即将涨价,预计涨幅较大

DeepSeek在API界面发布提示称,计划于近期整体上调API服务定价,预计涨幅较大。目前具体调价方案尚未公布,官方提醒开发者合理安排使用,并以正式通知为准。

DeepSeek目前已在开放平台API界面发布提示,计划近期整体上调DeepSeek API服务的定价,并预计此次涨幅较大。官方提醒开发者合理安排使用,具体的调价方案与生效时间尚未确定,将以正式通知为准。这一提示引发了社区用户的关注与讨论。

读原文 →

Meta 发布 Muse Code 测试版及 Muse Spark 1.2 模型

要闻

Meta 发布 Muse Code 测试版及 Muse Spark 1.2 模型

Meta 发布了 Muse Code beta版和 Muse Spark 1.2 模型。Muse Code 专为处理大型代码库任务设计,能够规划变更并协调多个持久性 subagent 并行工作。Muse Spark 1.2 基于前代模型面向编程升级,提升了代码生成、复杂调试、代码库理解和端到端开发能力。目前,Muse Code 已开放安装,Muse Spark 1.2 已上线官方API。Meta 还在Muse Code 和 API 中提供价格更低的Contributor档位,性能不变但采集提示词与生成结果用于改进模型。

Meta Superintelligence Labs 正式推出终端编码 Agent Muse Code(beta)及其驱动模型 Muse Spark 1.2。Muse Code 专为处理跨大型代码库的复杂软件工程任务而设计,能够规划变更、编写代码并验证结果,内置 /plan、/grill 和 /goal 等技能。该 Agent 采用模型与 Agent 联合训练机制,可协调多个持久性后台 subagent 并在隔离的 worktree 中并行处理复杂任务,同时通过本地事件日志实现崩溃后的精确恢复。Muse Spark 1.2 提供了全面的编码能力提升,并在 NVIDIA Hopper GPU 内核优化测试中展现了超过 1000 次工具调用的长期改进能力。Muse Code 可通过一行命令在 macOS 和 Linux 上安装,Muse Spark 1.2 可通过 Meta Model API 获取。Meta 还在Muse Code 和 API 中提供价格更低的Contributor档位,性能不变但采集提示词与生成结果用于改进模型。

读原文 →

Google宣布重组AI领导层:Demis Hassabis转任Alphabet首席科学家

要闻

Google宣布重组AI领导层:Demis Hassabis转任Alphabet首席科学家

Google宣布重组AI管理层,Demis Hassabis卸任DeepMind CEO,转任Alphabet首席科学家专注AGI突破;原CTO Koray Kavukcuoglu晋升高级副总裁,负责Gemini模型研发。

Google及Alphabet CEO Sundar Pichai通过官方博客宣布了Google DeepMind团队的重大领导层变动。Demis Hassabis卸任日常管理职务,正式转任Google DeepMind主席与Alphabet首席科学家,以便专注于AGI战略及科学突破,他将继续领导AI制药公司Isomorphic Labs。原DeepMind首席技术官Koray Kavukcuoglu晋升为Google DeepMind高级副总裁,直接向Pichai汇报,全面负责Gemini模型开发、前沿研究及应用团队。

读原文 →

Jeff Dean等多名Google核心研究员离职,创立AI新公司Discovery Loop

要闻

Jeff Dean等多名Google核心研究员离职,创立AI新公司Discovery Loop

Jeff Dean等多名Google资深研究员宣布离开Google,共同创立公共福利公司Discovery Loop。该公司旨在通过自动化机器学习、科学与工程的实验循环来加速科学发现。

Jeff Dean与Sanjay Ghemawat、Quoc Le及Oriol Vinyals等Google核心研究员宣布离职,共同创立名为Discovery Loop的公共福利公司。据报道,Jeff Dean将出任该公司的CEO。Discovery Loop致力于利用先进AI系统自动执行实验循环,从而大幅提升机器学习、科学和工程领域的研究速度与效率。目前公司已获得Google母公司Alphabet作为创始投资者和云合作伙伴的支持,首轮融资源由Radical Ventures和Khosla Ventures共同领投。

读原文 →

Cloudflare 开源 AI “操作系统” Cloudflare OS

开发生态

Cloudflare 开源 AI “操作系统” Cloudflare OS

Cloudflare 开源了 Cloudflare OS,这是一个面向企业的开源 AI “操作系统”平台,为组织中每个人提供基于公司上下文和技能的 Agent 工作区。

Cloudflare 发布了开源的 Cloudflare OS 平台,为企业中的每个人提供 Agent 工作区,用于构建应用、自动化工作流程和安全访问内部系统。平台包含三个核心部分:基于公司上下文和技能的 Agent 工作区、用于安全访问内部数据和服务的治理框架,以及可构建、分享和持续修改的个人应用平台。Cloudflare OS 运行在 Cloudflare Workers 上,通过 Cloudflare Access 控制访问权限,通过 AI Gateway 管理模型路由和支出,每个 Agent 和应用默认无任何访问权限,由 Gatekeepers 服务统一管控资源授权。Cloudflare 曾于今年五月在内部部署第一版供员工使用,新版本现已开源并上线 GitHub,组织可部署至自己的 Cloudflare 账户进行定制。

读原文 →

Prime Intellect 推出开源自我改进 Agent 框架 Prime Agent

开发生态

Prime Intellect 推出开源自我改进 Agent 框架 Prime Agent

Prime Intellect推出开源自我改进框架Prime Agent。它基于递归语言模型和连续环境,让Agent将上下文当变量实现自我改进。

Prime Intellect 推出了名为 Prime Agent 的开源 Agent 框架,专为编码和长时间运行的自主任务设计。该框架基于递归语言模型和连续环境两种核心抽象构建,允许模型将上下文作为变量处理,并在 REPL 中进行程序化工具调用和子 Agent 派发。官方数据显示,在使用 Opus 5 模型时,Prime Agent 在 ARC-AGI-3 测试中获得了 95.5% 的得分,超过了报告的人类专家基线。该框架已在 GitHub 上完全开源。

读原文 →

Command Code 推出 GOAT plan:每月 10 美元获 70 美元额度

开发生态

Command Code 推出 GOAT plan:每月 10 美元获 70 美元额度

Command Code 推出 GOAT plan,用户每月支付 10 美元即可获得 70 美元的额度。该订阅方案支持 30 多款开源与闭源模型,并提供全球范围访问。

Command Code 目前推出了全新的 GOAT plan(订阅方案),旨在为用户提供高性价比的编程服务。用户每月支付 10 美元即可获得 70 美元的额度,支持在 30 多款主流开源与闭源模型间随时切换。该订阅方案设有具体的使用上限,如每 5 小时限额 14 美元和每月限额 70 美元,且可用额度会根据所选模型的价格动态调整。GOAT plan 目前向全球用户开放,支持通过 Command Code CLI 或 Provider API 接入,且大部分模型默认提供零数据留存选项。

读原文 →

魔搭社区上线魔粒体系以替代每日固定免费次数

开发生态

魔搭社区上线魔粒体系以替代每日固定免费次数

魔搭社区将API-Inference等服务的每日固定免费次数更改为消耗额度“魔粒”。目前用户需每日登录获取魔粒以兑换模型调用额度。

魔搭社区调整了API-Inference等服务的使用机制,由每日固定免费次数转变为消耗虚拟额度“魔粒”。用户需通过每日登录、绑定阿里云账号或参与社区贡献来获取魔粒。魔粒分为生效24小时的短期魔粒和生效90天的长期魔粒,系统消耗时会优先扣减最临近过期的额度。使用API-Inference调用模型时,轻量、主流和旗舰模型分别每次平均消耗0.5、1和2个魔粒。此外,该服务要求用户必须绑定阿里云账号并完成实名认证。

读原文 →

美团 LongCat-2.0 模型免费上线 OpenCode 平台

开发生态

美团 LongCat-2.0 模型免费上线 OpenCode 平台

美团旗下 LongCat-2.0 模型目前已在 OpenCode 平台上免费开放使用。但官方未说明免费政策的持续时长及用量限制等具体细节。

美团旗下 LongCat 团队宣布,LongCat-2.0 模型现已免费上线 OpenCode 平台。据 OpenCode 官方介绍,LongCat-2.0 支持 100 万 token 上下文窗口,采用完全开源模式,定位为美团针对编程代码场景优化的最新模型。目前,用户可在 OpenCode 平台上免费使用该模型,但官方未说明免费政策的持续时长及 token 用量限制等具体细节。

读原文 →

千问图像模型Qwen-Image-3.0正式上线API

模型发布

千问图像模型Qwen-Image-3.0正式上线API

阿里千问宣布正式上线Qwen-Image-3.0模型的API,含标准版和Pro版。官方称该模型Pro版在权威国际评测平台榜单中位列国内第一,目前目前用户可在千问AI平台接入使用。

阿里巴巴千问图像生成模型Qwen-Image-3.0目前正式上线千问AI平台,向所有用户开放API。该模型包含旗舰版Pro和标准版Standard,支持4.5k token长指令输入与12国语言原生渲染,能够处理报纸、试卷等复杂版面。官方称其内置世界知识并支持联网获取信息,旗舰版Pro版在国际评测平台Arena.ai最新文生图榜单中位列国内第一,文生图起价为0.18元/张。海外用户目前可通过Qwen Cloud接入体验。

读原文 →

字节跳动Seed推出原生音视频全双工大模型 SeedRealtime

模型发布

字节跳动Seed推出原生音视频全双工大模型 SeedRealtime

字节跳动Seed正式推出原生音视频全双工大模型 SeedRealtime,目前已在豆包 App 全量上线。该模型通过统一架构融合音频、视频与文本,实现了“边看、边听、边说”的实时交互。

字节跳动Seed正式推出原生音视频全双工大模型 SeedRealtime。该模型采用统一架构原生融合音频、视频与文本,在连续的多模态信息流上进行实时交互,感知、理解、决策与表达同步进行。根据官方端到端人工评测,相比级联模型,SeedRealtime 的对话节奏问题减少了一半,打断、迟滞和误触发等现象显著减少。目前,用户将豆包 App 更新至最新版本后,即可在视频通话界面体验该模型。

读原文 →

Sand.ai 发布开源 114B 参数音视频模型 MAGI-2 Preview

模型发布

Sand.ai 发布开源 114B 参数音视频模型 MAGI-2 Preview

Sand.ai 正式发布并开源了音视频生成模型 MAGI-2 Preview。该模型拥有 114B 总参数,单 token 仅激活约 6B 参数,支持生成 10 秒时长的 1080p 音视频片段。

Sand.ai 正式发布并开源了统一音视频生成模型 MAGI-2 Preview。该模型总参数量约为 114B,但单次前向计算每个 token 仅激活约 6B 参数,采用单流架构实现文本、视频和音频的联合建模。在生成功能上,MAGI-2 Preview 目前仅支持生成时长为 10 秒、分辨率达 1080p 的视频片段并附带声音。此外,运行该模型的硬件门槛较高,需要配备 8 张 NVIDIA Hopper GPU。

读原文 →

京东开源实时视频编辑系统 JoyAI-Video-Edit

模型发布

京东开源实时视频编辑系统 JoyAI-Video-Edit

京东近期开源了实时视频编辑系统 JoyAI-Video-Edit 的部署代码、在线demo与模型权重。该系统支持流式实时编辑,在 720p 分辨率下端到端可达 30.19 FPS。

京东 jd-opensource 发布了实时、基于指令引导的视频编辑系统 JoyAI-Video-Edit 的部署代码、技术报告、在线 demo 以及模型权重。该系统可针对直播流或上传视频进行因果帧处理,无需等待完整视频即可实现实时编辑。根据官方基准测试数据,其完整端到端流水线在 720x1280 分辨率下可达到 30.19 FPS 的吞吐量。模型权重采用 Apache 2.0 许可证发布,但目前尚无 Inference Provider 提供官方托管服务。

读原文 →

小米开源机器人模型 Xiaomi-Robotics-1 代码与检查点

模型发布

小米开源机器人模型 Xiaomi-Robotics-1 代码与检查点

小米目前已开源机器人基础模型 Xiaomi-Robotics-1 的代码与检查点。该视觉-语言-动作模型基于超过 10 万小时真实轨迹训练,在多项模拟基准测试中达到当前最优表现。

小米通过 GitHub 和 Hugging Face 等平台开源了机器人基础模型 Xiaomi-Robotics-1(XR-1)的代码与检查点,包含后训练、推理及基准评估工具。该视觉-语言-动作(VLA)模型结合了预训练的 Qwen3-VL 与 Diffusion-Transformer,采用了包含预训练和后训练的两阶段训练范式。目前,该模型采用 Apache 2.0 协议开源,支持开发者进行自定义微调与实时部署。

读原文 →

Google Labs 将 Dreambeans 应用扩展至美国 AI Pro 订阅用户

产品应用

Google Labs 将 Dreambeans 应用扩展至美国 AI Pro 订阅用户

Google Labs将实验性应用Dreambeans开放给美国AI Pro订阅用户,此前仅限AI Ultra用户。该应用靠Personal Intelligence连接用户的Google应用,每天推送个性化故事集合,呈现可能错过的深度内容与相关主题。

Google Labs 宣布将实验性移动应用 Dreambeans 的可用范围扩展至美国的 AI Pro 订阅用户。Dreambeans 使用 Personal Intelligence 连接用户的 Google 应用,每天提供个性化的故事集合,呈现用户可能会错过的深度内容和相关主题。目前,美国的 AI Ultra 和 AI Pro 订阅用户均可使用该应用。

读原文 →

Visa 宣布以 24 亿美元收购反欺诈公司 BioCatch

行业动态

Visa 宣布以 24 亿美元收购反欺诈公司 BioCatch

Visa 宣布已签署最终协议,将以 24 亿美元现金收购行为反欺诈提供商 BioCatch。此次收购旨在整合 BioCatch 的行为与设备智能技术,帮助金融机构客户在支付发生前检测并防范账户接管、骗局和数字欺诈。

Visa 签署了以 24 亿美元现金收购 BioCatch 的最终协议,资金将支付给 Permira 顾问基金及其他股东。BioCatch 是一家提供基于行为和多信号的欺诈智能供应商,其 AI 技术通过分析数千种行为和设备信号来实时区分合法用户与欺诈者。Visa 预期此次收购将补充其现有的网络、欺诈和安全解决方案,帮助客户应对由 AI 驱动的日益增长的账户接管和数字欺诈威胁。

读原文 →

Meta发文介绍多阶段广告排序架构,官方称转化率提升6%

技术与洞察

Meta发文介绍多阶段广告排序架构,官方称转化率提升6%

Meta发文介绍了用于广告排序的多阶段序列模型架构,该架构将离线用户建模与在线排序解耦以提升计算效率。官方称,这一技术使Instagram转化率提升6%,并展现出类似大语言模型的可预测扩展定律。

Meta介绍了其用于广告排序的多阶段序列模型架构,该架构通过将离线用户建模与在线排序解耦来实现高效扩展。官方称,该技术及相关模型创新已在生产环境中应用,促使Instagram转化率累计提升6%,Facebook转化率提升3%,Facebook广告点击率提升3.5%。这一架构是Meta生成式广告推荐模型(GEM)的核心组件,并在真实流量中展现出类似大语言模型的可预测扩展定律,且目前未显示出饱和迹象。

读原文 →

消息称字节跳动不使用蒸馏技术追赶竞争对手

前瞻与传闻

据报道,字节跳动创始人在内部会议上要求公司不使用蒸馏技术追赶竞争对手。报道称,此举是为了避免引发审查,即便这意味着字节跳动在短期内可能落后于国内同行。

据The Information报道,字节跳动创始人在内部AI团队全员大会上明确要求,公司不使用蒸馏技术提升AI模型能力,即便短期内落后于国内竞争对手。报道称,该决定的主要原因是避免给旗下应用TikTok招致新一轮审查。该创始人向员工表示,公司应该愿意为长远目标牺牲短期利益。

读原文 →

消息称 DeepSeek 重启第二轮融资,投前估值约 5000 亿元

前瞻与传闻

消息称 DeepSeek 重启第二轮融资,投前估值约 5000 亿元

据报道,DeepSeek 已重启第二轮融资,计划募资 500 亿元。多名交易人士透露,该轮融资的投前估值约为 5000 亿元,预计将于 8 月下旬完成签约。

据《财经》报道,多名交易人士透露,大模型公司 DeepSeek 已重启第二轮融资。本轮计划募资 500 亿元,投前估值约为 5000 亿元,计划将在 8 月下旬完成签约。交易人士表示,DeepSeek 与投资人们希望此次融资在重启后能够低调进行。

提示:内容由AI辅助创作,可能存在幻觉和错误。

读原文 →