デイリー AI ニュース

2026-08-06

出典:橘鸦 AI 早报 · 19 件

2026-08-06
2026-08-06 2026-08-05 2026-08-04 2026-08-03 2026-08-02 2026-08-01 2026-07-31 2026-07-30 2026-07-29 2026-07-28

DeepSeek オープンプラットフォーム、API価格の大幅値上げを予告

要闻

DeepSeek オープンプラットフォーム、API価格の大幅値上げを予告

DeepSeekはAPIインターフェースで、近期にAPIサービス価格を全面的に引き上げる予定で、上昇幅は大きい見込みと発表した。現在具体的な価格改定案は未公表で、公式は開発者に合理的な利用を促し、正式な通知を基準とするよう注意を呼びかけている。

DeepSeekは現在、オープンプラットフォームのAPIインターフェースに通知を掲載し、近くDeepSeek APIサービスの価格を全体的に引き上げる計画であり、今回の値上げ幅はかなり大きくなる見込みであることを発表しました。公式は開発者に対し、計画的に利用するよう注意を促しており、具体的な値上げ方案と実施時期は未確定で、正式な通知をもって最終決定となります。この通知はコミュニティユーザーの関心と議論を呼んでいます。

原文を読む →

Meta、Muse Code ベータ版と Muse Spark 1.2 モデルを公開

要闻

Meta、Muse Code ベータ版と Muse Spark 1.2 モデルを公開

MetaはMuse Codeベータ版とMuse Spark 1.2モデルを公開した。Muse Codeは大規模コードベースのタスク処理に特化して設計されており、変更を計画し、複数の永続的なサブエージェントを調整して並行作業させることができる。Muse Spark 1.2は前世代モデルを基にプログラミング向けにアップグレードされ、コード生成、複雑なデバッグ、コードベース理解、エンドツーエンドの開発能力が向上した。現在、Muse Codeはインストールが開放され、Muse Spark 1.2は公式APIで利用可能。MetaはMuse CodeとAPIでも…

Meta Superintelligence Labsは、ターミナル向けコーディングエージェント「Muse Code(ベータ版)」とその駆動モデル「Muse Spark 1.2」を正式に発表しました。Muse Codeは、大規模なコードベースにまたがる複雑なソフトウェアエンジニアリングタスクを処理するために設計されており、変更の計画、コードの記述、結果の検証が可能で、/plan、/grill、/goalなどのスキルを内蔵しています。このエージェントは、モデルとエージェントの共同トレーニングメカニズムを採用し、複数の永続的なバックグラウンドサブエージェントを調整し、隔離されたワークツリーで複雑なタスクを並行処理できる一方、ローカルイベントログによるクラッシュ後の正確なリカバリを実現します。Muse Spark 1.2は包括的なコーディング能力の向上を提供し、NVIDIA Hopper GPUカーネル最適化テストにおいて、1000回以上のツール呼び出しにわたる長期的な改善能力を示しました。Muse CodeはmacOSとLinux上でワンライナーコマンドによりインストールでき、Muse Spark 1.2はMeta Model APIを通じて利用できます。Metaはまた、Muse CodeとAPIに、性能は変わらずにプロンプトと生成結果を収集してモデル改善に役立てる、より低価格のContributorティアを提供しています。

原文を読む →

Google、AI指導部を再編:Demis Hassabis氏はAlphabetの最高科学責任者に

要闻

Google、AI指導部を再編:Demis Hassabis氏はAlphabetの最高科学責任者に

GoogleはAI経営陣の再編を発表し、Demis Hassabis氏はDeepMindのCEOを退任し、Alphabetの最高科学責任者に就任してAGIの画期的進歩に注力。元CTOのKoray Kavukcuoglu氏は上級副社長に昇進し、Geminiモデルの研究開発を担当する。

GoogleおよびAlphabetのCEOであるSundar Pichai氏は、公式ブログを通じてGoogle DeepMindチームの重要なリーダーシップ変更を発表しました。Demis Hassabis氏は日常の管理業務を退き、正式にGoogle DeepMindの会長兼Alphabetの最高科学責任者に就任し、AGI戦略と科学的ブレークスルーに注力します。同氏は引き続きAI創薬企業Isomorphic Labsを率います。元DeepMindの最高技術責任者であるKoray Kavukcuoglu氏は、Google DeepMindの上級副社長に昇進し、Pichai氏に直接報告し、Geminiモデルの開発、最先端研究、およびアプリケーションチーム全体を担当します。

原文を読む →

Jeff Dean氏らGoogleの主要研究者が退社し、AI新会社Discovery Loopを設立

要闻

Jeff Dean氏らGoogleの主要研究者が退社し、AI新会社Discovery Loopを設立

Jeff Dean氏ら複数のGoogleの上級研究者がGoogleを退社し、公共福祉会社Discovery Loopを共同設立した。同社は自動機械学習と科学・工学の実験ループを通じて科学的発見を加速することを目指している。

Jeff Dean氏はSanjay Ghemawat氏、Quoc Le氏、Oriol Vinyals氏らGoogleの核心研究者とともに退職を発表し、共同で「Discovery Loop」という公共福利会社を設立しました。報道によると、Jeff Dean氏が同社のCEOに就任する予定です。Discovery Loopは、高度なAIシステムを利用して実験サイクルを自動実行し、機械学習、科学、エンジニアリング分野の研究速度と効率を大幅に向上させることを目指しています。現在、同社はGoogleの親会社であるAlphabetを創業投資家およびクラウドパートナーとして支援を受けており、初回の資金調達ラウンドはRadical VenturesとKhosla Venturesが共同でリードしました。

原文を読む →

Cloudflare、オープンソースAI「OS」Cloudflare OSを公開

开发生态

Cloudflare、オープンソースAI「OS」Cloudflare OSを公開

Cloudflareは、エンタープライズ向けのオープンソースAI「オペレーティングシステム」プラットフォームであるCloudflare OSを公開した。組織内の全員に、企業の文脈とスキルに基づいたエージェントワークスペースを提供する。

Cloudflareは、社内の全員にエージェントワークスペースを提供し、アプリの構築、ワークフローの自動化、内部システムへの安全なアクセスを可能にするオープンソースのCloudflare OSプラットフォームを発表しました。このプラットフォームは、企業のコンテキストとスキルに基づくエージェントワークスペース、内部データやサービスへの安全なアクセスのためのガバナンスフレームワーク、そしてアプリを構築・共有・継続的に修正できるパーソナルアプリプラットフォームの3つの中核部分で構成されています。Cloudflare OSはCloudflare Workers上で動作し、Cloudflare Accessでアクセス権限を制御し、AI Gatewayでモデルルーティングと支出を管理します。各エージェントとアプリはデフォルトでいかなるアクセス権も持たず、Gatekeepersサービスがリソースの承認を一元的に管理します。Cloudflareは今年5月に社内で最初のバージョンを従業員向けに展開しており、新バージョンはオープンソース化されGitHubで公開され、組織は自分のCloudflareアカウントにデプロイしてカスタマイズできます。

原文を読む →

Prime Intellect、オープンソースの自己改善エージェントフレームワークPrime Agentを発表

开发生态

Prime Intellect、オープンソースの自己改善エージェントフレームワークPrime Agentを発表

Prime Intellectは、オープンソースの自己改善フレームワークPrime Agentを発表した。これは再帰的言語モデルと連続環境に基づき、エージェントがコンテキストを変数として自己改善を実現する。

Prime Intellectは、Prime Agentという名前のオープンソースのAgentフレームワークを発表しました。これはコーディングと長時間実行される自律タスク向けに設計されています。このフレームワークは、再帰的言語モデルと連続環境という2つのコア抽象化に基づいて構築されており、モデルがコンテキストを変数として扱い、REPLでプログラム的なツール呼び出しと子Agentのディスパッチを行うことを可能にします。公式データによると、Opus 5モデルを使用した場合、Prime AgentはARC-AGI-3テストで95.5%のスコアを獲得し、報告されている人間の専門家のベースラインを上回りました。このフレームワークはGitHubで完全にオープンソース化されています。

原文を読む →

Command Code、GOATプランを発表:月10ドルで70ドル分のクレジット

开发生态

Command Code、GOATプランを発表:月10ドルで70ドル分のクレジット

Command CodeはGOATプランを発表した。ユーザーは毎月10ドルを支払うと70ドル分のクレジットを受け取れる。このサブスクリプションプランは30以上のオープンソースおよびクローズドソースモデルをサポートし、世界中からアクセス可能。

Command Codeは現在、新しいGOATプラン(サブスクリプションプラン)を開始し、ユーザーに高コストパフォーマンスのプログラミングサービスを提供することを目指しています。ユーザーは毎月10ドルを支払うことで70ドル分のクレジットを取得でき、30以上の主要なオープンソースおよびクローズドソースのモデルをいつでも切り替えることができます。このサブスクリプションプランには具体的な利用上限があり、例えば5時間ごとに14ドル、月間70ドルの制限があり、利用可能なクレジットは選択したモデルの価格に応じて動的に調整されます。GOATプランは現在世界中のユーザーに開放されており、Command Code CLIまたはProvider APIを介してアクセスでき、ほとんどのモデルでデフォルトでゼロデータ保持オプションが提供されています。

原文を読む →

ModelScopeコミュニティ、毎日の固定無料回数を置き換える「魔粒」システムを導入

开发生态

ModelScopeコミュニティ、毎日の固定無料回数を置き換える「魔粒」システムを導入

ModelScopeコミュニティは、API-Inferenceなどのサービスの毎日の固定無料回数を、消費型クレジット「魔粒」に変更した。現在、ユーザーは毎日ログインして魔粒を取得し、モデル呼び出しのクォータと交換する必要がある。

魔搭社区は、API-Inferenceなどのサービスの利用メカニズムを調整し、毎日の固定無料回数から仮想クレジット「魔粒」を消費する方式に変更しました。ユーザーは毎日のログイン、Alibaba Cloudアカウントの連携、またはコミュニティへの貢献によって魔粒を取得する必要があります。魔粒は、24時間有効な短期魔粒と90日間有効な長期魔粒に分かれており、システムは消費時に最も期限が近いクレジットを優先的に差し引きます。API-Inferenceを使用してモデルを呼び出す場合、軽量、主流、フラッグシップモデルはそれぞれ平均0.5、1、2個の魔粒を消費します。さらに、このサービスではユーザーがAlibaba Cloudアカウントを連携し、実名認証を完了する必要があります。

原文を読む →

美团(Meituan)のLongCat-2.0モデルがOpenCodeプラットフォームで無料公開

开发生态

美团(Meituan)のLongCat-2.0モデルがOpenCodeプラットフォームで無料公開

美团傘下のLongCat-2.0モデルが現在、OpenCodeプラットフォームで無料開放されている。ただし、公式は無料ポリシーの期間や利用制限などの詳細を明らかにしていない。

美団傘下のLongCatチームは、LongCat-2.0モデルが現在OpenCodeプラットフォームで無料で利用可能になったと発表しました。OpenCode公式の紹介によると、LongCat-2.0は100万トークンのコンテキストウィンドウをサポートし、完全なオープンソースモデルを採用しており、美団がプログラミングコードシナリオ向けに最適化した最新モデルとして位置づけられています。現在、ユーザーはOpenCodeプラットフォームでこのモデルを無料で利用できますが、公式は無料ポリシーの期間やトークン使用量の制限などの具体的な詳細は明らかにしていません。

原文を読む →

Qwen画像モデル Qwen-Image-3.0 が正式にAPIで提供開始

模型发布

Qwen画像モデル Qwen-Image-3.0 が正式にAPIで提供開始

阿里千问はQwen-Image-3.0モデルのAPIを正式に公開した。標準版とPro版を含む。公式によると、Pro版は権威ある国際ベンチマークリストで中国国内1位を獲得しており、現在ユーザーは千问AIプラットフォームで利用できる。

阿里巴巴の千問画像生成モデルQwen-Image-3.0が正式に千問AIプラットフォームに登場し、すべてのユーザーにAPIを開放しました。このモデルにはフラッグシップ版のProと標準版のStandardが含まれており、4.5kトークンの長い指示入力と12言語のネイティブレンダリングをサポートし、新聞、試験用紙などの複雑なレイアウトを処理できます。公式によると、世界知識が組み込まれており、ネットワーク接続による情報取得もサポートしています。フラッグシップ版のProは、国際的な評価プラットフォームArena.aiの最新のテキストから画像生成ランキングで国内1位を獲得しており、テキストから画像生成の開始価格は1枚あたり0.18元です。海外ユーザーは現在、Qwen Cloudを通じて体験できます。

原文を読む →

ByteDance Seed、ネイティブ音声・ビデオ全二重大規模モデル SeedRealtime を発表

模型发布

ByteDance Seed、ネイティブ音声・ビデオ全二重大規模モデル SeedRealtime を発表

ByteDance Seedは、ネイティブな音声・ビデオ全二重大規模モデル SeedRealtime を正式に発表し、現在Doubaoアプリで全面提供開始。このモデルは統合アーキテクチャで音声、ビデオ、テキストを融合し、「見ながら、聞きながら、話す」リアルタイムインタラクションを実現する。

ByteDance Seedは、ネイティブ音声・ビデオ全二重大規模モデル「SeedRealtime」を正式に発表しました。このモデルは統合アーキテクチャを採用し、音声・ビデオ・テキストをネイティブに融合し、連続的なマルチモーダル情報ストリーム上でリアルタイムにインタラクションし、知覚、理解、決定、表現を同時に行います。公式のエンドツーエンド人為評価によると、カスケードモデルと比較して、SeedRealtimeの対話リズム問題は半分に減少し、割り込み、遅延、誤発火などの現象が大幅に減少しました。現在、ユーザーはDoubaoアプリを最新版に更新すると、ビデオ通話インターフェースでこのモデルを体験できます。

原文を読む →

Sand.ai、オープンソースの114Bパラメータ音声・ビデオモデル MAGI-2 Preview を公開

模型发布

Sand.ai、オープンソースの114Bパラメータ音声・ビデオモデル MAGI-2 Preview を公開

Sand.aiは、音声・ビデオ生成モデル MAGI-2 Preview を正式に公開し、オープンソース化した。このモデルは総パラメータ114B、単一トークンで約6Bパラメータのみを活性化し、10秒間の1080p音声・ビデオクリップの生成をサポートする。

Sand.aiは、統一音声・ビデオ生成モデル「MAGI-2 Preview」を正式に発表し、オープンソース化しました。このモデルの総パラメータ数は約114Bですが、単回の前方計算で各トークンは約6Bのパラメータのみをアクティブ化し、単一ストリームアーキテクチャを採用してテキスト、ビデオ、オーディオの共同モデリングを実現しています。生成機能において、MAGI-2 Previewは現在、長さ10秒、解像度1080pのビデオクリップとそれに付随する音声の生成のみをサポートしています。また、このモデルを実行するためのハードウェア要件は高く、8枚のNVIDIA Hopper GPUが必要です。

原文を読む →

JD.com、リアルタイムビデオ編集システム JoyAI-Video-Edit をオープンソース化

模型发布

JD.com、リアルタイムビデオ編集システム JoyAI-Video-Edit をオープンソース化

JD.comは最近、リアルタイムビデオ編集システム JoyAI-Video-Edit のデプロイコード、オンラインデモ、モデルウェイトを公開した。このシステムはストリーミングリアルタイム編集をサポートし、720p解像度でエンドツーエンド30.19 FPSを達成する。

JD.comのjd-opensourceは、リアルタイムで指示ベースのビデオ編集システム「JoyAI-Video-Edit」のデプロイコード、技術レポート、オンラインデモ、モデル重みを公開しました。このシステムは、ライブストリームやアップロードされたビデオに対して因果フレーム処理を実行でき、完全なビデオを待たずにリアルタイム編集を実現します。公式ベンチマークデータによると、その完全なエンドツーエンドパイプラインは720x1280解像度で30.19 FPSのスループットを達成できます。モデル重みはApache 2.0ライセンスで公開されていますが、現在、公式ホスティングサービスを提供するInference Providerはありません。

原文を読む →

Xiaomi、ロボットモデル Xiaomi-Robotics-1 のコードとチェックポイントをオープンソース化

模型发布

Xiaomi、ロボットモデル Xiaomi-Robotics-1 のコードとチェックポイントをオープンソース化

Xiaomiは現在、ロボット基盤モデル Xiaomi-Robotics-1 のコードとチェックポイントを公開している。この視覚・言語・動作モデルは10万時間以上の実軌道データで訓練され、複数のシミュレーションベンチマークで最先端の性能を達成している。

Xiaomiは、GitHubやHugging Faceなどのプラットフォームを通じて、ロボット基礎モデル「Xiaomi-Robotics-1(XR-1)」のコードとチェックポイントをオープンソース化しました。これには、後訓練、推論、ベンチマーク評価ツールが含まれています。この視覚-言語-動作(VLA)モデルは、事前学習済みのQwen3-VLとDiffusion-Transformerを組み合わせ、事前学習と後学習の2段階訓練パラダイムを採用しています。現在、このモデルはApache 2.0プロトコルでオープンソース化されており、開発者はカスタムファインチューニングとリアルタイムデプロイをサポートしています。

原文を読む →

Google Labs、DreambeansアプリをアメリカのAI Proサブスクライバーに拡大

产品应用

Google Labs、DreambeansアプリをアメリカのAI Proサブスクライバーに拡大

Google Labsは実験的アプリDreambeansをアメリカのAI Proサブスクライバーに開放した。以前はAI Ultraユーザーのみが利用可能だった。このアプリはPersonal Intelligence機能でユーザーのGoogleアプリに接続し、毎日パーソナライズされたストーリー集をプッシュして、見逃しているかもしれない深いコンテンツや関連トピックを提示する。

Google Labsは、実験的なモバイルアプリ「Dreambeans」の利用範囲を米国のAI Proサブスクライバーに拡大すると発表しました。DreambeansはPersonal Intelligenceを使用してユーザーのGoogleアプリと接続し、毎日パーソナライズされたストーリーコレクションを提供し、ユーザーが見逃す可能性のある深いコンテンツや関連トピックを提示します。現在、米国のAI UltraおよびAI Proサブスクライバーはこのアプリを利用できます。

原文を読む →

Visa、不正防止企業BioCatchを24億ドルで買収すると発表

行业动态

Visa、不正防止企業BioCatchを24億ドルで買収すると発表

Visaは、行動型不正防止プロバイダーBioCatchを現金24億ドルで買収する最終契約を締結したと発表した。今回の買収は、BioCatchの行動・デバイスインテリジェンス技術を統合し、金融機関の顧客が支払い前にアカウント乗っ取り、詐欺、デジタル不正を検知・防止できるようにすることを目的としている。

Visaは、BioCatchを現金24億ドルで買収する最終契約を締結した。資金はPermiraアドバイザリーファンドおよびその他の株主に支払われる。BioCatchは、行動およびマルチシグナルに基づく不正インテリジェンスを提供する企業であり、そのAI技術は数千種類の行動およびデバイスシグナルを分析し、合法ユーザーと不正ユーザーをリアルタイムに識別する。Visaは今回の買収により、既存のネットワーク、不正・セキュリティソリューションを補完し、AIがもたらすアカウント乗っ取りやデジタル不正の増加に対応する顧客を支援できると期待している。

原文を読む →

Meta、多段階広告ランキングアーキテクチャを紹介、公式によるとコンバージョン率が6%向上

技术与洞察

Meta、多段階広告ランキングアーキテクチャを紹介、公式によるとコンバージョン率が6%向上

Metaは広告ランキングのための多段階シーケンスモデルアーキテクチャを紹介した。このアーキテクチャはオフラインのユーザーモデリングとオンラインランキングを分離し、計算効率を向上させる。公式によると、この技術によりInstagramのコンバージョン率が6%向上し、大規模言語モデルに似た予測可能なスケーリング則を示している。

Metaは、広告ランキングのための多段階シーケンスモデルアーキテクチャを紹介しました。このアーキテクチャは、オフラインのユーザーモデリングとオンラインランキングを分離することで、効率的なスケーリングを実現します。公式発表によると、この技術と関連するモデル革新は本番環境に適用されており、Instagramのコンバージョン率は累計6%向上し、Facebookのコンバージョン率は3%向上、Facebookの広告クリック率は3.5%向上しました。このアーキテクチャはMetaの生成型広告レコメンドモデル(GEM)の中核コンポーネントであり、実トラフィックにおいて大規模言語モデルに類似した予測可能なスケーリング則を示しており、現在のところ飽和の兆候は見られていません。

原文を読む →

ByteDanceは蒸留技術を使わずに競合他社を追い上げると報じられる

前瞻与传闻

報道によると、ByteDanceの創業者は内部会議で、蒸留技術を使って競合他社を追いかけないよう要求したという。この動きは審査を避けるためであり、短期的には国内の同業他社に遅れを取る可能性があっても、と報じられている。

The Informationの報道によると、ByteDanceの創業者は社内AIチームの全体会議で、短期的に国内の競合他社に遅れを取ることになっても、蒸留技術を用いてAIモデルの能力を向上させないよう明確に指示した。報道によると、この決定の主な理由は、自社のアプリTikTokに新たな審査が及ぶのを避けるためだという。創業者は社員に対し、長期的な目標のために短期的な利益を犠牲にする覚悟が必要だと述べた。

原文を読む →

DeepSeekが2回目の資金調達を再開、投資前評価額は約5000億元との報道

前瞻与传闻

DeepSeekが2回目の資金調達を再開、投資前評価額は約5000億元との報道

報道によると、DeepSeekは2回目の資金調達を再開し、500億元の調達を計画している。複数の取引関係者によると、このラウンドの投資前評価額は約5000億元で、8月下旬に契約完了の見込み。

『财经』の報道によると、複数の取引関係者が明らかにしたところ、大規模言語モデル企業のDeepSeekは第2回目の資金調達を再開した。今回のラウンドでは500億元の調達を計画しており、投資前評価額は約5000億元で、8月下旬に契約を完了する予定だ。取引関係者によれば、DeepSeekと投資家は今回の資金調達が再開後、目立たないように進められることを望んでいる。

注意:本内容はAI支援で作成されており、幻覚や誤りが含まれる可能性があります。

原文を読む →