デイリー AI ニュース

2026-08-25

出典:橘鸦 AI 早报 · 14 件

2026-08-25
2026-08-25 2026-08-24 2026-08-23 2026-08-22 2026-08-21 2026-08-20 2026-08-19 2026-08-18 2026-08-17 2026-08-16 2026-08-15 2026-08-14

MiniMax、GMI Cloudと提携しM3などのモデルを14日間無料開放

开发生态

MiniMax、GMI Cloudと提携しM3などのモデルを14日間無料開放

MiniMax と GMI Cloud は、原文で年が明記されていない 8 月 24 日から 9 月 6 日まで、M3、M2.7、Speech 2.8、Music 3.0を対象とする14日間の無料アクセスを提供し、不正利用防止措置とレート制限を設けると発表した。

MiniMax と GMI Cloud は、原文で年が明記されていない 8 月 24 日から 9 月 6 日まで、GMI Cloud を通じて MiniMax のモデルと機能を14日間無料で提供すると発表した。対象は MiniMax M3、M2.7、Speech 2.8、Music 3.0で、開発者は GMI API キーを使用してアクセスする。公式によると、期間中はこれらのサービスに利用量の上限を設けない一方、不正利用防止措置とレート制限は適用される。

原文を読む →

阿里云の云工开物、高校生向けにQoder CNプロ版を提供

开发生态

阿里云の云工开物、高校生向けにQoder CNプロ版を提供

Alibaba Cloudの「雲工開物」は、学生認証を完了した中国の大学在学生を対象にQoder CNプロフェッショナル版の特典提供を開始し、同一ユーザーにつき300元の無条件クーポン1枚を付与します。クーポンの有効期間は受取日から1年間で、指定されたPublic Cloud製品に利用でき、キャンペーンの終了時期は公式サイトで告知されます。

Alibaba Cloudは「雲工開物」のQoder CNプロフェッショナル版大学生向けキャンペーンを開始し、学生認証を完了した中国の大学在学生は300元の無条件クーポン1枚を受け取れるようになりました。キャンペーンはすでに始まっており、終了時期は公式サイトで告知されます。キャンペーン規約によると、対象には短期大学、学部、修士課程、博士課程、社会人大学院など、高等教育機関に在籍する学生が含まれ、同一ユーザーにひも付く複数のアカウントは関連アカウントとして管理されます。クーポンは受取日から1年間有効で、専用ページに掲載された一部のPublic Cloud製品に利用できます。1回の注文額が残高以下であれば、残高が0になるまで繰り返し利用できますが、製品割引やほかのクーポンとの併用、後払い製品の取得、出金時の預託金、譲渡には利用できません。期限切れの残高は失効し、リソース使用量がクーポン額を超えた場合は製品料金に基づく支払いが必要です。alibabacloud.com、jp.aliyun.com、およびそれらの配下ページは対象外です。

原文を読む →

OpenAI、米国の大学生にChatGPT Plusを4カ月間無料提供

产品应用

OpenAI、米国の大学生にChatGPT Plusを4カ月間無料提供

OpenAIは、米国の対象となる学位授与機関に在籍するフルタイムおよびパートタイムの学生に、4カ月間無料のChatGPT Plusを提供する。公式の表示価値は80ドルで、申請者は2026年10月31日までにSheerID認証を完了する必要がある。

OpenAIは米国の大学生向けChatGPT Plus優待を開始し、対象となる学生は2026年10月31日までにSheerIDで認証を完了して、4カ月間の無料利用期間を申請する必要がある。同社の説明によると、この優待の価値は80ドルで、対象は米国の学位授与機関に在籍するフルタイム学生とパートタイム学生である。新規ユーザーはChatGPT Plusの有効化時に支払い方法を追加する必要があるが、4カ月間の無料期間中は課金されない。

原文を読む →

Anthropic、Claudeのストリーミングレンダラーをアップグレード

产品应用

Anthropic、Claudeのストリーミングレンダラーをアップグレード

ClaudeのWeb版とデスクトップ版は、Anthropicが再構築したストリーミングレンダラーに切り替わり、長文回答の出力の滑らかさが約4倍向上した。公式によると、低速なノートPCではラグが9倍減り、最長フリーズ時間も4.5倍短縮した。

Anthropicは、ClaudeのWeb版とデスクトップ版で使用するストリーミングレンダラーを再構築し、長文回答の生成中におけるストリーミング出力の滑らかさを約4倍向上させた。公式によると、新しいレンダラーが現在処理する対象は変化し続けているコンテンツに限られ、この処理方式によって長文回答のストリーミング出力時に生じるラグやフリーズを改善する。同社の説明では、低速なノートPCで長文回答のラグが9倍減り、1回当たりの最長フリーズ時間が4.5倍短縮したほか、120HzのMacBookでは回答の生成開始から出力完了まで120fpsを維持できる。

原文を読む →

Agnes AI、マルチモーダル推論モデルAgnes 2.5 Pro Alphaをオープンソース化

模型发布

Agnes AI、マルチモーダル推論モデルAgnes 2.5 Pro Alphaをオープンソース化

Agnes AIはマルチモーダルモデルAgnes 2.5 Pro Alphaを公開し、API経由で提供します。このモデルはQwen3.5-397B-A17Bをベースに追加学習され、リポジトリにはApache License 2.0が適用されます。

Agnes AIはAgnes 2.5 Pro Alphaを公開しました。評価スナップショットは2026年8月18日時点のもので、モデルはOpenAI-compatible Chat CompletionsおよびResponses APIsから利用できます。これはQwen/Qwen3.5-397B-A17Bのpost-trained derivativeで、Agnes AIが追加のpost-trainingを実施しています。リポジトリと上流モデルにはApache License 2.0が適用され、元の著作権表示も保持されています。同社の説明では、複雑なタスクにextended reasoningを使用し、リポジトリ単位のcoding、技術調査、文書統合、画像分析、ツールを利用するAgentを用途としています。

比較対象はQwen3.5-397B、Qwen3.7-Max、GLM-5.2-744B、MiniMax-M3-428B、DeepSeek-V4-Pro-1.6T、Claude Opus 4.7、Claude Opus 4.8で、結果はいずれもArtificial Analysisによる独立したbenchmark measurementです。Quickstartは8-GPU tensor parallelismを使用し、checkpointは複数のshardからなるBF16 packageであるため、単一のGPUでは実行できません。公式はgreedy decodingではなくsamplingを採用し、extended reasoning向けに十分なmax_tokensまたはmax_output_tokensを確保し、応答が途中で終了した場合は上限を引き上げるよう求めています。API keyは環境変数に保存し、画像入力には公開アクセス可能なURLを使用する必要があります。公式は出力に誤りが含まれる可能性があるとし、影響の大きい判断やツール操作をapplication layerで検証し、機密データや規制対象データを送信する前にAgnes AI service termsを確認するよう説明しています。

原文を読む →

阿里の動画モデルWan3.0が正式リリース、APIを期間限定で30%割引

模型发布

阿里の動画モデルWan3.0が正式リリース、APIを期間限定で30%割引

Alibabaの動画生成モデル Wan3.0 はパブリックテストを終了して正式提供を開始し、1回で最長30秒の動画を生成できる。API料金は1秒当たり0.3~1.2元で、8つのプラットフォームから利用でき、一部では期間限定で通常価格の70%となる。

Alibabaは動画生成モデル Wan3.0 をパブリックテストから正式サービスへ移行し、ユーザーは現在、Alibaba Cloud Bailian、Wanxiang公式サイト、Qwenなど8つのプラットフォームで利用できる。1回の動画生成時間の上限は30秒で、doc、xls、ppt、pdf、md形式の文書入力にも初めて対応した。公式によると、生成時間、全能参照、現実世界の再現、指示追従、ショット間の一貫性などの能力が更新された。APIは解像度別に課金され、料金は1秒当たり0.3~1.2元で、一部のプラットフォームでは期間限定で通常価格の70%としている。井英科技やMeitu傘下の RoboNeo など、複数の企業が Wan3.0 を導入済みだ。

原文を読む →

字节、TRAEと扣子を豆包エコシステムに統合

行业动态

字节、TRAEと扣子を豆包エコシステムに統合

メディアによると、ByteDance は TRAE と Coze のチームを Doubao の事業体系に統合し、オフィス向け AI 製品チームを再編した。関連機能は業務シーンとプログラミング製品ラインに分けて再構成され、既存ユーザーの権利には影響しないと同社は説明している。

メディアによると、ByteDance はオフィス向け AI 製品チームの統合を完了し、TRAE と Coze のチーム全体を Doubao の事業体系に編入した。統合後のチームは Doubao の製品責任者に報告する。製品面では、TRAE Work と Coze が Doubao の業務シーン向け機能と統合され、TRAE IDE と CLI はプログラミング製品ラインに組み込まれるという。また、Doubao は統一 AI オフィス製品「豆包工作」を提供し、Feishu と緊密に統合すると報じられている。ByteDance は公式に、今回の調整はリソース間の連携を目的としており、既存ユーザーの権利には影響しないと説明した。

原文を読む →

小米、独自開発の玄戒チップ3製品を発表しAI Cubeのプロトタイプを展示

行业动态

小米、独自開発の玄戒チップ3製品を発表しAI Cubeのプロトタイプを展示

Xiaomiは2026年8月24日、自社開発チップの玄戒 O3、O100、D100を発表し、AI Cubeのプロトタイプを展示した。雷軍氏によると、3製品はいずれも実チップ検証を完了しており、O3はXiaomi 18 Foldで初搭載され、残る2製品は2027年の商用化を予定している。

2026年8月24日に開かれた玄戒チップ技術説明会で、Xiaomiは玄戒 O3、O100、D100を正式に発表し、会場でAI Cubeのプロトタイプも展示した。Xiaomiの創業者、会長兼CEOの雷軍氏は、3製品がXiaomiの「人・クルマ・家」エコシステム全体におけるエッジAIの演算需要をカバーし、いずれも実チップ検証を完了したと説明した。玄戒 O3は最上位の新型折りたたみ端末Xiaomi 18 Foldで初めて採用され、玄戒 O100とD100は2027年に正式商用化される予定だ。同氏の説明では、玄戒はXiaomiの全エコシステムを支えるAI演算基盤と位置付けられ、ポケット、コックピット、リビングルームから工場までを対象とし、Xiaomiのチップ戦略の一部であると同時に、AI戦略の物理的基盤とされている。

原文を読む →

SpaceXAI、NVIDIA Vera CPUを導入し宇宙版NVL72の打ち上げを計画

行业动态

SpaceXAI、NVIDIA Vera CPUを導入し宇宙版NVL72の打ち上げを計画

NVIDIAは、SpaceXAIのAIインフラにVera CPUを導入し、最適化したVera Rubin NVL72を軌道上へ展開する計画を発表した。最初のStarmind衛星は2027年第4四半期に軌道投入され、2028年に規模を拡大する予定だ。

NVIDIAは、SpaceXAIがNVIDIA Vera CPUを導入し、Agent AIアプリケーションを高速化するとともに、Grokを支えるAIインフラを拡張すると発表した。SpaceXAIは、軌道環境向けに最適化したVera Rubin NVL72を宇宙へ展開することも計画している。最初のStarmind衛星は2027年第4四半期に打ち上げられて軌道投入され、2028年に展開規模を拡大する予定だ。NVIDIAの説明によると、宇宙版システムは軌道環境に対応しながら、地上システムと同じアーキテクチャとソフトウェアエコシステムを維持することを設計目標としている。

原文を読む →

NVIDIA、Vera Rubin NVL72の性能データを公開

行业动态

NVIDIA、Vera Rubin NVL72の性能データを公開

NVIDIAはVera Rubin NVL72の初期データを公表した。AgentXテストでは、1MW当たりのスループットがGB300 NVL72の最大30倍となり、100万token当たりのコストは同製品の最大35分の1になるとしている。

NVIDIAは、Vera Rubin NVL72のAgentワークロードにおける現時点の推論性能を公表し、SemiAnalysis AgentXに収録された実際のAgent coding sessionで、1MW当たりのスループットがGB300 NVL72の最大30倍になったと説明した。このワークロードでは、実際のcontextの増加、tool call、sub-agent spawningが維持されている。DeepSeek V4 Proの結果はSemiAnalysisによるレビュー待ちで、Vera CPUがtool callingを実行する際の性能もまだ含まれていない。同社の説明では、Vera Rubin NVL72の100万token当たりのコストはGB300 NVL72の最大35分の1となる。GB300 NVL72は同じモデルで、NVIDIA Hopperアーキテクチャの最大15倍の1MW当たりスループットを記録したとしている。

OpenRouterのデータによると、Agentic AIワークロードが消費するtokenは、単純なchat requestの15倍である。NVIDIAは、通常のchatや文書要約では入出力シーケンスが一般に1K–8K tokenである一方、Agent sessionでは複数ステップを通じてcontextが蓄積し、数十万input tokenに達すると説明している。同社によると、Rubin GPUの第5世代Tensor Cores、第3世代Transformer Engine、NVFP4 quantizationがprefillとdecodeを高速化する。第6世代NVLinkとNVLink Switchesは、市販のEthernet代替製品と比べてpacket rateが10倍で、latencyは3分の1になるとしている。DSX MaxLPSにより、同じMW予算内でGPUを最大40%多く配備できるという。Vera Rubinはseven-chip architectureを採用し、Vera CPU、Groq 3 LPU、NVLink 6 Switch、BlueField-4 DPU、Spectrum-6 SPX、ConnectX-9 SuperNICも含む。公式発表では、同プラットフォームは全面的に量産へ移行している。

原文を読む →

NVIDIA、Vera Rubinの推論を拡張する量産版Groq 3 LPXを発表

行业动态

NVIDIA、Vera Rubinの推論を拡張する量産版Groq 3 LPXを発表

NVIDIAは、Vera Rubin NVL72向けのGroq 3 LPXが本格生産に入ったと発表した。公式によると、100,000-tokenのテストで毎秒3,400個の出力tokenを記録し、最も近い代替プラットフォームの4倍に達した。

Agentic AI推論向けのNVIDIA Groq 3 LPXは本格生産段階に入り、token生成専用のアクセラレーション拡張としてVera Rubin NVL72と連携して動作する。公式によると、Artificial AnalysisがオープンソースのAgentモデルGemma 4 31Bを使用したテストでは、100,000-tokenの長文コンテキストにおいて毎秒3,400個の出力tokenを生成し、最も近い代替プラットフォームの4倍に達した。このアーキテクチャでは、Rubin GPUsが大規模なコンテキスト処理を担い、LPXが遅延に敏感なdecodeワークロードを処理することで、Agentの推論、tool use、システム間連携におけるtoken単位の応答に対応する。

NVIDIAの説明によると、NebiusはNVIDIA Groq 3 LPXを採用する最初のAI cloudとなり、Nebius Token Factoryに同製品を追加して、対話型Agent、codingシステム、その他のリアルタイムAIアプリケーションに利用する。CoreWeaveはSpectrum-X Multiplaneを本番環境に導入し、複数の並列switchでVera Rubin racksを接続することにより、高帯域幅でフラットかつロスレスなAI networkを提供する。SpaceXAIは、将来のAIアーキテクチャをVera Rubinを基盤として構築し、地上のdata centersから軌道上のsatellitesまで展開するとしており、Agentic AIのorchestration、tool use、code execution、data processing、simulationを処理するためにVera CPUsを導入する計画だ。

原文を読む →

Nvidia、Perplexity AIに数十億ドル規模の投資を検討か

行业动态

2026年8月24日の報道によると、NvidiaはPerplexity AIの新たな株式資金調達ラウンドに数十億ドルを出資する方向で協議している。同ラウンドでの評価額は300億ドルを超え、同社の年間換算売上高は7億5,000万ドル超に達した。

2026年8月24日、NvidiaがPerplexity AIの最新の株式資金調達ラウンドに参加し、数十億ドルを出資する方向で協議していると報じられた。両社は同時に、技術ライセンス契約についても協議している。報道によると、同ラウンドにおけるPerplexity AIの評価額は300億ドルを超える。同社の年間換算売上高は2026年初めの時点で2億5,000万ドル未満だったが、その後7億5,000万ドル超に増加した。評価額と売上高の数値はいずれも今回の報道に基づく。

原文を読む →

Mistral AIとHUMAIN、中東のソブリンAIインフラを展開へ

行业动态

Mistral AIとHUMAINは、サウジアラビアと中東で主権AIに関する戦略的協業を開始すると発表した。対象はインフラ、モデル開発、業界向け導入で、公式発表によると協業規模は数億ユーロ、初期の重点分野はアラビア語、サイバーセキュリティ、音声となる。

Mistral AIとHUMAINは、サウジアラビアと中東を対象に、AIインフラ、高度なモデル開発、AIソリューション導入を含む戦略的協業を発表し、公式には協業規模を数億ユーロとしている。両社は高度なAIモデルの開発とローカライズを計画し、初期段階ではサイバーセキュリティと音声に注力するとともに、アラビア語能力を強化したfrontier modelsを開発する。Mistral AIは、現地で増加する計算需要に対応するため、HUMAINのデータセンターインフラの利用を検討する。両社はさらに、規制対象業界へAIソリューションを提供するため、サウジアラビア市場向けの共同go-to-market戦略を策定する計画だ。説明によると、この協業における主権AIは、顧客がデータ、知能、計算資源、運用を管理し、顧客が選んだインフラと法域で学習とinferenceを実行し、open weightsでモデルを調整、保有できる仕組みを指す。発表には将来予想に関する記述が含まれ、実際の結果はリスク、不確実性、今後の商業契約によって異なる可能性があるとしている。

原文を読む →

Thinking Machines Lab、オープンソースモデルの安全性研究助成を開始

行业动态

Thinking Machines Lab、オープンソースモデルの安全性研究助成を開始

Thinking Machines Labは、1件当たり最大50,000米ドル相当のcreditsを提供するTinker助成を開始し、open-weightの安全研究を支援する。対象分野は危険データの識別、改変耐性を持つ訓練、reward hackingである。

Thinking Machines Labは、open-weightモデルの安全研究を対象とするTinker助成を開始し、1件当たり最大50,000米ドル相当のcreditsを提供する。この制度はInklingとInkling-Smallがopen weightsで公開された後に始まり、追加のTinker creditsによって進展を加速できる安全プロジェクトを対象とする。提示された研究分野には、defensive fine-tuning後に攻撃側と防御側の能力向上を別々に測定し、その差が真の非対称性なのか、攻撃圧力で消える抑制や測定時のみ続くsandbaggingなのかを判定する研究が含まれる。別の分野では、危険データを十分な規模とrecallで識別できるclassifierを訓練し、下流のfine-tuningを通じてフィルタリングが危険能力の向上を抑えるかを測定する。

研究範囲には、adversarial fine-tuningや通常のcontinued trainingを経ても維持される安全対策の開発、未知の攻撃戦略による汎化性能の検証、規模とarchitectureがrobustnessに与える影響の分析も含まれる。ほかの課題は、限定的で有害なfine-tuningが広範な行動変化に拡大する条件、モデルがplanning、tool use、ドメイン知識を組み合わせて訓練中にエンドツーエンドで示されていない行動を生成できるか、reward hackingがモデル能力とoptimization pressureに応じてどう変化するかである。この制度では、問題が深刻化する前に初期シグナルで予測できるか、chain-of-thought monitorsを回避または妨害する戦略を検出できるか、その戦略がタスク間で転移するかも扱う。公式によると、これらの分野は完全な一覧ではない。

原文を読む →