デイリー AI ニュース

2026-09-25

出典:橘鸦 AI 早报 · 27 件

2026-09-25
2026-10-01 2026-09-30 2026-09-29 2026-09-28 2026-09-27 2026-09-26 2026-09-25 2026-09-24 2026-09-23 2026-09-22 2026-09-21 2026-09-20

ChatGPT、月額500ドルのPro Maxサブスクリプションプランを追加か

要闻

ChatGPT、月額500ドルのPro Maxサブスクリプションプランを追加か

未公開の ChatGPT サブスクリプション情報から、OpenAI が月額 500 ドルの Pro Max プランを追加する可能性が浮上した。一部ページでは 600 ドルと表示され、報道は差額を付加価値税によるものとしており、最終的な特典と提供開始時期は未定となっている。

OpenAI の未公開の ChatGPT サブスクリプション情報に、月額 500 ドルの Pro Max プランが掲載された。このプランは現時点で提供されておらず、ユーザーは契約できない。別のページでは 600 ドルと表示されており、報道は 2 つの価格の差額を付加価値税によるものと説明している。既存の Pro プランと比べ、確認された文言の主な変更点は「最速の Work と Codex」の追加で、関連タスクの処理が速くなることを示しているが、具体的な速度や利用上限は説明されていない。メディアは Cerebras の計算インフラを使用する可能性も推測しているが、OpenAI は両者の直接的な関係を確認しておらず、最終的な特典と提供開始時期も公表していない。

原文を読む →

豆包、PC版ユーザー向けに30日間の無料サブスクリプションを再提供

要闻

豆包は前回の30日間のサブスクリプション特典に続き、最新版の「豆包」PC版と「豆包工作」PC版のユーザーに30日間の無料サブスクリプションを提供する。受け取りは1アカウントにつき1回で、前回分を受け取ったユーザーには期限が近づくと次回分が付与される。

豆包は即日、これまでの1カ月間のサブスクリプション特典キャンペーンに追加する形で、30日間の無料サブスクリプションの提供を開始した。対象は最新版の「豆包」PC版または「豆包工作」PC版をダウンロードするか、最新版へアップグレードしたユーザーで、受け取りは1アカウントにつき1回に限られる。同社の説明によると、前回の30日間の特典を受け取ったユーザーには、既存特典の期限が近づく時期に次の30日間分が付与される。受け取り前から有料サブスクリプションを契約しているユーザーは、有料特典の有効期間が自動で延長され、ピーク時間帯の優先利用などの特典も継続して利用できる。特典の有効期限は「設定—サブスクリプションと上限管理」で確認でき、同ページの「サブスクリプション履歴」から詳細情報も確認できる。

原文を読む →

Google、Colabのプレミアム特典をGoogle AIサブスクリプションプランに統合

要闻

Google、Colabのプレミアム特典をGoogle AIサブスクリプションプランに統合

GoogleはColabのプレミアム特典をGoogle AIサブスクリプションに組み込み、加入者は高速なアクセラレータと高性能なマシンを優先利用できるようになった。Ultra加入者には、中断のないバックグラウンド実行とPremium GPUへのアクセスも提供され、今後数週間でColab対応国に展開される。

Googleは、Google AIの加入者がColabのプレミアム特典を利用できるようになり、関連機能を今後数週間かけてColab対応国の加入者へ順次提供すると発表した。Google AIサブスクリプションでは、高速なアクセラレータと高性能なマシンを優先利用できる。Google AI Ultraには、中断のないバックグラウンド実行とPremium GPUへのアクセスも含まれ、ブラウザのタブを開いたままにせず長時間のトレーニングを継続できる。同社の説明によると、Google AIプランには、クラウドストレージ容量の拡大、Googleの高性能モデルへのアクセス拡充、Gemini appの拡張機能、Workspace連携、Google AntigravityやGoogle AI Studioなどの開発者ツールへのプレミアムアクセスも含まれる。既存のColabサブスクリプションに変更はなく、その特典はGoogle AIのサブスクリプション特典と併用でき、より多くのColabプレミアム機能を利用できる。

原文を読む →

WorkBuddy、WeChatミニプログラムの生成・公開機能を提供開始

要闻

WorkBuddy、WeChatミニプログラムの生成・公開機能を提供開始

WorkBuddyはPC版5.6.1以降にWeChat Mini Programの生成・公開機能を追加した。ユーザーは自然言語でプロジェクトを作成し、製品内でクラウドサービスへの接続、プレビュー、公開手続きの開始ができ、アカウントがない場合は14日間の試用版を作成できる。

WorkBuddyはPC版5.6.1以降でWeChat Mini Programの生成・公開機能を提供し、対象バージョンへのアップグレード後に利用できる。同社の説明によると、ユーザーは「コード開発」モードで「Mini Program」を選択するか、自然言語で要件を直接記述できる。プロジェクトの生成後は、必要に応じてクラウドデータベース、ファイルストレージ、ログイン認証、AI呼び出しなどのクラウドサービスに接続し、WorkBuddy内でプレビューして公開プロセスへ進める。通常の手順では、開発者ツールを別途インストールする必要はなく、AppIDの設定やコードパッケージの手動アップロードも不要となる。既存のMini Programアカウントを持つユーザーはQRコードで連携し、まず体験版を公開して実機テストを行った後、WeChatの公式手順に従って審査申請と正式版の公開ができる。アカウントがないユーザーは機能検証用の14日間試用版を作成できるが、この試用版を正式版へ直接移行することはできない。

原文を読む →

DeepSeek Harness Desktop版のインストーラーが発見

要闻

DeepSeek Harness Desktop版のインストーラーが発見

DeepSeek Harness Desktop版のインストーラーが、DeepSeek AIのGitHub Releasesページで確認された。同ページには、0.1.6系と0.1.7系の複数のバージョン差分も掲載されている。

DeepSeek AIのGitHub ReleasesページにDeepSeek Harness Desktop版のインストーラーが掲載されたが、発見日または公開日の具体的な記載はない。同ページには、dsh-v0.1.7-rc.1からdsh-v0.1.7-rc.2、dsh-v0.1.7-alpha.1からdsh-v0.1.7-alpha.2、dsh-v0.1.6-alpha.1からdsh-v0.1.6-alpha.2までのFull Changelogの範囲が示されている。ページの説明によると、0.1.7系の最初のリリース候補には、v0.1.5-rc.3以降のユーザーおよび開発者向けの主要な変更がまとめられている。元のページには複数の読み込みエラーが表示され、提示された内容にはインストーラーのファイル名、対応プラットフォーム、インストール方法などの情報は含まれていない。

原文を読む →

SiliconFlow、3つのオープンソース高速意思決定モデルAPIを公開、10月8日まで無料

开发生态

SiliconFlow、3つのオープンソース高速意思決定モデルAPIを公開、10月8日まで無料

SiliconFlowは、Kev-4B、SemIf、DiffusionGemmaという3つのオープンソースモデルのServerless APIを公開した。開発者は2026年10月8日より前まで無料で利用でき、二択、単一選択、段階評価などの構造化された判断を迅速に取得できる。

SiliconFlowは、Kev-4B、SemIf、DiffusionGemmaをAPI経由で利用できるServerlessサービスとしてデプロイし、開発者向けに2026年10月8日より前まで無料で提供する。利用するには、SiliconFlowのプラットフォームに登録またはログインしてAPI Keyを取得する必要がある。リクエストではモデルと判断対象の内容を指定し、問題形式を二択、単一選択、段階評価から設定でき、同一リクエスト内で複数の問題形式を組み合わせることもできる。SiliconFlowの説明によると、3つのオープンソース高速意思決定モデルはそれぞれ異なる技術方式を採用し、構造化された判断を迅速に必要とする用途を対象としている。

原文を読む →

Bocha、Bocha Jev意思決定モデルを公開、APIを期間限定で無料提供

开发生态

Bocha、Bocha Jev意思決定モデルを公開、APIを期間限定で無料提供

博查は構造化された意思決定向けモデル Bocha Jev を公開し、API の期間限定無料テストを開始した。bocha-jev-v1 は1回のリクエストで最大32件の問題と1,024個の候補を処理でき、デフォルト上限はユーザー当たり200 QPSとなる。

博查は構造化された意思決定タスク向けの Bocha Jev を公開し、API の期間限定無料テストを開始した。開発者は既存の博查 API Key を使って接続できる。同社の説明によると、業務プログラムから現在の状態、タスク指示、候補を送信すると、モデルがアクション選択、コンテンツ評価、条件判定の結果を返し、プログラムはその結果に基づいて後続処理を実行できる。このモデルは、共通のコンテキストを持つ複数の問題を1回のリクエストで処理でき、カスタマーサービスの振り分け、検索結果の順位付け、Agent ワークフローに利用できる。現在のモデル識別子は bocha-jev-v1。1回のリクエストで最大32件の問題と1,024個の候補に対応し、デフォルトの呼び出し上限はユーザー当たり200 QPSで、具体的な上限はアカウント設定に準じる。

原文を読む →

Anthropic、3種類の応答前にブロックされたリクエストへの課金を再開

开发生态

Anthropic、3種類の応答前にブロックされたリクエストへの課金を再開

Anthropicは、出力前にbio、frontier_llm、reasoning_extractionのいずれかで拒否されたリクエストをモデル料金で課金する。それ以外のカテゴリーまたはnullは課金されないが、全リクエストがrate limitsに算入される。

Anthropicの文書では、Claude Fable 5.1、Claude Fable 5、Claude Opus 5.5、Claude Opus 5のsafety classifierが、出力前にbio、frontier_llm、reasoning_extractionのいずれかのカテゴリーでリクエストを拒否した場合、実際に実行したモデルの通常料金で課金すると定めている。それ以外のカテゴリーまたはnullは課金されない。公式によると、2026年9月時点で、この3カテゴリーのfalse positiveは少ない。この規則はClaude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryに適用される。拒否でもHTTP 200が返り、stop_reasonは"refusal"、カテゴリーはstop_details.categoryに記録される。課金の有無にかかわらず、usageにはtoken数が表示され、リクエストはrate limitsにも算入される。ストリーミング出力の途中で拒否された場合、入力tokenと出力済みtokenは通常料金で課金され、既存の出力は不完全なものとして破棄する必要がある。

Claude APIのserver-side fallbackはbetaとして提供されている。server-side-fallback-2026-07-01 beta headerを付け、fallbacksを"default"に設定すると、推奨fallbackがある拒否カテゴリーについて、APIは同じ呼び出し内で同一リクエストをAnthropic推奨モデルへ渡す。推奨モデルがない場合、拒否はそのまま維持される。開発者は最大3つのfallbackモデルを指定し、順番に再試行することもできる。この仕組みを作動させるのはsafety classifierによる拒否だけで、rate limit、overload、server errorはそのまま返される。fallbackを発生させた元の拒否が課金対象カテゴリーに属するか、出力途中で発生した場合、その拒否とfallbackリクエストはそれぞれ課金される。fallback creditは後続リクエストのprompt-cache missを補償し、同じ会話のcache作成費用が二重に発生するのを防ぐ。実際に応答したモデルはレスポンス最上位のmodelフィールドに示され、切り替えはusage.iterations内のfallback_messageに記録される。

原文を読む →

Claude Code Projectsがローカル対応、スレッドをユーザーのPC上で実行可能に

开发生态

Claude Code Projectsがローカル対応、スレッドをユーザーのPC上で実行可能に

ClaudeDevsは、Claude CodeのProjectsにローカル対応を追加し、プロジェクトのスレッドをユーザー自身のPC上で実行できるようにしたと発表した。この機能はデスクトップ版とWeb版で一部ユーザーによるテストが進められており、順番待ちリストを通じてより多くのProおよびMaxユーザーに段階的に開放されている。

ClaudeDevsは、Claude CodeのProjectsがローカル実行に対応し、プロジェクトのスレッドをユーザー自身のPC上で実行できるようになったと発表した。この機能はデスクトップ版とWeb版で、一部ユーザーを対象とするテスト段階に入っている。公式によると、チームは順番待ちリストに沿ってアクセス対象を拡大し、より多くのProおよびMaxユーザーに利用権限を付与している。以前にClaude Projectsを利用していたユーザーは引き続き移行を待っており、まだ登録していないユーザーは早期アクセスを申請できる。

原文を読む →

OpenRouter、検索やコマンドラインなどを提供するサーバーツール市場を公開

开发生态

OpenRouter、検索やコマンドラインなどを提供するサーバーツール市場を公開

OpenRouterはサーバーツールマーケットプレイスを公開し、Web検索、URLコンテンツ抽出、サンドボックスshell、画像生成、複数モデルの呼び出し、ツール定義のオンデマンド読み込みを含む11機能を掲載した。

OpenRouterはサーバーツールマーケットプレイスを公開し、現在のページにはモデルが利用できる11のserver toolsが掲載されている。情報取得機能には、UTCまたは指定タイムゾーンの現在日時の提供、Web検索、URLコンテンツの取得と抽出が含まれる。実行機能には、任意のモデル向けのホスト型サンドボックスshellと、任意でサンドボックス実行を利用できるAnthropic-style bash toolがある。モデル編成機能は、生成途中でより強力なモデルを呼び出すこと、複数のモデルを呼び出した後に別のモデルで最終回答を合成すること、タスクをより小型で高速なモデルに委任することに対応する。このほか、テキストpromptからの画像生成、V4A diffsによるファイル変更案の作成、必要時のツール定義読み込みも含まれる。

原文を読む →

Google、Gemini 3.8 Liveのビデオアバター機能を企業向けプラットフォームで正式提供

开发生态

Google、Gemini 3.8 Liveのビデオアバター機能を企業向けプラットフォームで正式提供

GoogleはGemini EnterpriseでGemini 3.8 Live with Live Avatarを公開し、リアルタイム音声対話と低遅延の映像Avatarを統合するとともに、97言語の切り替えに対応した。

Googleは発表日から、Gemini EnterpriseでGemini 3.8 Live with Live Avatarの提供を開始し、準リアルタイムの映像生成とネイティブなリアルタイム音声対話を組み合わせた。公式によると、この機能は映像と音声の入力を同時に処理し、リップシンク、表情、自然な話者交代を伴う音声と映像で応答でき、カスタマーサービスやインタラクティブな操作案内に利用できる。asynchronous tool callingにより、対話を続けながらバックグラウンドでツールを呼び出してデータを取得し、ホテル宿泊客のチェックインなどのタスクを処理できるとしている。

同社の説明では、Live Avatarはネイティブのmultilingual speech-to-speech synchronizationを備え、97言語を切り替えながらリップシンクと表情を動的に調整する。公式は、その過程で映像の忠実度が低下したり、視覚的なずれが生じたりすることはないとしている。企業はプリセットのAvatarを利用できるほか、高品質な参照画像から、人物の類似性、ブランドスタイル、キャラクターの同一性を維持したカスタムAvatarを生成できるが、現在は企業向けallowlistの対象顧客に限られる。Googleによると、同社のAI製品が生成するすべての出力にはSynthID透かしが埋め込まれ、Live Avatarの音声と映像にも知覚できない形で付与される。APIドキュメントとmodel cardも製品ページで提供されている。

原文を読む →

Claude Code、plan modeを組み込みmodに変更へ

开发生态

Claude Code、plan modeを組み込みmodに変更へ

Claude Codeの開発者Thariqは、plan modeを内蔵modに変更し、ほかのmodが新しいモードを追加したり、Shift+Tabの用途を再設定したりできるようにする計画を示した。この案はまだ計画段階で、実装されていない。

Claude Codeの開発者Thariqは、plan modeを内蔵modに変更し、ほかのmodが新しいモードを追加したり、Shift+Tabの用途を再指定したりできるようにする計画だと説明した。この仕組みはまだ実装されていない。この案では、ユーザーはplan modeのプロンプトを変更し、独自のモードを作成して共有できるほか、plan modeを使わずに、そのショートカットを別の機能へ割り当てることもできる。Thariqは以前、plan modeを廃止し、Shift+Tabでモデルの思考への投入度を調整する案を検討していた。フィードバックを募った後、一部のユーザーは自分でタスクを計画するため専用モードを必要とせず、別のユーザーはClaudeとの議論や構想だけに使うモードを求めていると説明した。

原文を読む →

Odyssey、最大20人の人間とAgentがリアルタイムのシミュレーション世界を共有できるAgora-2を公開

模型发布

Odyssey、最大20人の人間とAgentがリアルタイムのシミュレーション世界を共有できるAgora-2を公開

Odysseyは2026年9月21日、最大20人の人間とAgentが同じリアルタイム生成環境に参加できるAgora-2のプレイ可能な研究プレビューを公開した。参加者数はAgora-1の5倍で、対象も単一環境から複数環境へ拡張された。

Odysseyは2026年9月21日、次世代multi-agent world model「Agora-2」のプレイ可能な研究プレビューを公開し、最大20人の人間とAgentが共有シミュレーション内でリアルタイムに交流できるようにした。公式によると、参加者数はAgora-1の5倍で、シミュレーションの対象も単一環境から複数環境へ広がり、より複雑なインタラクションと長期的な行動を扱える。Agora-2はBlizzardが開発したDiablo IIのキャプチャーデータで訓練され、observationとaction、stateを対応付けたデータから、エンティティの移動、交流、相互反応を学習する。

同社の説明では、Agora-2はstreaming pixelsとして共有世界を生成し、明示的なshared stateを維持する。simulation modelはエンティティの属性、直近のaction、周辺のgeometryを基に、複数のactionが状態へ与える影響を予測する。world serverが予測を統合して状態を更新した後、rendering modelが各参加者の視点を生成する。エンティティが画面外へ移動しても、その属性はshared stateに保持される。rendering modelはflow matchingで訓練され、訓練中にはvisual historyを頻繁に取り除き、エンティティに関する誤差の重みを高める。Odysseyはreinforcement learningにより、対戦相手の追跡、障害物の回避、動けなくなった場合や集団から離れた場合の復帰もAgentに学習させている。これらのAgentは、部分的に観測できる視点と直近のobservationに基づいて行動する。

原文を読む →

Tencent、33言語間の相互翻訳に対応するHy翻訳アプリを公開

产品应用

Tencent、33言語間の相互翻訳に対応するHy翻訳アプリを公開

Tencentは、混元 Hy-MT2翻訳モデルを基盤とする「腾讯 Hy 翻译」APPをリリースし、米国や日本など12の国・地域で提供を開始した。同APPは33言語間の翻訳に対応し、音声、写真、オフライン翻訳を提供する。

Tencentは、混元 Hy-MT2翻訳モデルを基盤とする「腾讯 Hy 翻译」APPを、米国や日本など12の国・地域で公開した。同社の説明によると、同APPは33言語間の翻訳に対応し、中国の少数民族言語および方言5種をカバーするほか、音声翻訳、写真翻訳、オフライン翻訳を提供する。翻訳モデルを事前にスマートフォンへダウンロードすれば、インターネット接続がない場合や通信状況が悪い環境でもオフライン機能を利用できる。TencentはスマートフォンAPPのほか、ミニプログラム、プラグイン、PC版も提供しており、「腾讯混元翻译」で検索すると関連サービスにアクセスできる。

原文を読む →

Arena.ai、新しいランキング概要ページを公開

产品应用

Arena.ai、新しいランキング概要ページを公開

Arena.aiは、リアルタイムのランキング、新モデルの情報フィード、プラットフォームの動向を新しいランキング概要ページに統合した。ユーザーは単一のページで、GPT-6 SolやClaude Opus 5.5などのスコア、カテゴリ別順位、能力紹介を確認できる。

Arena.aiは、分散していたモデルのリアルタイム情報を1つのページに集約する、再設計されたランキング概要ページを公開した。研究者、開発者、モデル評価の参加者が各モデルのパフォーマンスを追跡できる。新ページには、最近Arenaに追加されたモデルのリリース情報フィードがあり、評価セッションの件数に加え、Agents、画像、コーディングなどのカテゴリで上位に入るモデルをリアルタイムで表示する。Arenaチームによる新モデルの能力に関する初期紹介と、プラットフォームの研究、機能、アップデート情報も掲載する。ユーザーはGPT-6 SolやClaude Opus 5.5などの各ランキングにおけるスコアを確認し、カテゴリ別順位や能力情報と合わせてパフォーマンスを把握できる。

原文を読む →

Tencent QClaw、12月24日にサービス終了へ、返金とデータ移行を提供

产品应用

Tencent QClaw、12月24日にサービス終了へ、返金とデータ移行を提供

TencentのQClawは2026年12月24日00:00に運営を終了し、新規ユーザー登録、サブスクリプション購入、更新、自動課金はすでに停止した。ユーザーは返金申請またはWorkBuddyへのデータ移行ができ、有効データの移行に成功すると1,000ポイントを受け取れる。

QClawチームは2026年9月24日、事業展開上の調整を理由として、QClawを2026年12月24日00:00に停止すると発表した。公告の公開以降、新規ユーザー登録、サブスクリプション購入、更新、自動更新による課金は停止され、登録済みユーザーは運営終了までサービスを利用でき、保有ポイントも従来の有効期限まで利用できる。ユーザーは公式サイトで未使用かつ有効な有料サブスクリプションまたはポイントパックの返金を申請できるほか、クライアントでデータをバックアップできる。WorkBuddyへの移行は、公式サイトでの認証後にクライアントで同期を実行する2段階で行う。運営終了後はデータのバックアップ機能と移行機能のみが残る。有効データの移行に成功したユーザーにはWorkBuddyの1,000ポイントが付与され、条件を満たす初回の単月会員購入者には追加ポイントも付与される。

原文を読む →

Meta、MuseのMac、メール、さらなるショッピングサービスとの連携を推進

产品应用

Meta、MuseのMac、メール、さらなるショッピングサービスとの連携を推進

Metaは個人向けAI Agent「Muse」をビデオ対話、スマートグラス、Mac、メール、より多くのショッピングサービスへ拡張し、開発者が独自のコネクターを構築できるプラットフォームも公開した。スマートグラスとの統合は今後数カ月以内に提供する計画だ。

MetaはConnectで個人向けAI Agent「Muse」の拡張計画を発表し、デジタルアバター、スマートグラス、Mac操作、メール連携、ショッピングサービスへ機能範囲を広げるとした。スマートグラスとの統合は今後数カ月以内に提供する計画だ。同社の説明によると、ユーザーは将来、Museのデジタルアバターとリアルタイムでビデオ対話できるほか、Metaのスマートグラスを通じて音声でタスクを依頼できる。Metaは、MuseがMacアプリを代わりに操作する機能も紹介し、メール処理用の専用メールボックスを開発していると説明した。ショッピングでは、接続できる小売アプリと決済手段を増やす。公式発表によると、Museは大量の無料tokenを提供し、長期的には取引を通じて少額の手数料を徴収する見込みだ。Metaは同時に、Museが接続できるサービスを増やすため、開発者が独自のコネクターを構築できるプラットフォームを公開した。

原文を読む →

Meta、ウェアラブル端末Muse Charmを披露、12月のホリデーシーズン前の出荷を計画

产品应用

Meta、ウェアラブル端末Muse Charmを披露、12月のホリデーシーズン前の出荷を計画

MetaのMuse AI Agent向けに、キーホルダー型デバイスMuse Charmが加わる。同社は2026年9月23日に製品を公開し、12月のホリデーシーズン前の出荷を目指しているが、内部部品の配置はまだ確定していない。

Meta CEOのMark Zuckerbergは、2026年9月23日に開催された年次イベントConnectでMuse Charmを披露し、12月のホリデーシーズンまでに出荷可能な状態にすると説明した。Zuckerbergによると、チームは内部部品の配置を確定する必要があり、製品は当時まだ出荷できる段階ではなかった。Muse Charmは手のひらサイズで、ポケットに入れたりキーホルダーに取り付けたりできる。小型画面には、社内でJollyと呼ばれるデジタルavatarが表示され、ユーザーは音声でMuseとやり取りできる。報道によると、デバイスはユーザーに代わってタスクを実行するよう設計されている。Zuckerbergの説明では、MetaはMuseのreal-time voiceとavatar stackをデバイスに搭載した。角にあるfingerprint sensorに触れると、スマートフォンのロック解除やappの起動をせずに会話を始められる。同氏は、眼鏡を着用していない場合、Museと話し、周囲の状況を見せるための最速の手段になるとも述べた。

原文を読む →

Meta、3種類のスマートグラスを披露、VRグラスは2027年春に発売予定

产品应用

Metaはスマートグラス3機種を発表した。1,299ドルのMeta VR Glassesは2027年春に発売予定で、ほかのRay-Ban Meta 2機種は349ドルと449ドルとなる。

MetaはMeta Connectで、349ドルのRay-Ban Meta Audioと449ドルの第3世代Ray-Ban Metaを披露し、1,299ドルのMeta VR Glassesを2027年春に発売すると発表した。公式によると、VRモデルの重量はMeta Quest 3の5分の1で、5Kディスプレイを搭載する。演算コンポーネント、バッテリー、ストレージは有線接続の独立したpuckに収め、外部カメラで周囲の環境を表示する。操作にはハンドジェスチャーまたはMuse AI agentを使用でき、単一または複数の仮想ディスプレイを表示するほか、平面を仮想キーボードやマウスとして利用できる。カスタマイズしたMuse avatarも完全にレンダリングされた状態で表示する。Metaは、同製品がIMAX Enhanced認証を取得した初のVRデバイスで、Disney+に対応し、Prime VideoやYouTubeなども導入する計画だと説明した。Xbox Cloud Gamingも対応予定で、Meta AI appはユーザーの写真から全身のデジタル像を作成し、装着中のビデオ通話に利用できる。

Ray-Ban Meta Audioはカメラを搭載せず、バッテリー駆動時間は最長12時間で、音楽再生とMuse AI agentとの会話に対応する。従来のカメラ搭載モデルはLEDで撮影中であることを示すが、ユーザーが表示灯を改造した事例があり、これに関する問題を受けて、世界の一部の都市、州、企業は特定の状況でカメラ搭載スマートグラスの使用を制限している。第3世代Ray-Ban Metaはカメラを維持し、バッテリー駆動時間とマイクを更新した。Ray-Banシリーズとは別のMeta Glassesも更新され、価格は249ドルからとなる。IDCによると、Metaは2026年第2四半期の世界スマートグラス出荷台数の68.7%を占めた。SamsungとGoogleは、Android XRを基盤とし、Warby ParkerとGentle Monsterのデザインを採用するグラスを準備している。Snapは2,195ドルのSpecs ARを展開中で、BloombergのMark Gurmanは、Appleが2027年末に独自のスマートグラスを発表する可能性があると報じた。

原文を読む →

Google、長編動画生成向けのマルチAgent研究フレームワークを発表

技术与洞察

Google、長編動画生成向けのマルチAgent研究フレームワークを発表

Googleは長尺動画向けのmulti-Agent方式を公開した。これは4つのフレームワークを含み、2つのループでクリエイティブ設定と制作工程を統括するもので、数分間のコンテンツを生成しつつ、ショット間のキャラクター変化と上流エラーの伝播を抑えると公式は説明している。

Googleは、一貫性のある長尺動画を生成するAI video co-directorのmulti-Agent研究フレームワークを公開した。GeminiとVeo上のオーケストレーション層として構築され、複数ショットの物語生成をglobal optimizationとworld-state trackingの問題として扱う。研究にはCo-Director、CANVAS、A²RD、VQQAが含まれ、Co-DirectorはCOLM 2026、CANVASはEMNLP 2026で発表される予定である。同社の説明では、生成される画像、動画、音声にはSynthID watermarkingを含む基盤モデルの安全機構が引き継がれ、完成動画にsafety classifierを追加することもできる。

システムはstrategic steeringとmulti-stage productionの2つのループで動作する。Orchestrator Agentはmulti-armed banditを使い、Creative Strategy、Narrative Mode、Aesthetic Archetypeの3次元で設定を選択する。Pre-Production Agentはシーンごとのストーリー、ビジュアル素材、storyboardを統合し、Production AgentはKeyframe Agent、Video Agent、Audio Agentを通じて映像、動き、ナレーション、音楽を生成する。最後にMLLM Judgeが同じ3次元で完成動画を評価し、分解したreward signalをMABへ戻して反復的に最適化する。公式は、評価において複数ショットの物語的一貫性とキャラクターの持続性が向上し、数分間の動画を生成しながらvisual driftとパイプライン内のエラー伝播を緩和したとしている。

原文を読む →

Anthropic、Claude Agentが従業員に代わって本を交換するProject Swapを紹介

技术与洞察

Anthropic、Claude Agentが従業員に代わって本を交換するProject Swapを紹介

Anthropicによると、Project Swapでは201人の社員が交換用の本を1冊ずつ持ち寄り、Claude Agentが取引を仲介した。実験は6拠点で行われ、参加者の本の選好順位に基づいて結果を評価した。

Anthropicの説明によると、同社は夏季にProject Swapを通じて201人の社員による本の交換を実施した。各参加者は手放したい本を1冊提供し、読書の好みをClaude-powered Agentに伝えた後、Agentが所定時間の終了までデジタル取引フロアで交換相手を探した。参加者はSan Francisco、New York City、London、Seattle、DC、Dublinの6つのローカルプールに分かれ、規模はDublinの3人からSan Franciscoの115人までだった。大半の参加者はAgentが交換で得た本を受け取り、Dublinの参加者は分析の大部分から除外された。

取引が個人の好みに沿っていたかを評価するため、Claudeは短い半構造化対話で読書の嗜好と夏季に読みたい本を尋ね、Fable 5を使って各参加者のプール内にある全書籍の順位を作成した。研究チームは別途、各参加者にプール内の10冊を順位付けさせ、ground truthとした。Anthropicによると、この実験は、Agentが参加者を正確に理解できるか、またAgent向け市場で参加資格、取引不成立時の処理、市場活動の可視範囲をどう定めるべきかを調べるためのものだった。異なる実物をAgentに売買させた従来のProject Dealとは異なり、今回は本の選好順位から市場が好みを満たした度合いを算出した。

原文を読む →

Google、Planetと衛星を打ち上げ、宇宙空間でのTPU稼働をテストへ

行业动态

Google、Planetと衛星を打ち上げ、宇宙空間でのTPU稼働をテストへ

GoogleはPlanetと共同で、SpaceXのTransporter-18ミッションにTPU搭載の試作衛星を投入し、最大100 gの加速度、放射線、真空下の冷却条件でチップが動作できるかを検証する。2衛星間のレーザー通信試験は2027年に予定している。

GoogleはProject Suncatcherを通じてPlanetと協力し、SpaceXのTransporter-18ライドシェアミッションで試作衛星を打ち上げ、TPUが飛行時の振動、放射線、温度の極値にさらされた際の軌道上データを収集する計画を決定し、2027年を次段階のマイルストーンに設定した。このプロジェクトは、low Earth orbitにスケーラブルなmachine learningインフラを構築できるかを研究する。公式説明によると、衛星はほぼ継続的な日照を利用でき、太陽光発電量は地上の最大8倍になる。ロケットがlow Earth orbitへ到達するまでには約10分かかり、宇宙機には最大10 gの持続的な加速度が加わる。TPUなどの個別部品には50~100 gが加わる可能性がある。チームは3軸方向の振動試験を実施し、公式はハードウェアが試験で加えられた力に耐えたとしている。

チームはUC DavisのCrocker Nuclear Laboratoryでも陽子ビームを使い、Trillium TPUでAI workloadを実行しながらbitflipなどのエラーを監視した。公式説明によると、初期結果では、Trillium TPUが耐えられるtotal ionizing doseは5年間の宇宙ミッションで想定される線量を上回った。真空中に気流がない問題に対しては、heat pipesとradiatorsを組み合わせてチップを冷却し、thermal vacuum chamberで試験を実施した。将来の衛星設計では、各衛星に数十個のTPUを搭載し、クラスターとして地球を周回させる。極短距離で高帯域幅の接続を維持するため、衛星はレーザーを使って自機の位置と隣接衛星との相対位置を把握する必要がある。プロジェクトは2027年に2基の衛星を軌道へ投入し、この方式を試験する計画だ。

原文を読む →

DeepSeekが新たな資金調達を推進か、計算能力の70%超をモデル訓練に使用

前瞻与传闻

報道によると、DeepSeekは約500億元の新たな資金調達を進めており、目標評価額は約5,000億元、遅くとも2026年10月末までの完了を予定している。年間換算の売上高ランレートは10億ドルに達し、計算資源の70%超を新モデルの訓練に充てている。

DeepSeekは約500億元の資金調達を詰めていると報じられており、目標評価額は約5,000億元で、遅くとも2026年10月末までの完了を予定している。報道によると、同社の年間換算の売上高ランレートは10億ドルで、数カ月前の5億ドル未満から2倍超になった。創業者の梁文鋒氏は投資家向け会合で、モデルの値上げ後も顧客数は減っていないが、収益拡大は現時点での最優先事項ではないと述べたとされる。報道では、同社は計算資源の70%超を新モデルの訓練に割り当て、既存モデルの推論サービスに使う割合は30%未満としている。

原文を読む →

Musk氏、SpaceXが2~3カ月以内にFableまたはGPT-6級モデルを保有する可能性を示唆

前瞻与传闻

Musk氏、SpaceXが2~3カ月以内にFableまたはGPT-6級モデルを保有する可能性を示唆

マスク氏は、SpaceXが2〜3カ月以内にFableまたはGPT-6水準のモデルを保有する可能性について、慎重ながら楽観視していると述べた。開発の加速が続けば、同社は約6カ月後に先頭に立つ可能性があると予測し、大規模な計算資源を迅速に展開する能力も示したとしている。

マスク氏はソーシャルプラットフォームへの投稿で、SpaceXが2〜3カ月以内にFableまたはGPT-6水準のモデルを保有する可能性があり、AI研究開発の進展が引き続き加速すれば、約6カ月後に先頭に立つ可能性があるとの見方を示した。同氏の説明によると、SpaceXはAI研究開発をさらに加速させる方針で、同社のAI事業は約3年間、AnthropicとOpenAIの関連事業はそれぞれ約6年間と10年間にわたり展開されている。マスク氏は、大規模な計算資源を迅速に展開することは非常に難しいものの、SpaceXはその能力をすでに示しているとも述べた。

原文を読む →

Google、Gemini 4の進捗を明かす:ポストトレーニング初期段階で、社内コーディングツールに導入済み

前瞻与传闻

Google、Gemini 4の進捗を明かす:ポストトレーニング初期段階で、社内コーディングツールに導入済み

Google DeepMindの責任者によると、次世代フラッグシップモデルGemini 4は後学習の初期段階に入った。関連報道では、エンジニアが社内で同モデルを使い、Antigravity AIコーディングツールを稼働させている。Googleは年末よりかなり前の早期版公開を計画しているが、公開日は未定となっている。

Google DeepMind責任者のコライ・カヴクチュオール氏は、The Informationが主催したAI Agenda Liveサミットで、Gemini 4が後学習の初期段階に入り、Googleは年末よりかなり前に早期版を公開し、その後も迅速なイテレーションを続ける計画だと説明した。この時期は公開方針を示したもので、確定した公開日ではない。関連報道によると、Gemini 4ではガードレールの開発と安全性テストも進められており、Googleのエンジニアは社内で同モデルを使ってAntigravity AIコーディングツールを稼働させている。外部提供の時期は、計画中の早期版公開に依存する。

原文を読む →

Anthropicが株式構造を調整か、共同創業者7人が議決権の50.1%を掌握へ

前瞻与传闻

Anthropicが株式構造を調整か、共同創業者7人が議決権の50.1%を掌握へ

The Informationが関係者の話として報じたところによると、AnthropicはIPO前に議決権を再編し、Dario Amodeiら共同創業者7人が大半の会社事項について合計50.1%の議決権を持つ仕組みを計画している。

The Informationが関係者の話として報じたところによると、AnthropicはIPO前に実施する株式構造の変更について株主の承認を求めており、CEOのDario Amodeiとほかの共同創業者6人に特別な種類の株式を付与し、大半の会社事項について7人が合計50.1%の議決権を持つ計画である。この仕組みは、7人のうち少なくとも3人が規定された数量の同社株式を保有し続けることが条件で、取締役の選任には適用されない。同報道によると、Anthropicは従業員にも別の種類の特別株式を付与し、一部の会社事項に関する採決が同数になった場合の決定に使う計画である。

原文を読む →

Google、OpenAI、AnthropicがAI安全基準の自主規制団体を設立か

前瞻与传闻

報道によると、Google、OpenAI、Anthropicは、政府の監督を設けない方針で、SAFAと暫定的に呼ばれるフロンティアAI安全基準の自主規制団体を準備しており、2026年末または2027年初頭に発足する可能性がある。

The Informationによると、Google、OpenAI、Anthropicは、フロンティアモデル開発企業を対象とするAI安全基準の自主規制団体の設立を進めており、政府の監督を設けず、2026年末または2027年初頭に発足する可能性がある。関係者によると、団体の暫定名称はStandards Authority for Frontier AI(SAFA)で、モデルの実用化前に第三者がテストを実施できるよう支援するほか、安全およびセキュリティ上のインシデントの報告方法と、独立監査人に求める資格要件を策定する方針である。準備作業部会は、同団体がモデルの安全性と能力のテストを直接担うかどうかを引き続き協議しており、役割の全容はまだ確定していない。計画は現在も設立に向けた協議段階にある。

原文を読む →