デイリー AI ニュース

2026-07-30

出典:橘鸦 AI 早报 · 19 件

2026-07-30
2026-08-04 2026-08-03 2026-08-02 2026-08-01 2026-07-31 2026-07-30 2026-07-29 2026-07-28 2026-07-27 2026-07-26

OpenAI、GPT-5.6 Solの効率改善を展開し、Codexの利用制限をリセット

要闻

OpenAI、GPT-5.6 Solの効率改善を展開し、Codexの利用制限をリセット

Codex責任者のTibo氏は北京時間7月29日正午に、すべてのChatGPT WorkおよびCodexユーザー向けに割り当てをリセットし、効率改善を展開したと発表した。Solの消費が速すぎる問題に対応するため、今回の改善ではツール待機とウェブ検索のシナリオを最適化し、一般的な使用時間は約18%延長すると見込まれる。同時に、これまで停止されていた5時間制限が間もなく再開される。注目すべきは、Tibo氏がその後コミュニティユーザーの要請に返信し、現地時間7月31日に再度利用量のリセットを実行する可能性を示唆したことだ。

Codex責任者のTibo氏は北京時間7月29日正午に、すべてのChatGPT WorkおよびCodexユーザーの利用枠をリセットし、効率改善を展開したことを発表した。Solの利用枠消費が速すぎる問題に対処するためである。その原因について、Tibo氏は以下の点を説明した。GPT-5.6 Solはより長時間の継続作業、より多くのツール呼び出し、そしてツール横断的およびsubagentの複雑なワークフローの調整を好む。同じ推論強度でも以前のモデルよりも作業強度が高く、High設定ではGPT-5.5のHigh設定よりも多くのトークンを消費する。プログラムによるツール呼び出しはSolにツール呼び出しを並行実行したり、待機中に作業を継続したりする柔軟性を与えるが、その一方で1回の応答あたりの生成量が増え、キャッシュ入力トークンが増加し、使用量が予想を上回る。この現象はSolがツール呼び出しの完了を待つ場合や大量のウェブ検索を実行する場合に特に顕著である。影響の分布も均一ではない。中央値のユーザーはSolのトークン効率はまずまずだと感じている一方、より難しいタスクを処理する一部のヘビーユーザーは利用枠の消費がはるかに速い。チームはリリース前に平均および中央値の使用量に過度に注目し、ロングテールのケースを十分に考慮していなかった。今回の改善では、ツール待機時間とウェブ検索のシナリオが最適化され、典型的な使用時間は約18%延長すると見込まれる。それと同時に、先日停止されていた5時間の制限は明日から再開される。注目すべきは、Tibo氏がその後コミュニティユーザーの要望に応え、現地時間7月31日に再び使用量リセットを実行することを示唆したことだ。

原文を読む →

SpaceXAI、音声モデル「Grok Voice Think Fast 2.0」を発表

模型发布

SpaceXAI、音声モデル「Grok Voice Think Fast 2.0」を発表

SpaceXAIは次世代音声モデル「Grok Voice Think Fast 2.0」を発表し、複数の音声ベンチマークテストでスコアが大幅に向上したと公式に発表した。現在、このモデルはAPIとVoice Agent Builderで利用可能。

SpaceXAIは新世代音声モデルGrok Voice Think Fast 2.0を発表し、インテリジェンス、文字起こし精度、会話能力を重点的に改善した。公式発表のデータによると、このモデルは複数の音声ベンチマークテストでスコアが大幅に向上し、公式は騒音環境での文字起こし精度が専用の音声テキスト変換モデルよりも優れていると述べている。このモデルは現在、APIおよびVoice Agent Builderで提供されており、価格は音声1分あたり0.08ドルである。

原文を読む →

Google DeepMindが音楽モデル「Lyria 3.5」を公開

模型发布

Google DeepMindは音楽生成モデル「Lyria 3.5」を公開し、Google Flow Musicプラットフォームに統合した。新バージョンでは歌詞の品質とボーカルの表現力が向上し、より複雑なメロディーに対応している。

Google DeepMindは最新の音楽生成モデルLyria 3.5を発表し、現在このモデルは正式にGoogle Flow Musicプラットフォームに統合され、ユーザーが利用できるようになった。公式によると、Lyria 3.5はより豊かな編曲と複雑なメロディ構造をもたらし、より高品質な歌詞を生成し、ボーカルの表現力、感情の繊細さ、発音の自然さを大幅に向上させた。創作コントロールの面では、新しいモデルはユーザーの創作指示により良く従い、正確なBPMと時間長の設定をサポートし、完全な曲のステムをエクスポートすることができる。

原文を読む →

SKT、688Bパラメータのオープンソース大規模モデル「A.X K2」とオーディオ版を公開

模型发布

SKT、688Bパラメータのオープンソース大規模モデル「A.X K2」とオーディオ版を公開

SKTはオープンソースの大規模言語モデル「A.X K2」を公開した。総パラメータ数は688B、アクティブパラメータは33Bで、ネイティブFP8トレーニングを採用している。また、オーディオ言語モデル「A.X K2 ALM」も発表し、その重みは後日公開される予定。

SKTはオープンソース大規模言語モデルA.X K2とその音声版A.X K2 ALMを発表した。A.X K2はMoEアーキテクチャを採用し、総パラメータ数は688B、活性化パラメータ数は33Bであり、ネイティブFP8精度でトレーニングされ、最大256Kコンテキストをサポートする。公式によると、このモデルは数学と韓国語の分野で優れた性能を発揮し、IMO 2025テストで金メダルの基準に達した。現在、A.X K2のウェイトはHugging Face上でApache-2.0ライセンスの下でオープンソース化されている。A.X K2 ALMオーディオモデルはフリーズされたA.X K2 Lightバックボーンに基づいて構築されており、現在ウェイトは公開されておらず、公式は後日公開する予定であると述べている。

原文を読む →

Cursor公式がiPad版Cursorの提供開始を発表

开发生态

Cursor公式がiPad版Cursorの提供開始を発表

Cursor公式は、iPad版Cursorが利用可能になり、iPhone版の全機能を備えていると発表した。iPhone版とiPad版の両方に、inboxと完全なPRレビュー体験が同時に追加された。

Cursor公式は、CursorがiPadで利用可能になったことを発表した。iPad版はiPhone版と同じ全機能を提供し、ユーザーがエージェントと協力するためのより多くのスペースを提供する。同時に、iPhone版とiPad版の両方に、整理整頓のためのinbox機能と、完全なPRをカバーするレビューエクスペリエンスが新たに追加された。このレビューエクスペリエンスは、コメントの表示、確認、承認をサポートする。

原文を読む →

支付宝がAI決済開発者向けインセンティブプログラムをアップグレード

开发生态

支付宝がAI決済開発者向けインセンティブプログラムをアップグレード

支付宝はAI決済開発者向けインセンティブプログラムをアップグレードし、最高5660元のToken専用補助金を提供する。本日から8月21日まで、個人開発者が指定の収納商品を統合すれば参加できる。

支付宝はAI決済開発者向けインセンティブプログラムのアップグレードを発表し、AI開発者に対して最高5,660元のToken専用補助金を引き続き提供するとともに、インセンティブの適用範囲をさらに拡大し、参加ハードルを引き下げる。本日から8月21日まで、個人開発者がVibe Coding時に支付宝のAI従量課金、AIウェブアプリ決済、またはAIモバイルアプリ決済のいずれかの決済商品を統合すれば、累計有効取引ユーザー数に応じて段階的なインセンティブを受けられる。さらに、個人開発者はAI従量課金を利用する場合、2026年12月31日まで手数料0%の優遇を受けることができる。

原文を読む →

Qoder、AIプログラミングエージェント評価ツール「Better Harness」をオープンソース化

开发生态

QoderはAIプログラミングエージェント評価ツール「Better Harness」をオープンソース化した。これは、タスク理解などの5つの側面からエージェントのワークフローをレビューし、証拠付きのレポートと修正提案を生成する。

Better Harnessは、QoderAIが開発したAIプログラミングエージェントのワークフロー評価ツールであり、現在GitHub上でMITライセンスのもとオープンソース化されている。このツールは、タスク理解、制御された実行、変更検証、信頼性のある納品、学習獲得の5つの次元でプロジェクトを審査し、証拠付きのレポートを生成するとともに、発見事項を優先度付きの修正推奨事項に変換する。Better Harnessは、Claude Code、Codex Desktop、Codex CLI、Cursor、およびQoderをサポートしている。

原文を読む →

Perplexity、クライアントエンド向けエージェントセキュリティ検知・対応スイート「Numbat」をオープンソース化

开发生态

Perplexity、クライアントエンド向けエージェントセキュリティ検知・対応スイート「Numbat」をオープンソース化

Perplexityは、エージェントフレームワーク横断のセキュリティ検知・対応レイヤー「Numbat」をオープンソース化した。セキュリティチームはエージェントの行動をリアルタイムで監視し、危険な動作が実行される前に遮断できる。

Perplexityは、クライアント端末向けのAgent検出・対応セキュリティスイートであるNumbatを正式にオープンソース化した。Numbatは、デスクトップ、コマンドライン、IDE、ゲートウェイのエージェントフレームワークにわたり動作し、エージェントフックサブシステム、セッション成果物、OTLPテレメトリデータを統合することで、セキュリティチームにリアルタイム監視、ローカル検出、実行前ブロック、フォレンジックリコンストラクション機能を提供する。Numbatには52の検出ルールが組み込まれており、機密情報へのアクセス、データ漏えい、権限昇格、横移動など11の行動カテゴリをカバーし、マルチステップシーケンスの検出も行う。Perplexityは社内で既にNumbatを使用して、エンジニアが利用するClaude Code、Codex、OpenCode、Piなどのコーディングエージェントを保護している。Numbatは現在、Apache 2.0ライセンスのもと、単一のGoバイナリとして提供されており、macOS、Linux、Windowsをサポートしている。

原文を読む →

OpenAIが「ChatGPT for Academic Researchers」プログラムを開始

产品应用

OpenAIは「ChatGPT for Academic Researchers」プログラムを開始し、科学者、数学者、エンジニアに最先端モデルのアクセスを無料で提供する。このプログラムはまず1万人の研究者を対象とし、2027年までに10万人に拡大する見込み。

OpenAIは、科学・数学・工学分野の研究者に最先端モデルへの無料アクセスを提供する「ChatGPT for Academic Researchers」プログラムを発表した。公式情報によると、このプログラムは最初に1万人の研究者を対象とし、2027年までに10万人に拡大する計画で、主に選定された学術機関のユーザーを対象としている。公式は、この取り組みは研究者が高度な問題を処理し、科学的発見を加速し、生産性を向上させることを目的としていると述べている。

原文を読む →

Google、macOS版Geminiアプリに新しい自然言語音声機能を導入

产品应用

Google、macOS版Geminiアプリに新しい自然言語音声機能を導入

macOS版Geminiに新しい音声機能が登場。ユーザーはFnキーを長押しするだけでスマートディクテーションができ、設定を有効にすると、画面コンテキストと組み合わせて複雑なタスクを実行できる。現在、世界中の英語ユーザー向けに展開中。

Googleは、Gemini for macOSアプリに新しい自然言語音声インタラクション機能が追加されたことを正式に発表し、ユーザーが音声でコンテンツの作成、編集、要約を行えるようにした。デスクトップの任意のウィンドウでFnキーを長押しすると、デフォルトのスマートディクテーション機能が使用でき、アプリはフィラーワードを自動的にフィルタリングし、途中での訂正をキャッチして、フォーマットされたテキストをカーソル位置に直接出力する。ユーザーが設定でGemini推論機能を手動で有効にすると、アプリは現在の画面上のコンテキストを理解し、音声指示に基づいてローカルファイルの抽出と要約、テキストの書き換え、画像の生成と編集などの複雑なタスクを実行できる。この機能は現在、世界中のすべてのGemini for macOSアプリユーザーに提供されており、現時点では英語のみをサポートしているが、今後さらに多くの言語を追加する予定である。

原文を読む →

Replitが新しいAIデザインツール「Replit Design」を発表

产品应用

Replitが新しいAIデザインツール「Replit Design」を発表

ReplitはAIデザインツール「Replit Design」を発表し、現在すべてのユーザーに開放している。このスイートにはAmbient Intelligenceが組み込まれており、ワンクリックでブランドシステムを適用できる。

Replit公式は、新しいAIデザインクリエイティブスイート「Replit Design」を発表し、現在このツールは全面稼働しています。Replit Designには「Ambient Intelligence」という機能が組み込まれており、デザインの各ステップでユーザーにワンクリックで採用できる提案バージョンを提供します。ユーザーはプロンプトを入力したり、専門的なデザイン用語を理解する必要はありません。モデルサポートにおいては、ユーザーは複数のモデルを自由に選択し、異なるモデルの出力結果を比較できます。さらに、このスイートはMobbinが所有する60万以上の実在アプリのUI画面を直接統合しており、ユーザーは別途Mobbinアカウントに登録することなく利用できます。

原文を読む →

Hermes Agentに「Hey Hermes」音声ウェイクワードを追加

产品应用

Hermes Agentはローカル音声ウェイク機能を導入した。ユーザーがウェイクワードを話すと、ハンズフリーで新しいセッションを開始できる。この機能の検出はすべてローカルで行われ、デフォルトではオフになっている。

Hermes Agentは正式に音声ウェイクアップ機能をリリースしました。ユーザーが特定のフレーズを話すことで、ハンズフリーで新しい音声セッションを開始できます。この機能はコマンドラインインターフェース(CLI)、TUIインターフェース、およびデスクトップアプリでサポートされています。プライバシーを確保するため、ウェイクワードの検出プロセスは完全にローカルデバイス上で実行され、ユーザーが実際の指示を話すまで、オーディオがデバイスから送信されることはありません。この機能は現在デフォルトでオフになっており、ローカルマイクを備えたインターフェースでのみ利用できます。

原文を読む →

OpenAI、2つのAPI設定でGPT-5.6のベンチマークスコアが3倍になると主張

技术与洞察

OpenAI、2つのAPI設定でGPT-5.6のベンチマークスコアが3倍になると主張

OpenAIは、保持推論と圧縮という2つのAPI設定を有効にすることで、GPT-5.6 SolのARC-AGI-3ベンチマークテストのスコアが3倍の38.3%に向上し、出力トークンが6分の1に減少したと発表した。

OpenAI公式ブログによると、GPT-5.6 Solでリザーブ推論と圧縮の2つの設定を有効にすることで、ARC-AGI-3ベンチマークの性能が大幅に向上しました。公式データによると、このモデルは最高設定でスコアが当初の13.3%から38.3%に上昇し、約3倍の改善、出力トークンは6倍削減されました。OpenAIは、以前のテストツールの推論破棄とスクロール切り捨てメカニズムが低スコアの原因だったと指摘しています。公式はAPI開発者に対し、Responses APIで同じ設定を使用してパフォーマンスを最大化することを推奨しています。

原文を読む →

OpenAI、GPT-5.6 Solを適用して自社の運用を最適化:サービスコストが20%削減

技术与洞察

OpenAI、GPT-5.6 Solを適用して自社の運用を最適化:サービスコストが20%削減

OpenAIは、GPT-5.6 Solを適用して自社の運用インフラを最適化したプロセスを紹介した。プロダクション中核の書き直しと投機的デコードの改善により、サービスコストが20%削減され、トークン生成効率が15%以上向上した。現在、この最適化は推論スタックとAgentic harnessに適用されている。

OpenAIは、GPT-5.6モデルファミリーの効率改善に関する記事を公開しました。公式によると、彼らはCodexでフラッグシップモデルGPT-5.6 Solを適用し、自社のインフラストラクチャとパフォーマンスを最適化しています。公式データによると、TritonとGluon言語を使用してプロダクションコアを書き直すことで、このモデルはエンドツーエンドのサービスコストを20%削減しました。また、投機的デコードの改善により、トークン生成効率が15%以上向上しました。現在、これらの最適化はOpenAIの推論スタックと、CodexやChatGPT Workで使用されるAgenticハーネスに適用されています。

原文を読む →

腾讯混元、投機的デコードフレームワーク「AngelSpec」をオープンソース化

技术与洞察

腾讯混元、投機的デコードフレームワーク「AngelSpec」をオープンソース化

腾讯混元チームは、訓練とデプロイをサポートする投機的デコードフレームワーク「AngelSpec」をオープンソース化した。公式によると、Hy3-A21B上で最大2.4倍のエンドツーエンド高速化を実現できる。

Tencent Hunyuanチームは、エンドツーエンドの投機的デコードフレームワーク「AngelSpec」をオープンソース化し、v0.1.0バージョンをリリースしました。このフレームワークはtorch-nativeベースで、MTPとblock-parallel投機的デコードトレーニングをサポートし、DFly、DFlashなど6つのドラフトアーキテクチャのトレーニングパイプラインを統一しています。公式データによると、Hy3-A21Bモデルと並行度4〜64のテストで、DFlyアーキテクチャは自己回帰デコードと比較して1.98倍から2.40倍のエンドツーエンド加速を実現し、スループットはDFlashより10.5%から11.8%高くなっています。

原文を読む →

MiniMaxとFireworks AIがM3スパースアテンションGPUカーネルを共同オープンソース化

技术与洞察

MiniMaxとFireworks AIがM3スパースアテンションGPUカーネルを共同オープンソース化

MiniMaxとFireworks AIは、MiniMax M3のブロックスパースアテンション向けの2つのGPUカーネルリポジトリを共同でオープンソース化した。

MiniMax と Fireworks AI は、両社が共同開発した MiniMax M3 ブロックスパースアテンション GPU カーネルコードをオープンソース化し、2つのリポジトリを公開しました。fw-ai/minimax-kernels は Fireworks AI によって開発され、NVIDIA Blackwell(SM100)CuTe-DSL に基づく KV-outer ブロックスパースアテンションを実装しており、Apache 2.0 ライセンスを採用しています。MiniMax-AI/MSA の fireworks-msa ブランチは、既存の MSA カーネルを基盤に Fireworks の KV-outer スパースプリフィルバックエンドを統合し、MIT ライセンスを採用しています。

原文を読む →

月之暗面、35億ドルの資金調達を完了、評価額は350億ドルに

行业动态

報道によると、月之暗面は35億ドルの資金調達を完了し、調達後の評価額は350億ドルに達した。同社は現在、調達前評価額500億ドルで投資家と接触しており、早ければ今年にも香港に上場する計画だという。

ブルームバーグによると、月之暗面(Moonshot AI)は35億ドルの資金調達を完了し、当初の目標である10億〜20億ドルを大幅に上回り、調達後評価額は350億ドルに達しました。報道によると、今回のラウンドは月之暗面の Kimi K3 モデルがシリコンバレーで引き起こしたセンセーションによるものです。関係者によると、同社は現在、潜在的な投資家との接触を開始しており、プレマネー評価額500億ドルでの新たな資金調達を模索しています。これは香港上場前の最終ラウンドとなり、IPO は早ければ今年中にも実現する可能性があります。

原文を読む →

AlphaFoldチームが解散、研究者の約4分の1がGoogle DeepMindを離れる

行业动态

報道によると、Google DeepMindはAlphaFoldチームを解散し、研究者の約4分の1が去った。大多数はGeminiプロジェクトまたはIsomorphic Labsに異動した。

メディア報道によると、Google DeepMind はタンパク質フォールディングを担当する AlphaFold チームを解散しました。過去1年間で、元論文著者の大半は Gemini 大規模言語モデルに関連するプロジェクトに再配置されるか、創薬に特化した Isomorphic Labs に異動しました。Google DeepMind の研究担当副社長 Pushmeet Kohli は、研究所の戦略が進化しており、現在は科学者を支援するシステムの開発にシフトし、OpenAI や Anthropic と競いながら最先端の AI エージェントを構築していることを認めました。さらに、元著者の約4分の1は完全に退職しており、Anthropic に加わった中心メンバーの John Jumper も含まれています。

原文を読む →

SpaceXAI、AI「裸化」技術を制限する新法の施行差し止めを求めて提訴

行业动态

報道によると、SpaceXAIは米国連邦裁判所でミネソタ州司法長官を相手取り、AI「裸化」技術を制限する新法の施行差し止めを求めて提訴した。同社は法律の範囲が広すぎ、免責メカニズムが提供されていないと主張している。これにより、Grok Imagine機能を制限せざるを得なくなる。

報道によると、SpaceXAI は米連邦裁判所でミネソタ州司法長官キース・エリソンを訴え、AIによる「裸化」技術(nudification technology)を制限する新法の施行差し止めを求めています。この法律は下院法案1606号(H.F. 1606)で、2026年8月1日に施行予定であり、ウェブサイトやアプリなどのサービスの所有者がユーザーに裸化機能の使用を許可することを禁止し、違反者には行為ごとに最大50万ドルの民事罰金と私人訴訟による責任が課されます。SpaceXAI は性的ディープフェイク画像の禁止には反対しないものの、法律の範囲が広すぎるとし、合理的な措置を講じたプラットフォームに免責メカニズムを提供しておらず、同意を得た画像や表現価値のある画像にも及ぶ可能性があると述べています。同社は、この法律により Grok Imagine の画像生成・編集機能を制限せざるを得なくなるとし、米国憲法修正第1条に違反すると主張しています。

注記:このコンテンツはAI支援で作成されており、幻覚や誤りが含まれる可能性があります。

原文を読む →