Epoch 0
ZH · EN
デイリー AI ニュース
2026-08-04
出典:橘鸦 AI 早报 · 16 件
阿里千问、Qwen3.8-Max正式版を発表、来週モデル重みをオープンソース化へ
要闻
阿里千问はQwen3.8-Maxモデルの正式版を発表した。本モデルはQwen 3.5のアーキテクチャ基盤に基づき、総パラメータは2.4T、活性化パラメータは95B。現在、公式APIプラットフォームおよびToken Plan、Qwen Studio、Qoderシリーズなどの製品で利用可能。公式によると、本モデルはプログラミング、オフィス、長期タスク、マルチモーダルエージェントなどの分野で全面的に向上した。公式テストによると、本モデルは約16日間にわたる長期的な自動プログラミングを単独で完了できる。モデルの重みは来週公開され、Qwen3.8-27Bモデルも重みが公開される予定。
阿里巴巴は本日、Qwen3.8-Maxモデルを発表し、Qwen AIプラットフォームのAPIサービスおよびToken Plan、Qoderシリーズなどの製品に搭載しました。このモデルはQwen 3.5アーキテクチャに基づいて構築され、総パラメータ2.4兆、アクティブパラメータ95B、100万トークンのコンテキストをサポートします。価格設定は、国内では100万トークンあたり入力12元、出力36元、海外ではそれぞれ2ドル、6ドルです。
公式によると、このモデルはプログラミング、オフィス業務、長期タスク、マルチモーダルエージェントなどで全面的に向上しました。公式テストによれば、約16日間にわたる長期的な自律プログラミングを単独で完了できます。Arena.aiのランキングデータによると、このモデルのビジョンとプログラミング能力はそれぞれ2位と4位です。
公式は、このモデルのウェイトを来週公開すると発表しました。これはQwen初のMax規模のオープンソースウェイトモデルであり、Qwen3.8-27Bモデルのウェイトも公開されます。このモデルはOpenAIおよびAnthropicのインターフェースと互換性があり、主要なエージェントフレームワークへの統合をサポートしています。
原文を読む →
MiniMax-H3の重みが正式リリース、ComfyUIがネイティブ対応
要闻
MiniMaxは全モーダル生成システムMiniMax-H3を正式にオープンソース化した。今回リリースされたモデル重みには、H3-BaseのFL2VAとRef2VAの2つのチェックポイントが含まれる。関連する重みはComfyUIのネイティブサポートを獲得している。そのライセンスは、米国やEUなどの国と地域での使用を禁止している。
MiniMaxは、全モーダル生成システムMiniMax-H3を正式にオープンソース化し、HuggingFaceでモデルウェイトを公開しました。テキスト、画像、音声、ビデオの統一的解釈をサポートし、最大2K解像度、15秒間、24FPS、32kHzステレオサウンドのビデオを生成できます。今回公開されたモデルウェイトは主に、H3-Base-FL2VAとH3-Base-Ref2VAの2つのタスク専用チェックポイントです。H3-Context-IRとH3-Regenerate-2Kの公式実装はまだオープンソース化されておらず、現在は公式API経由で利用できます。そのうちH3-Context-IRには、独自の代替処理フローを構築するためのガイドも提供されています。ComfyUIはウェイト公開当日からネイティブにサポートしています。ライセンスは米国、EU、英国、韓国での使用を禁止しており、MiniMaxの従業員RyanLee氏は、米国での制限はハリウッドの制作会社との生成的ビデオ著作権訴訟に起因すると述べています。米国のユーザーは正式なライセンス申請を提出できます。
原文を読む →
Qoder1周年:Qwen3.8-Maxが全端末で利用可能に、新旧ユーザーに無料呼び出し
开发生态
QoderはQwen3.8-MaxがQoderの全端末で正式に利用可能になったと発表した。8月3日から9月3日までの間、新規ユーザーと有料ユーザーは800回の無料呼び出しを受け取ることができ、注文時にさらに2000回を追加できる。また、毎日オフピーク時間帯は50%割引の課金となり、個人版と法人版の両方に適用される。中国版では招待特典キャンペーンも開始された。
Qoderは、1周年を記念して、Qwen3.8-MaxがQoder国際版および中国版の全クライアントに正式に搭載されたことを発表しました。8月3日から9月3日までの期間中、新規登録ユーザーと既存の有料ユーザーはQwen3.8-Maxの無料呼び出しを800回受け取ることができます。キャンペーン期間中の注文でさらに2000回を追加でき、呼び出し回数の有効期限は9月30日までです。さらに、毎日22:00から翌日08:00(UTC+8)までのオフピーク時間帯は5割引で、個人版と企業版の両方で利用できます。中国版では、友人を招待してポイントを獲得できるキャンペーンも開始しています。
原文を読む →
阿里云百炼 Token Plan が Qwen3.8-Max 正式版を提供開始、週間制限をリセット
开发生态
阿里云百炼 Token Plan は、Qwen3.8-Max 正式版の提供開始を発表した。旧バージョンの Qwen3.8-Max-Preview は8月5日に終了し、有効なサブスクリプションを持つユーザーは、7日分のクォータを1回リセットできる権利を得られる。
阿里雲百炼プラットフォームは、Qwen3.8-Max正式版がリリースされ、個人版のToken Planもこのモデルをサポートしていることを発表しました。公式は北京時間8月5日から、これまでにサブスクリプションしたすべてのユーザーに1回限りの7日間クォータリセット権利を配布します。ユーザーは権利の有効期間内に必要な分だけ利用可能クォータをリセットできます。旧Qwen3.8-Max-Previewバージョンは8月5日に廃止されるため、公式はオンラインサービスに影響が出ないよう、ユーザーに速やかな切り替えを推奨しています。Qwen3.8-MaxのCredits消費基準については、公式はユーザーがコンソールで使用量統計を確認し、使用ペースを適切に計画するよう推奨しています。
原文を読む →
Ant Ling が OpenRouter プラットフォームでの Ling-3.0-flash 無料期間を延長
开发生态
Ant Ling は、OpenRouter プラットフォームで Ling-3.0-flash モデルを無料で利用できる期間が太平洋時間8月6日午前8時まで延長されたと発表した。ユーザーは引き続きこのモデルを無料で体験できる。
Ant Ling公式は、同社のLing-3.0-flashモデルのOpenRouterプラットフォームでの無料アクセス期間が延長されたことを発表しました。ユーザーは現在、このプラットフォームでLing-3.0-flashを引き続き無料で利用できます。今回の無料期間は、太平洋時間8月6日午前8時まで続きます。
原文を読む →
TRAE が既存ユーザーにポイントを追加付与し、複数の機能アップグレードを推進
开发生态
TRAE はポイント制度の開始後、既存の有料ユーザーに追加の汎用ポイントを付与し、未アップグレードユーザーへの移行加算ポイントを2倍にすると発表した。また公式は、画像・動画生成の制限調整や、より大きなコンテキストウィンドウのサポートなどの機能を推進していると述べ、ユーザーの要望に応えるとしている。
TRAEはポイント制度の導入後、既存ユーザー向けに2つの特典を追加すると発表した。新しいポイント制度にアップグレード済みの有料ユーザーは、8月3日に会員ランクに応じて一般ポイントを追加で受け取り、有効期限は31日間である。まだアップグレードしていない速通ユーザーには、一括移行時の加算ポイントが従来の2倍に引き上げられ、ポイント制度への切り替え日から31日間有効である。2つの特典はいずれも一般ポイントで、TRAE WorkとTRAE IDEの全端末で共通利用でき、入金後は操作不要で使用できる。また、公式は画像・動画生成の制限調整、より大きなコンテキストウィンドウへの対応、モデルの思考強度選択機能、Deepseek-V4-Flash正式版モデルのリソース増強によるより多くのユーザーへの対応などを推進中であると述べている。
原文を読む →
Kiro が統一された Kiro agent harness を発表、全4クライアントで利用可能に
开发生态
Kiro は、各クライアントの独立したアーキテクチャに代わる統一された Kiro agent harness を発表した。新しいスイートは Kiro IDE、CLI、Web、iOS で全面的に利用可能になり、クロスプラットフォームで一貫した設定を実現する。
Kiroは公式に、これまでの3つの独立したエージェントスイートを単一の「Kiro agent harness」に統合したと発表した。このスイートは現在、Kiro IDE、CLI、Web、iOSの4つのクライアントで全面展開されている。新アーキテクチャは独立したサーバープロセスとして動作し、Agent Client Protocol(ACP)とその拡張機能を介してクライアントと通信することで、規範駆動開発、カスタムエージェント、フックが全クライアントで一貫した動作と設定形式を実現する。さらに、Kiroは従来のクライアント間で互換性のなかった権限システムに代わり、Cedarベースの単一能力レベル権限モデルを導入した。
原文を読む →
OpenRouter が Ori Eval を公開、モデル比較と定量的レコメンデーションをサポート
开发生态
OpenRouter は、開発者がプロジェクトに最適なモデルを選択するのに役立つ評価ツール Ori Eval を公開した。Ori Eval は、プログラミングエージェントを通じてコードベースを自動的にスキャンし、プロバイダー間のモデル比較を実行する。
OpenRouterは、CLIツールおよび評価フレームワークである「Ori Eval」を公開した。現在利用可能である。Ori Evalを使用すると、開発者は実在のプロンプトでエージェントをテストすることでプロジェクトに最適なモデルを見つけることができ、コードベースの自動スキャン、評価ファイルの作成、プロバイダー間のモデル比較の実行、スコア付きの推奨事項の提供が可能である。実行ごとにharnessとモデルを固定することで、再現可能な結果を保証する。開発者はエージェントを介してcurlコマンドで起動するか、CLIを手動インストールできる。BunランタイムとOpenRouterのログイン資格情報が必要で、評価は実際のモデルを呼び出し、料金が発生する。
原文を読む →
Interconnects AI が Artifacts Hub と Adoption Dashboard を公開、オープンソースモデルのトレンドと採用状況を分析
开发生态
Interconnects AI は、オープンソースモデルのエコシステムを理解するための2つの無料ツールの提供開始を発表した。Artifacts Hub はオープンソースモデルのトレンドを追跡し、Adoption Dashboard は地域と組織別のモデル採用データを表示する。
Interconnects AIは、Artifacts HubとAdoption Dashboardという2つの無料リソースを発表した。Artifacts Hubは、OpenRouterの推論トークンデータ、Artificial Analysisのモデル知能スコア、Hugging Faceのデータに基づくカスタム採用指標を統合したキュレーションビューで、現在は過去2年間に公開された792のモデルをカバーしている。Adoption Dashboardは、地理的領域と組織ごとにダウンロード数と派生モデル数を表示する動的ダッシュボードで、米中格差とオープンソースエコシステムの新興プレーヤーを強調している。
原文を読む →
Cloudflare がオープンソースのAgentランタイム @cloudflare/computer を発表
开发生态
Cloudflare は、オープンソースのAgentランタイム @cloudflare/computer の早期プレビュー版を発表した。これはAgentに独立した計算環境を提供し、SQLite仮想ファイルシステムを活用して、isolatesとLinuxコンテナを動的にオーケストレーションしてタスクを実行する。
Cloudflareは、オープンソースのエージェントランタイムの初期プレビュー版「@cloudflare/computer」を公開した。各エージェントに独立した「コンピュータ」環境を提供することを目的としている。その中核は、SQLiteベースの仮想ファイルシステムであり、タスクの要件に応じて、高速なisolatesと完全なLinuxコンテナを動的にオーケストレーションする。公式は、この設計はパフォーマンスとコストの最適化を目的としており、エージェントが大部分の作業でisolatesを使用し、コンテナが必要なのはタスクの10%未満であることを目標としていると述べている。開発者は現在、npmでライブラリをインストールして試用できる。
原文を読む →
Cloudflare が Billable Usage API を公開、セルフサービスアカウントでコストと使用量をプログラムから照会可能に
开发生态
Cloudflare は、新しい Billable Usage API を発表した。セルフサービスアカウント向けに開放され、単一のエンドポイントで全製品の使用量とコストを照会できる。
Cloudflare は Billable Usage API を公開し、セルフサービスアカウント向けに単一エンドポイントでプログラム的にコストと使用量を照会できる機能を提供します。Workers、R2、D1、Workers AI、Vectorize、Images、Stream など、すべての従量課金製品をカバーします。API のフィールドは FinOps のオープンコスト・使用量仕様である FOCUS に準拠し、製品と請求サイクルごとの明細行を返します。現在、使用量とコストのデータは毎日更新され、エンタープライズ契約のサポートは開発中です。
原文を読む →
NousResearch が Hermes Agent v0.20.0 をリリース
产品应用
NousResearch は Hermes Agent v0.20.0 をリリースした。このバージョンには、ストリーミング対話音声、Agent-to-Agentプロトコル、デスクトップアプリプラグインSDKなどの新機能が追加されている。
NousResearch は Hermes Agent v0.20.0 をリリースしました。前バージョンと比較して、このバージョンには約 3,650 回のコミットと約 1,400 件のマージされた PR が含まれます。今回のアップデートの中心的な新機能は、ストリーミング合成と途中割り込み可能なリアルタイム会話音声モードのサポートで、CLI、デスクトップアプリ、Feishu などの複数プラットフォームをカバーします。また、Agent-to-Agent v1.0 プロトコル、アウトバウンド Webhook、事実確認スキル、デスクトップアプリ用の plugin SDK と artifacts サンドボックスプレビューも導入されました。ツール呼び出しのデフォルトの反復上限は 90 から 500 に引き上げられ、コンテキストの軽微な圧縮メカニズムが導入され、コールドスタートは約 1.8 秒に短縮されました。
原文を読む →
米国がAI規制枠組みを完成、主要テック企業にレビューを要請と報道
行业动态
報道によると、米国政府はOpenAI、Google、AnthropicなどのAI企業に対し、火曜日に完成した自主的なAI規制枠組みのレビューを要請した。この枠組みは、フロンティアモデルの公開前に政府へ提出するプロセスを確立する。
The Information の独占報道によると、米国政府は OpenAI、Google、Anthropic などの主要テクノロジー企業の従業員を火曜日にホワイトハウスに招き、完成した AI 規制枠組みの最終版をレビューするよう依頼しました。この枠組みは自主的な性質であり、各研究所が最先端モデルを公開する前に政府に提出することを求めるプロセスを確立します。
原文を読む →
OpenAI が GPT-Live のアーキテクチャを詳説:全二重モデルと非同期委任
技术与洞察
OpenAI は、第3世代音声システム GPT-Live について詳しく説明した。これは全二重モデルを採用し、ターン検出器を排除して、同時に聞くことと話すことをサポートする。深い推論やツールの使用が必要な場合、音声ストリームを中断せずに GPT-5.5 を非同期に呼び出すことができる。
OpenAI は、第 3 世代音声システム GPT-Live の基盤アーキテクチャを詳しく説明しました。このシステムは全二重モデルを採用し、同時に聞くことと話すことをサポートし、従来のターン検出器を廃止してレイテンシーを低減します。深い推論やツール呼び出しが必要な場合は、GPT-5.5 などの最先端モデルを非同期で呼び出し、コアの音声ストリームを中断しません。
この体験を実現するため、OpenAI は 6 か月かけてシステムを再構築し、コアメディアストリームとビジネスロジックを分離しました。システムは Python の代わりに Go 言語を採用し、新しいシステムの p95 フレーム品質は旧システムの p50 に匹敵します。チームは WARP プロトコルと Instant Connect テクノロジーを開発し、ネットワーク起動の往復回数を 6 回から 1 回に削減しました。システムはインスタンスのシームレスな切り替えと動的コンテキスト圧縮をサポートし、公開前には実際のトラフィックの一部をルーティングしてサイレントテストを実施しました。
現在、GPT-Live は ChatGPT Voice をサポートしており、PC 制御や Agent の調整などの機能を含み、専用 API は近日公開予定です。
原文を読む →
Google Agent Skills チームがプロジェクトの構築、テスト、品質管理の仕組みを共有
技术与洞察
Google Agent Skills チームは、このプロジェクトの Skills の構築と品質メカニズムについて共有した。プロジェクトでは、スキルが自動化されたチェックと継続的な評価を通過することが求められ、規模拡大時の品質を保証している。
Google Agent Skills チームは、構築、テスト、スケーリングのプロセスにおける品質管理メカニズムを詳しく説明しました。このプロジェクトは、Google Cloud のドメイン知識を構造化されたオープンソースの指示としてエンコードし、AI Agent の幻覚を減らし、ベストプラクティスを強制することを目的としています。スケーリング時の品質を保証するため、チームは各 Skill に標準化されたリポジトリレイアウトを定義し、リモート MCP ツールを優先的に参照するように設計しました。すべての Skill は公開前に、リンクチェックを含む自動 CI/CD パイプラインを通過する必要があり、コミット時と毎週、正確性と効率性に基づく継続的評価を受けます。
原文を読む →
智谱のGitHubリポジトリとZCodeドキュメントにGLM-5.3関連の記述が出現
前瞻与传闻
コミュニティユーザーの発見によると、智谱のZCodeドキュメントに GLM-5.3 関連の記述が一時的に出現した。同時に智谱公式のGitHubリポジトリにも関連する文字が現れたが、公式はGLM-5.3に関する詳細情報をまだ明らかにしていない。
社区ユーザーが智谱の公式GitHubリポジトリ「zai-org/z-ai-sdk-java」に「glm-5.3」ブランチが存在するのを発見し、ZCodeのドキュメントページにも「GLM-5.3」関連の表記が一時的に表示されていたことから、このモデルがまもなくリリースされる可能性が高いとみられている。上記の情報はいずれもコミュニティユーザーによる公式リポジトリとドキュメントの観察に基づくものであり、智谱はまだGLM-5.3のリリース時期や利用可能範囲を公式に発表していない。
注記:本内容はAI支援によって作成されたものであり、幻覚や誤りが含まれる可能性があります。
原文を読む →