デイリー AI ニュース

2026-08-28

出典:橘鸦 AI 早报 · 22 件

2026-08-28
2026-08-28 2026-08-27 2026-08-26 2026-08-25 2026-08-24 2026-08-23 2026-08-22 2026-08-21 2026-08-20 2026-08-19 2026-08-18 2026-08-17

Gemini Omni 1.1 Flashがリリース:開始・終了フレーム制御と4Kアップスケーリングを追加

要闻

Gemini Omni 1.1 Flashがリリース:開始・終了フレーム制御と4Kアップスケーリングを追加

Googleは開発者向けにGemini Omni 1.1 Flashをリリースした。同社によると、シーンの延長、開始・終了フレームの制御、1080pまたは4K出力に対応し、360pプレビューは最大60%高速で、コストは標準720pの3分の1となる。

GoogleはGemini Omni 1.1 Flashをリリースし、本バージョンは本番環境で利用可能で、開発者はGoogle AI StudioのGemini APIまたはGemini Enterprise Agent Platformから使用できると説明した。公式の説明によると、新バージョンはシーンを延長する際に直前のコンテキストを最大10秒間分析でき、従来のモデルが参照していたのは最後の1秒間のみだった。動画は1回につき10秒ずつ、累計最長40秒まで延長できる。開発者はショットの開始フレームと終了フレームを指定し、2つのキーフレーム間をつなぐ連続動画を生成できるため、カメラの周回、ズームトランジション、シームレスなループに利用できる。360pの軽量プレビューは標準720pと比べ、システムスループット基準で生成速度が最大60%向上し、コストは3分の1となる。完成動画は1080pまたは4Kで出力できる。

原文を読む →

Tibo、全ChatGPT WorkおよびCodexユーザーの利用枠がリセットされたと発表

要闻

Tibo、全ChatGPT WorkおよびCodexユーザーの利用枠がリセットされたと発表

Codex責任者のTibo氏は、ChatGPT WorkとCodexの利用枠を全ユーザー分リセットしたと表明した。一方、従来の5時間の利用制限を撤廃するよう求めるユーザーもいる。

Codex責任者のTibo氏は、ChatGPT WorkとCodexの全ユーザーについて利用枠のリセットが完了し、今回の措置が両サービスの全ユーザーに適用されたと発表した。ユーザーからの反応は、従来設けられていた5時間の利用制限に集中している。あるユーザーは、この制限によりリセット前に残りの利用枠を使い切れなかったとして、制限の撤廃を求めた。Tibo氏の発表で確認されたのは利用枠のリセット完了であり、原文では5時間の制限を撤廃するかどうかや、その変更時期には触れていない。

原文を読む →

OpenAI、予備利用枠「Luna Reserve」を導入

要闻

OpenAI、予備利用枠「Luna Reserve」を導入

OpenAI は、一部の個人向け ChatGPT Plus および Pro アカウントに Luna Reserve を開放しました。通常の利用枠を使い切ると、GPT-5.6 Luna 専用の、独立して計算され上限が設定された予備枠が提供されます。

OpenAI は現在、Codex と ChatGPT Work において、一部の個人向け ChatGPT Plus および Pro アカウントに Luna Reserve の予備枠を導入しており、アカウントの通常の利用枠を使い切った後に追加枠を提供します。Luna Reserve の枠は通常の利用枠とは別に計算され、上限が設定されており、GPT-5.6 Luna でのみ利用できます。使い切った通常枠が回復することはなく、より高性能なモデルが利用可能になることもありません。現時点では ChatGPT Business および Enterprise ワークスペースは対象外で、通常の Chat と API にも適用されません。

原文を読む →

ChatGPTの一時チャットが更新:メモリとプラグインを利用可能、通常チャットへの変換にも対応

要闻

ChatGPTの一時チャットが更新:メモリとプラグインを利用可能、通常チャットへの変換にも対応

OpenAIは、ChatGPTの一時チャットに新たな制御項目を追加すると発表した。ユーザーはチャット作成時にパーソナライズを有効にして既存のメモリ、カスタム指示、プラグインを利用できるほか、会話を保存し、アカウント設定に従う通常のチャットへ変換できる。

OpenAIの公式発表によると、ChatGPTは一時チャットの制御機能を順次導入しており、ユーザーは一時チャットの作成時にパーソナライズの有効化や会話の保存を選択できる。保存された会話は、アカウント単位の設定に従う通常のチャットへ変換される。パーソナライズを有効にすると、アカウント内の既存のメモリ、カスタム指示、プラグインを一時チャットから利用できるが、やり取りを通じて新しいメモリが作成されることはない。パーソナライズは一時チャットの作成時にのみ設定でき、会話開始後は変更できない。パーソナライズされた一時チャットは、保存するまでサイドバーとチャット履歴に表示されず、保存後に通常のチャットとして表示される。

原文を読む →

OpenAI、Anthropicなどと共同でサイバー防御の強化を呼びかけ

要闻

OpenAI、Anthropicなどと共同でサイバー防御の強化を呼びかけ

OpenAIはAnthropic、AWS、Google、Microsoft、Oracleなどと共同でサイバー防御の集団行動を呼びかけ、3つの原則を提示するとともに、フロンティアAI企業にAgentic IDの追跡可能性と説明責任の確保を求めた。

OpenAI、Anthropic、AWS、Google、Microsoft、Oracleなどは、サイバー防御を強化するための行動イニシアチブを共同で公表し、OpenAIは、AI駆動型サイバー攻撃に対処するための時間的猶予は限られていると表明した。このイニシアチブは、現在のセキュリティ対策が不十分であると認識すること、サイバー能力を持つAIによって防御側を支援すること、世界規模の集団対応を推進することの3原則を掲げた。OpenAIの説明によると、行動提案は各種組織、サイバーセキュリティ企業、政府、フロンティアAI企業を対象とする。フロンティアAI企業には、Agentic IDの追跡可能性と説明責任を確保し、リソースが不足する重要インフラの防御担当者にモデルへのアクセス権と資金を提供することを求めている。

原文を読む →

Anthropic、Model Hardware Standardの研究プレビュー版を公開

要闻

Anthropic、Model Hardware Standardの研究プレビュー版を公開

Anthropic は、最初の研究機関と先端メーカーに MHS のリサーチプレビューを公開した。公式説明では、この仕様により AI Agent は顕微鏡、液体ハンドラー、ロボットアームを並列操作でき、機器統合の期間を数週間または数カ月から数時間または数分へ短縮する。

Anthropic は Model Hardware Standard(MHS)の初期版を、科学、ロボティクス、電子、製造分野の最初のパートナーに提供し、AI Agent による物理機器の操作を検証するとともに、オープンソース化に先立って安全性評価とベストプラクティスを共同で策定する。MHS は Anthropic と HHMI Janelia Research Campus の協力で開発が始まり、programmable interface を持つあらゆる機器に対応し、特定のモデルには依存しない。Agent harness は Model Context Protocol などの標準プロトコルを通じて接続できる。公式説明では、Agent が顕微鏡、液体ハンドラー、ロボットアームなどを並列制御し、創薬実験や量子コンピューターのレーザー較正といったタスクを実行でき、通常は数週間または数カ月かかるハードウェア統合を数時間または数分に短縮する。

MHS は標準化された driver で異なる機器のインターフェースを統一し、read や write などの primitives でパラメーターを取得または設定する。機器情報も共通形式で公開するため、機器と Agent は専用の translator を用意せずにネットワーク越しで相互に検出し、通信できる。ユーザーは自然言語の tags を使い、重量、測定可能な項目、調整可能なパラメーター、安全上の制限などを追加でき、driver はその情報から reference file を自動生成する。機器の制御には MCP、command line interface、code files(APIs)の3つを利用する。Agent は工程の編成、結果の監視、パラメーターのリアルタイム調整を行い、長時間または高速なタスクを code files に記述できる。Anthropic によると、テスト中の Claude はレーザーを繰り返し調整してカメラで結果を確認し、その後 deterministic script を生成して、単一のコマンドでレーザーの位置合わせを完了した。

原文を読む →

蚂蚁百灵、金融強化モデルLing-3.0-flash-Finをリリース

模型发布

蚂蚁百灵、金融強化モデルLing-3.0-flash-Finをリリース

Ant Lingは金融特化モデルLing-3.0-flash-Finを公開した。総パラメータ数は124B、活性化パラメータ数は5.1Bで、現在は2つのプラットフォームで期間限定の無料提供が行われ、重みは公開翌週にオープンソース化される予定だ。

Ant Lingは金融特化モデルLing-3.0-flash-Finを公開したが、原文には具体的な公開日は記載されていない。このモデルはLing-3.0-flashをベースに開発され、総パラメータ数は124B、1回あたりの活性化パラメータ数は5.1Bとなる。公式によると、複数の金融ベンチマークで高い性能を示し、汎用能力のスコアも向上した。モデルは現在、Vercel AI GatewayとOpenRouterで提供されている。Vercel AI Gatewayの無料期間は原文に記載された9月25日までだが、年は明記されていない。OpenRouterでは1カ月間の無料体験を提供する。公式はまた、モデルの重みを公開翌週にオープンソース化する予定だとしている。

原文を読む →

fal、MiniMax H3ベースのポストトレーニングモデルH3 Maxをリリース

模型发布

fal、MiniMax H3ベースのポストトレーニングモデルH3 Maxをリリース

falは、MiniMax H3をベースにpost-trainingを施した動画モデルH3 Maxを発表した。公式によると、5秒の動画を3秒未満で生成し、公式H3 endpointの約35倍のthroughputを実現したほか、3項目の人間による選好評価ですべて1位となった。

falは現在、同社のプラットフォームを通じてH3 Maxを提供している。これはfal Researchがopen-weights MiniMax H3をベースに開発し、同社のinferenceチームが最適化したpost-training済み動画モデルである。falによると、チームはpost-training段階で新たなデータを追加し、prompt adherenceと視覚品質の改善に重点を置きながら、モデル開発とinference stackを並行して反復した。モデルの学習と提供にはNVIDIA GB200 NVL72が使用され、チップ単位の性能は従来使用していた前世代アクセラレーターの最大2倍としている。H3 Maxの学習にはfal Serverlessも使用された。

falの品質評価は、人間による一対一の選好比較を中心とし、overall quality、prompt understanding、aestheticsの3項目を対象に、95% confidence intervals付きのBayesian Eloで結果を集計した。評価対象の動画モデルは12種類で、公式MiniMax H3 endpoint、Gemini Omni Flash、Wan 3.0、Seedance 2.5、Kling 3、Veo 3.1が含まれる。公式によると、H3 Maxは3項目すべてで1位となり、評価した各モデルとの一対一比較でも過半数を獲得したほか、Artificial AnalysisとDesign Arenaの独立ランキングでも1位となった。同社の説明では、5秒の動画を3秒未満で生成し、throughputは公式H3 endpointの約35倍、同等品質のモデルより平均15倍高速である。Playground、fal Agent、APIから利用でき、最初の1週間は50% offで提供される。

原文を読む →

Midjourney V8.2画像編集モデルがテスト開始

模型发布

Midjourney V8.2画像編集モデルがテスト開始

Midjourneyは、初のV8.2 image edit modelのテストを全ユーザーに開放し、メインサイトとalphaサイトのUIも更新した。公式は不具合事例とUIへのフィードバックを募っており、今後も短い間隔で更新を続けるとしている。

Midjourney初のV8.2 image edit modelは、全ユーザーを対象とするテスト段階に入り、midjourney.comとalpha.midjourney.comのUIも更新された。公式によると、alphaでは同モデル向けのインターフェース再構築を巡る実験を継続し、テスト中には想定どおりに動作しないエッジケースが発生すると見込んでいる。画像の仕上がりが良くない場合、ユーザーはlightbox右側のsad face emojiをクリックするか、画像をlightboxで開いたまま、対応するjobidまたはURLを送信できる。UIの改善案やモデルのエッジケースは#ideas-and-featuresに、利用成果は#edit-showcaseに投稿できる。公式の説明では、今後も短い間隔で更新を続け、今回のテストにはより広い範囲のコミュニティが参加する。

原文を読む →

BreezeBlue、音声モデルBreeze TTS 2をオープンソース化

模型发布

BreezeBlue、音声モデルBreeze TTS 2をオープンソース化

BreezeBlue はリアルタイム対話向けの open-weight 音声モデル Breeze TTS 2 を公開した。同社によると、Artificial Analysis TTS leaderboard の open-weight モデル部門で第 1 位となり、24 kHz のストリーミング PCM 出力に対応する。

BreezeBlue は、リアルタイム対話向けの open-weight text-to-speech モデル Breeze TTS 2 をリリースした。同社によると、このモデルは Artificial Analysis TTS leaderboard の open-weight モデル部門で第 1 位となり、frontier proprietary systems を上回った。自然言語の instruction により、参照音声なしで声を設計できるほか、参照音声を使って話者のトーン、感情、速度、話し方を制御できる。--cfg-scale 4 を使うと instruction-following を強化できる。話者をクローンする場合、参照音声には背景ノイズを可能な限り抑えた明瞭な音声と、正確な transcript が必要となる。

Breeze TTS 2 の CLI と単一同時実行の streaming API は、デフォルトで PyTorch eager streaming を使用し、graph warmup を省略する。API はモノラル 24 kHz signed 16-bit little-endian PCM を返し、--fast-all を指定すると全推論段階で最適な構成を有効にできるが、cold-start 時間は長くなる。デフォルトの Docker image は H100/Hopper(sm90)向けで、A100 用のビルド方法も用意され、必要なモデルコンポーネントはすべて checkpoint に含まれる。source code は Apache License 2.0、モデルの重み、checkpoint、adapter、派生モデル、self-hosted 出力は別途 BreezeBlue Research and Non-Commercial License の対象となる。商用利用には RESONIA, INC. の書面による許可が必要で、連絡先は contact@breeze.blue。

原文を読む →

Cohere、文書解析モデルParse 5をリリース

模型发布

Cohere、文書解析モデルParse 5をリリース

Cohereは文書解析モデルCohere Parse 5を正式に提供開始した。テキスト、表、フォーム、画像を処理でき、公式によるとParseBenchのスコアは79.2、料金は1,000ページ当たり1.50米ドルとなる。

CohereはCohere Parse 5を正式にリリースし、提供を開始した。このモデルはRAGシステムの構築と文書処理の自動化を対象とし、文書内のテキスト、表、フォーム、画像を認識して、バウンディングボックス付きの機械可読文書を生成する。公式によると、ParseBenchで79.2を記録し、Mistral OCR 4などの競合製品を上回った。Cohereは料金を1,000ページ当たり1.50米ドルに設定しており、同社の説明では、フロンティア大規模モデルより最大95%安い。

原文を読む →

新しいQoderが登場:コーディング・汎用のデュアルモードとデスクトップ版を提供

开发生态

新しいQoderが登場:コーディング・汎用のデュアルモードとデスクトップ版を提供

Qoderは新しいAgentワークスペースとデスクトップアプリを発表し、Codingと汎用の2モードを提供する。国際版と中国版はすでにダウンロード可能で、世界のユーザー数は600万人を超え、40超のコネクターと70超のプラグインに接続できる。

Qoderは新世代のAgentワークスペースとデスクトップ版を公開し、国際版と中国版のダウンロード提供を開始した。この製品はCoding能力を基盤とし、プログラミングモードと汎用モードを備える。公式によると、世界トップクラスのモデルとAutoインテリジェントスケジューリングエンジンを内蔵し、Harness技術によって複雑で長い処理経路を伴う自律タスクをサポートする。同社の説明では、40超のコネクターと70超のプラグインを通じて業務システムに接続でき、音声起動と能動的なリマインド機能も追加された。Qoderの世界累計ユーザー数は600万人を超えており、公式は専用Creditsやモデル割引などの期間限定特典も同時に提供している。

原文を読む →

阿里云百炼、Qwen3.8-Flashモデルを値下げ

开发生态

阿里云百炼、Qwen3.8-Flashモデルを値下げ

原文を読む →

AISI、LLM評価の計算資源を動的に最適化するオープンソースツールoptstopを公開

开发生态

原文を読む →

Hugging Face、オープンソースの二足歩行ロボットMicroduckを発表

产品应用

Hugging Face、オープンソースの二足歩行ロボットMicroduckを発表

原文を読む →

Google検索のAI Mode、旅行計画機能を強化

产品应用

Google検索のAI Mode、旅行計画機能を強化

原文を読む →

Gemini Notebook、購入済みGoogle Play電子書籍のインポートに対応

产品应用

Gemini Notebook、購入済みGoogle Play電子書籍のインポートに対応

原文を読む →

Google DeepMind、最先端AIモデルの二重盲検評価を試験運用

技术与洞察

Google DeepMind、最先端AIモデルの二重盲検評価を試験運用

原文を読む →

Anthropic、科学者向けClaudeサブスクリプションプランを発表、1万席を無料提供

行业动态

原文を読む →

NVIDIA、Hugging Faceを129億ドルで買収することで合意か

前瞻与传闻

NVIDIA、Hugging Faceを129億ドルで買収することで合意か

原文を読む →

NVIDIA、AIクラウド事業者との収益分配契約を停止か

前瞻与传闻

原文を読む →

Google社員、Ox Alphaの示唆をめぐる論争に回答

其他

Google社員、Ox Alphaの示唆をめぐる論争に回答

原文を読む →