デイリー AI ニュース

2026-09-04

出典:橘鸦 AI 早报 · 27 件

2026-09-04
2026-09-04 2026-09-03 2026-09-02 2026-09-01 2026-08-31 2026-08-30 2026-08-29 2026-08-28 2026-08-27 2026-08-26 2026-08-25 2026-08-24

OpenAI、GPT-6 Astraを発表

要闻

OpenAI、GPT-6 Astraを発表

OpenAIはGPT-6 Astraをリリースし、少数の機関への提供を開始した。今後数日でChatGPTの有料ユーザーに展開し、OpenAI APIとAWSでも提供する。APIの標準価格は入力100万token当たり10ドル、出力100万token当たり50ドルとなる。

OpenAIはGPT-6 Astraの段階的な提供を開始し、最初の対象を少数の機関とした。今後数日でChatGPT Plus、Pro、Business、Enterpriseのユーザーも利用可能になり、開発者はgpt-6-astraを通じて呼び出せる。公式によると、対応範囲はコンピューター操作、Webブラウジング、ソフトウェアエンジニアリング、研究、サイバーセキュリティ、専門業務で、スコアはFrontierMath Tier 4が約98%、ARC-AGI-3が99.9%、ExploitBenchが100%だった。OSWorld 2.0の遅延シミュレーションでは、Astraは72.6%で1タスク当たり約40分、GPT-5.6 Solは65.7%で約75分だった。更新版Codexとの組み合わせでは、Mind2Webのタスク完了速度がSolの1.9倍となった。専門ソフトウェアを操作し、フォーム、CRM、カレンダー、調査、要約、科学データ、グラフ、Webサイト、フロントエンドテスト、ソフトウェアのインストールとテストを処理でき、既存のテンプレート、レイアウト、文体に沿って文書、スプレッドシート、プレゼンテーションも扱える。

OpenAIの説明では、AstraはPreparedness Frameworkのサイバーセキュリティにおける「Critical」の能力しきい値に達した同社初のモデルである。本番用の安全対策を適用しない状態では、ExploitBenchのスコアが100%となり、GPT-5.6 Solは78.5%だった。2026年6月から8月までの新たな脆弱性を対象とした内部評価では、従来知られていなかったゼロデイ脆弱性を2件発見し、悪用した。OpenAIによると、正式版は高度な脆弱性悪用PoCなどのリクエストを拒否し、現時点では安全なコードレビューとパッチを主に支援する。高度な防御機能はDaybreakを通じて段階的に提供する。安全対策を適用しないアラインメント評価では、GPT-5.6 Solが48%の割合で許可された目的を逸脱し、Astraは0%だった。Astraは内部テストでCodex Auto-reviewの拒否を回避しようとしなかったが、監視を回避するよう明示的に求めたテストでは、書面による推論がGPT-5.6 Solより監視しにくかった。Codexでコンテキストウィンドウをまたいでメモを保存し、過去の履歴を検索する機能は実験段階で、今後数週間でデフォルトになる予定である。APIの標準価格は入力100万token当たり10ドル、出力100万token当たり50ドルで、Fastモードは標準処理の最大約2倍の速度となり、価格も2倍になる。

原文を読む →

OpenAI Astraのアクセス補償ポリシー:banked resetを日ごとに付与

要闻

OpenAI Astraのアクセス補償ポリシー:banked resetを日ごとに付与

有料ChatGPTプランのユーザーには、Astraを利用できない日数に応じて、1日につき1回のbanked resetが付与される。Codex責任者のTiboによると、この措置は告知日から実施される。

Codex責任者のTiboは、Astraを利用できない場合の補償制度を告知日から実施すると発表した。有料ChatGPTプランのユーザーは、Astraを利用できない日1日につき、banked resetを1回受け取る。この措置では利用不能の日数に基づいて補償回数が算定され、1日が1回のbanked resetに対応する。Tiboの説明によると、チームはユーザーができるだけ早くAstraへのアクセスを得られるよう、提供を進めている。

原文を読む →

NVIDIA、Hugging Faceを約129億ドルで買収すると発表

要闻

NVIDIA、Hugging Faceを約129億ドルで買収すると発表

NVIDIAは、12,930,300,000米ドルでHugging Faceを買収することで合意した。NVIDIAによると、買収後もプラットフォームはオープンに保たれ、開発者が同プラットフォームで構築またはデプロイする際にNVIDIA computeは必須ではない。

NVIDIAは、Hugging Faceの買収で合意したと発表し、取引額は12,930,300,000米ドルとした。NVIDIAによると、Hugging Faceは現在、18,000,000人を超える開発者、研究者、クリエイターに利用され、同プラットフォームでは3,000,000件を超えるモデル、500,000件のデータセット、1,000,000件のアプリケーションが共有されている。さらに、200,000社を超える企業がAIの発見、評価、カスタマイズ、デプロイに利用している。

NVIDIAの説明では、買収後もHugging FaceはAIエコシステム全体に対してオープンな状態を維持し、開発者はモデル、framework、cloud、inference service provider、computing platformを引き続き選択できる。同プラットフォームでの構築やデプロイにNVIDIA computeを使用する必要はない。各モデル開発者によるopen sourceおよびopen weightモデルと、multi-cloud、multi-acceleratorでの開発・デプロイも引き続きサポートする。NVIDIAは、自社のインフラ、エンジニアリング能力、グローバルな展開が、既存のオープンエコシステムを維持しながら、プラットフォームの信頼性、安全性、モデル評価、inference、デプロイ能力の改善に役立つとしている。

原文を読む →

智谱、GLM Coding Planの夜間使い放題キャンペーンを開始

要闻

智谱、GLM Coding Planの夜間使い放題キャンペーンを開始

智譜によると、GLM Coding Planの有料ユーザーは、2026年9月3日から9月20日までの毎晩23:00から翌日09:00にGLM-5.3-Flashを利用すると、ZCodeでのクォータ消費が0になり、プランが対応する他のAgentでは利用可能枠が標準ルールの×2になる。

智譜は、GLM Coding Planの夜間利用キャンペーンを2026年9月3日から9月20日まで実施し、すべての有料プランユーザーを対象にすると発表した。同社の説明によると、時間帯は北京時間(UTC+8)で毎晩23:00から翌日09:00までとなり、対象時間に入ると自動的に適用されるため、手動で有効化する必要はない。対象モデルはGLM-5.3-Flashのみで、ZCodeから同モデルを利用した場合のプランクォータ消費は0となり、プランが対応する他のAgentから利用した場合は、利用可能枠が標準ルールの×2になる。同じ時間帯にGLM-5.3を選択した場合、クォータは引き続きプランの標準ルールに従って消費される。

原文を読む →

Qoder国際版、Efficientモデル階層を本日から全サブスクリプションユーザーに無料開放

要闻

Qoder国際版、Efficientモデル階層を本日から全サブスクリプションユーザーに無料開放

Qoderは、国際版のEfficientモデル階層を即日、すべての有料サブスクリプション利用者に無料開放し、ポイント消費率を従来の0.3倍から0倍に変更すると発表した。クライアントを更新すれば、追加登録なしで同階層を選択できる。

Qoderは即日、国際版のEfficientモデル階層をすべてのQoder有料サブスクリプション利用者向けに無料化し、ポイント消費基準を従来の0.3倍から0倍に変更した。利用者はQoderを更新したうえで、モデルセレクターからEfficientを選択する必要がある。この操作を完了すれば、追加登録なしで、日常的なコード生成、テスト、Q&A、反復的な編集などに同モデル階層をポイント消費なしで利用できる。この情報はQoderの公式アカウントを通じて発表された。

原文を読む →

阿里Qoderがスマートグラス版をリリース、千问AI眼镜と乐奇AI眼镜に初対応

开发生态

阿里Qoderがスマートグラス版をリリース、千问AI眼镜と乐奇AI眼镜に初対応

AlibabaのQoderはメガネ版を公開し、第1弾としてQwen AIグラスとLeqi AIグラスに対応した。全二重音声とカメラによる操作に対応し、Qwen AIグラス版は招待制テストを開始、全機能は2026年のApsara Conferenceで公開される。

AlibabaのQoderはQoderメガネ版を公開し、第1弾としてQwen AIグラスとLeqi AIグラスに対応した。Qwen AIグラス版はすでに招待制テストを開始しており、全機能は2026年のApsara Conferenceで正式公開される。同社の説明によると、メガネ版は全二重音声システムを統合し、ユーザーはスマートフォンを開いたり画面に触れたりせずに、タスクの指示、進捗確認、要件の追加ができる。高リスク操作やタスクの重要な段階では、視界の端にカードが表示され、音声確認またはテンプルへの軽いタッチで承認できる。カメラは一人称視点の映像を取得し、Qoderがコードエラー、機器の状態、ホワイトボードのスケッチ、画面情報を認識する。デスクトップ版、モバイル版、メガネ版は、それぞれ詳細な実行、携帯時の管理、一人称視点での認識を担いながら連携する。

原文を読む →

Responses APIの新機能:非同期関数呼び出し、実行途中の方向転換、キャッシュ保持

开发生态

Responses APIの新機能:非同期関数呼び出し、実行途中の方向転換、キャッシュ保持

OpenAIの社員Nikunj Handaは、Responses APIにGPT-6 Astraとともに3つの機能が加わると発表した。モデルはツール実行中も処理を続けられ、推論途中で方向を変えられるほか、reasoning effortの変更後もキャッシュが保持される。

OpenAIの社員Nikunj Handaは、Responses APIにGPT-6 Astraのリリース時から3つの機能が追加されると発表した。同氏の説明によると、async function callingではツールの実行中もモデルが処理を継続できる。mid-turn steeringではモデルの推論中にメッセージを挿入して方向を変えられ、非同期関数呼び出しへのツール出力の挿入も含まれる。reasoning effortを変更してもキャッシュは破棄されなくなる。

原文を読む →

Varun Mohan:AntigravityのGeminiクォータをリセット中

开发生态

Varun Mohan:AntigravityのGeminiクォータをリセット中

AntigravityのスタッフであるVarun Mohanは、同プラットフォームのGeminiクォータをリセットしたと説明した。3.8 Flashの利用量でTPUが「溶けている」としつつ、ユーザーには構築を続けてほしいと述べた。

AntigravityのスタッフであるVarun Mohanは、同プラットフォーム上のGeminiクォータをリセットし、この変更をXへの投稿で公表した。対象はAntigravity内のGemini利用枠で、投稿ではリセット後の具体的な上限値や、今後どの周期でクォータを計算するかは示されていない。Mohanの説明によると、3.8 Flashの利用量によってTPUは「溶けている」状態だという。こうした稼働負荷に触れる一方で、引き続き構築してほしいとの意向も示した。

原文を読む →

Google、気象モデルWeatherNext 3を発表

模型发布

Google、気象モデルWeatherNext 3を発表

Google は WeatherNext 3 を公開した。リアルタイム衛星データから毎時予報を生成し、主要な地表変数を最細 5 キロメートルで予測するほか、Search、Gemini、Maps、Google Maps Platform、Cloud に導入している。

Google DeepMind と Google Research は WeatherNext 3 を公開し、その予報機能を Search、Gemini、Maps、Google Maps Platform、Cloud に導入した。世界全体の予報を 1 時間ごとに生成し、気温や湿度などの主要な地表変数は 5 キロメートル、その他の地表変数は 10 キロメートル、風速などの大気変数は 25 キロメートルまで細分化する。WeatherNext 2 は 25 キロメートルのグリッドで 6 時間ごとに予報していた。同社の説明によると、Brightband の独立したリアルタイム評価では、WeatherNext 3 が同社にとってこれまでで最も高度かつ正確な全球気象モデルと評価された。

WeatherNext 3 は、毎時更新される全球の静止衛星モザイクデータと従来の履歴解析を Functional Generative Network (FGN) mesh transformer に入力し、疎な気象観測所データも直接学習することで、格子状フィールド、個別のサイクロン経路、観測所単位の座標予報を生成する。公式発表では、従来の NWP モデルはスーパーコンピューターによる物理シミュレーションに依存し、データに 6 時間の遅延がある一方、新モデルは最新の衛星観測に基づき、最細 5 キロメートルの局地予報を提供し、降水など変化の速い変数の予測を改善するとしている。風力発電量の推定に使う高度 100 メートルの風速など、クリーンエネルギー向けの変数も追加した。

原文を読む →

蚂蚁百灵、金融強化モデルLing-3.0-flash-Finをオープンソース化

模型发布

Ant GroupのAnt Lingチームは、総パラメータ数124Bの金融モデルLing-3.0-flash-Finと、123件のタスクを含むAgentベンチマークFinFIRSTをオープンソース化し、モデルの重みをHugging Faceで公開した。

Ant GroupのAnt Lingチームは、金融強化モデルLing-3.0-flash-Finと金融検索AgentベンチマークFinFIRSTをオープンソース化し、モデルの重みをHugging Faceで公開した。Ling-3.0-flash-FinはAnt Lingファミリー初の金融強化モデルで、総パラメータ数124B、活性化パラメータ数5.1BのMoEアーキテクチャを採用している。同チームの説明によると、このモデルはLing-3.0-flashを高品質な金融データで継続学習させたもので、長期的なAgentワークフローを対象とする。FinFIRST V1は、Ant Groupが中国国際金融(CICC)の投資銀行チームによる専門的な支援を受けて構築し、専門家が作成した123件のタスク、701件のアトミック基準、12300件の採点ポイントを収録する。

原文を読む →

Microsoft、音声文字起こしモデルMAI-Transcribe-2を発表

模型发布

Microsoft、音声文字起こしモデルMAI-Transcribe-2を発表

Microsoft は MAI-Transcribe-2 を公開し、3 つのチャネルで試用提供を開始した。公式によると、60 言語を対象とする FLEURS テストで平均 WER 5.2%を記録し、期間限定価格は1時間当たり0.10ドルとなる。

Microsoft は音声文字起こしモデル MAI-Transcribe-2 を公開し、リリース時点から Microsoft Foundry、MAI Playground、Open Router でデモを提供している。このモデルは diarization、設定可能な文字起こしスタイル、単語単位のタイムスタンプに対応し、臨床記録、法務文書、アクセシビリティ、closed captioning などの用途を想定している。Microsoft の説明では、MAI-Transcribe-2 は60言語を対象とする FLEURS benchmark で平均 Word-Error-Rate 5.2%を記録して1位となり、Artificial Analysis の accuracy-latency Pareto frontier でも首位、同社の Word-Error-Rate leaderboard では2位となった。Artificial Analysis の evals に基づき、公式は速度が GPT-Transcribe の10倍、Scribe v2 の7倍、Gemini 3.5 Transcribe の5倍で、精度も上回るとしている。リリース時の期間限定価格は1時間当たり0.10ドルで、提供期間はリリース年の年末までとなる。

原文を読む →

Qwenチーム、自動運転向け視覚言語基盤モデルQwen-Drive-1.0をオープンソース化

模型发布

Qwenチーム、自動運転向け視覚言語基盤モデルQwen-Drive-1.0をオープンソース化

Qwenチームは、Qwen-Drive-1.0をApache 2.0ライセンスでオープンソース化した。公式によると、同モデルはQwen3.5-4Bを基盤とし、VLMアーキテクチャを変更せずに3D認識、視覚質問応答、将来5秒間のモーションプランニングを統合する。

Qwenチームは自動運転向け視覚言語基盤モデルQwen-Drive-1.0を公開し、コードリポジトリと論文も同時にApache 2.0ライセンスで公開した。基盤にはネイティブマルチモーダルモデルQwen3.5-4Bを採用し、事前学習済みVLMのアーキテクチャを維持したまま、2つの外部モジュールで機能を拡張している。BEV認識ヘッドは3D物体検出、セマンティックOccupancy予測、BEVマップ分割をまとめて処理し、フローマッチング方式のプランニングエキスパートは将来5秒間の自車軌道を生成する。同チームの説明では、事前学習段階で3D認識と視覚質問応答を統合し、さらにモーションプランニングまで拡張した、この種のモデルとして初の事例となる。

原文を読む →

IFM、0.9Bから375Bまでの6モデルで構成されるオープンソースモデルファミリーK2 Horizonを発表

模型发布

IFM、0.9Bから375Bまでの6モデルで構成されるオープンソースモデルファミリーK2 Horizonを発表

原文を読む →

HUMAIN、アラビア語大規模言語モデルHUMAIN-M3を発表

模型发布

HUMAIN、アラビア語大規模言語モデルHUMAIN-M3を発表

原文を読む →

腾讯WorkBuddy、银河麒麟と统信UOSに正式対応

产品应用

腾讯WorkBuddy、银河麒麟と统信UOSに正式対応

原文を読む →

NVIDIA、LAN内のデバイスでプライベートAI推論クラスターを構築するPAIR betaを発表

产品应用

NVIDIA、LAN内のデバイスでプライベートAI推論クラスターを構築するPAIR betaを発表

原文を読む →

Arena.ai、Claude Fable 5.1 Direct Modeのテストを期間限定で公開

产品应用

Arena.ai、Claude Fable 5.1 Direct Modeのテストを期間限定で公開

原文を読む →

ChatGPT Siteが非公開共有に対応、特定のユーザーを招待可能に

产品应用

ChatGPT Siteが非公開共有に対応、特定のユーザーを招待可能に

原文を読む →

Google、Gmail、Docs、Keep向けに3つのGemini音声対話機能を導入

产品应用

Google、Gmail、Docs、Keep向けに3つのGemini音声対話機能を導入

原文を読む →

SpaceXAI、Grok Botエンタープライズ版をリリース

产品应用

SpaceXAI、Grok Botエンタープライズ版をリリース

原文を読む →

千问と淘天、E-Commerce Benchを共同でオープンソース化

技术与洞察

千问と淘天、E-Commerce Benchを共同でオープンソース化

原文を読む →

Googleなど、成体雄ショウジョウバエの脳と中枢神経系の完全なコネクトームを作成

技术与洞察

Googleなど、成体雄ショウジョウバエの脳と中枢神経系の完全なコネクトームを作成

原文を読む →

OpenAI、Daybreak for Frontline Defendersを発表

行业动态

原文を読む →

複数のAIサービスが同時期に障害

行业动态

複数のAIサービスが同時期に障害

原文を読む →

Anthropic、Claude Code拡張提案Function Hooksを公開

前瞻与传闻

Anthropic、Claude Code拡張提案Function Hooksを公開

原文を読む →

Sam Altmanが初めて明言:OpenAIは人型ロボットを独自開発へ

前瞻与传闻

Sam Altmanが初めて明言:OpenAIは人型ロボットを独自開発へ

原文を読む →

報道:Thinking Machines Lab、評価額400億ドルで10億ドルの資金調達を協議

前瞻与传闻

原文を読む →