デイリー AI ニュース

2026-09-20

出典:橘鸦 AI 早报 · 14 件

2026-09-20
2026-10-01 2026-09-30 2026-09-29 2026-09-28 2026-09-27 2026-09-26 2026-09-25 2026-09-24 2026-09-23 2026-09-22 2026-09-21 2026-09-20

DeepSeek API、祝日および振替出勤となる週末は終日オフピーク料金を適用すると明確化

开发生态

DeepSeek API、祝日および振替出勤となる週末は終日オフピーク料金を適用すると明確化

DeepSeekの公式APIでは、振替出勤となる週末と中国の法定祝日は、終日オフピーク時間帯として課金される。プラットフォームの告知バナーは、週末が振替で勤務日になってもこの区分は変わらないと説明している。

DeepSeek APIプラットフォームは、振替出勤となる週末と中国の法定祝日を終日オフピーク時間帯として課金する公式APIの時間帯区分を、告知バナーで明確にした。週末が振替措置によって勤務日になった場合も、オフピーク時間帯の基準が引き続き適用される。説明が対象とする日付は2種類で、振替出勤が必要な週末と中国の法定祝日である。いずれも対象範囲は終日で、適用対象はDeepSeekの公式APIユーザーである。

原文を読む →

Tibo、Codex banked resetを示唆か

开发生态

Tibo、Codex banked resetを示唆か

OpenAIが期待されていた更新を公開しなかったとして、あるユーザーがbanked resetを求めたところ、Codex責任者のTiboは予告済みの内容が火曜日に提供されると回答したが、resetの実施は明言しなかった。

Codex責任者のTiboは、あるユーザーがOpenAIにbanked resetを求める投稿をした後、予告済みの内容は引き続き火曜日に提供されると回答したが、resetそのものは直接確認しなかった。このユーザーは、OpenAIが同ユーザーのいう今週に期待されていた更新を公開しなかったことを理由に要求していた。Tiboの原文は「OK fine. But it’s also still coming in Tuesday」だった。一部のユーザーは「OK fine」をbanked resetへの同意と解釈した一方、別の解釈では、明確な約束には当たらず、以前言及された内容が火曜日の予定どおり提供されることだけを確認した発言とされている。返信には「banked reset」という表現がないため、resetの有無は原文から確定できない。

原文を読む →

Step 5 PreviewがArtificial Analysisのウェブサイトに登場

模型发布

Step 5 PreviewがArtificial Analysisのウェブサイトに登場

Step 5 Previewは2026年9月にリリースされ、Artificial Analysis Intelligence Indexで44点を獲得した。テキストと画像の入力に対応し、コンテキストウィンドウは100万tokensとなる。

Artificial Analysisのページによると、Step 5 Previewは2026年9月にリリースされ、Artificial Analysis Intelligence Index v4.3.2で44点を獲得した。同クラスのモデルの中央値は24だった。この評価では160M tokensを生成し、同クラスの中央値は92M、評価全体の費用は922.84米ドルだった。料金は100万input tokens当たり1.00米ドル、100万output tokens当たり2.70米ドルで、それぞれの中央値は1.88米ドルと10.00米ドルだった。測定された出力速度は100 tokens/sで、同クラスの中央値は70 tokens/sだった。

このモデルはテキストと画像を入力として受け付け、テキストを出力し、1M tokensのコンテキストウィンドウを備える。ページに掲載されているのはreasoning版で、non-reasoningの派生版も存在する可能性があるとしている。各指標は同クラスのモデルと比較されている。速度データにはfirst-party APIの値を使用し、first-party APIがない場合は複数プロバイダーの中央値を採用する。Intelligence Index v4.3.2は、AA-Briefcase v1.1、GDPval-AA v2.1、AutomationBench-AA、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR v1.1で構成される。

原文を読む →

千问がQwen3.8-LiveTranslateをリリース

模型发布

千问がQwen3.8-LiveTranslateをリリース

千問は Qwen3.8-LiveTranslate を公開し、実際の会話向けに 60 言語のリアルタイム翻訳を提供しており、千問のデータでは 1 文字当たりの平均遅延が前世代の 2.8 秒から 2.3 秒に短縮された。モデルは現在オンラインで試用でき、API は千問 AI プラットフォームで提供されている。

Qwen3.8-LiveTranslate が正式に公開された。これは千問が実際の会話向けに投入した同時通訳モデルで、60 言語に対応する。オンライン試用はすでに提供され、API も千問 AI プラットフォームで公開されている。千問の説明によると、モデルは Interleave アーキテクチャを採用し、音声とテキストを交互に並べた単一ストリームとして構成する。受信済みの音声と生成済みの訳文をキャッシュから再利用することで、1 文字当たりの平均遅延を前世代の 2.8 秒から 2.3 秒に短縮した。新たな機能には、リアルタイムの話者分離、原文と訳文の同一フレーム出力、長いコンテキストを利用した曖昧性解消が含まれる。千問が公表した評価結果では、複数話者による長時間音声と多言語リアルタイム同時通訳のテストで、前世代および現在の主要システムを上回ったとしている。

原文を読む →

阿里巴巴达摩院が腹部CT診断モデルRADARをオープンソース化、論文はScienceに掲載

模型发布

阿里巴巴达摩院が腹部CT診断モデルRADARをオープンソース化、論文はScienceに掲載

Alibaba DAMO Academyは腹部CT向け視覚言語モデルRADARをオープンソース化し、関連論文はScienceに掲載された。プロジェクトの説明によると、同モデルは400,000件超の造影腹部CT検査と1,500万組の解剖学的情報を考慮した画像・テキストペアで学習し、手作業のアノテーションを必要としない。

Alibaba DAMO Academyは汎用腹部CT視覚言語モデルRADARをGitHubでオープンソース化し、関連論文はScienceに掲載され、プロジェクトのコードにはApache License 2.0が適用される。プロジェクトの説明によると、RADARは臨床レポートから直接学習し、400,000件超の造影腹部CT検査と1,500万組の解剖学的情報を考慮した画像・テキストペアで訓練されており、手作業のアノテーションを必要としない。公式は、放射線医学AIの定型的および複雑な臨床タスクを対象とし、両方で専門家レベルの性能を示したとしている。リポジトリにはconda環境、依存関係、詳細なガイドが用意され、コードはZenodoでもアーカイブできる。一部のコードは個別のライセンスを持つ第三者のオープンソースプロジェクトに由来し、元のライセンス文書はTHIRD_PARTY_LICENSES.mdに保存されている。

原文を読む →

Cuaが小型フォーム入力モデルcua-s1-formsをオープンソース化

模型发布

Cuaが小型フォーム入力モデルcua-s1-formsをオープンソース化

Cuaは、GUIフォーム入力向けのcua-s1-formsをオープンソース化し、1回のforward passで各UI要素の候補操作を並列評価できるようにした。公式の同一タスク比較では、同モデルが総合99.7%、ホスト版Jev APIが83.6%だった。

Cuaは、cua-driverの背後でGUIフォーム入力の判断層として動作するcua-s1-formsをオープンソース化した。このモデルはテキストを生成せず、単一のUI要素と型付き候補を1回のforward passで処理し、各選択肢の確率を出力する。コンテキストは224 bytes、各選択肢は96 bytesで切り詰められ、候補には文書内の各エンティティに対応するfill操作と、固定のcheck、click、skipが含まれる。フォーム上の操作可能な全要素は1つのbatchで独立かつ並列に評価され、下流のexecutorがargmaxを選び、fill、checkbox、1回のsubmit clickの順に並べ、set_valueまたはclickとしてcua-driverに渡す。公式表示によると、fine-tuningなしのホスト版Jev API(jev-latest)との同一タスク比較では、cua-s1-formsが総合99.7%、Jevが83.6%だった。Jevはfill、check、clickの判断で96%、入力済みフィールドをno-opと認識する判断で74%だったという。後者の規則はcua-s1-formsの訓練には使われたが、ホスト版Jevの訓練には使われていないと説明している。プロジェクトのリポジトリでは、詳細な解説、訓練コード、合成データ生成器、Cua Driver統合、snapshot → score → order → executeの実装も公開されている。

原文を読む →

中国电信がXing4.0-29B-A4Bモデルをオープンソース化

模型发布

China TelecomはXing4.0-29B-A4Bをオープンソース化した。総パラメータ数は29Bで、各tokenにつき4Bを有効化し、ネイティブのcontext lengthは256K、512Kまで拡張できる。公式によると、学習には一貫してAscend NPUとMindSporeを使用した。

中国電信人工知能科技有限公司はXing4.0-29B-A4Bをオープンソース化した。総パラメータ数は29Bで、各tokenにつき4Bを有効化し、ネイティブのcontext lengthは256K、512Kまで拡張できる。公式によると、このモデルはAscend NPUプラットフォーム上でMindSporeを用いて全学習工程を実施した、この規模では初のモデルである。プロジェクトが公表したCoding Agent評価はSWE-bench Verifiedが75.0、SWE-bench Multilingualが66.0、Terminal-Bench 2.1が57.5だった。General Agent評価はClaw-Evalが76.55、DeepresearchBIIが60.80、Tau3-Benchが64.63だった。

プロジェクトはvLLM、SGLang、KTransformersにXing4.0対応のPRをそれぞれ提出したが、いずれも審査中でmain branchにはまだマージされておらず、マージ前は対応するPR branchからインストールする必要がある。vLLMとSGLangは起動後、http://localhost:8000/v1 でOpenAI-compatible APIを提供する。このモデルはLLaMA-Factoryによるfine-tuning、weight merging、推論、デプロイに対応するほか、Ascend Atlas 800T A3 clusterにも適応済みで、MindSpore + MindFormersを使った分散学習と評価を実行できる。プロジェクトはさらに、FlagOSを通じてmHC Triton-Ascend fused operatorsをMindFormersに統合し、単一ノード16カードでの学習検証を完了した。

原文を読む →

Android DevelopersがAndroid Bench 2.0を発表

技术与洞察

Android DevelopersがAndroid Bench 2.0を発表

Android Developers は、実際の複数日にわたる Android 開発タスクを AI が遂行する能力を評価する Android Bench 2.0 を公開し、一般的な Agent とモデルの組み合わせ、および 6 つの新モデルを評価対象に加えました。

Android Developers は Android Bench 2.0 を公開し、更新後の評価手法とモデル比較結果を現在閲覧できるようにしました。このベンチマークは、アプリの新規構築、新機能の開発、クロスプラットフォームのコードベースから Android への移行など、実際の複数日にわたる開発タスクを対象とし、完了率、視覚的忠実度、リグレッション、各モデルが各タスクを実行する際の平均コストを継続的に評価します。2.0 では、一般的な Agent と対応モデルの組み合わせも評価対象となり、Gemini 3.8 Flash、Gemini 3.7 Flash、GPT-6 Astra、Fable 5.1、Kimi K3、Qwen 3.8 Max が追加されました。

原文を読む →

OpenAIなど4社、有料ユーザーから反トラスト訴訟を提起される

行业动态

有料ユーザーは2026年9月18日、Anthropic、OpenAI、SpaceXAI、Googleが共謀してAI製品の改善を遅らせ、契約者が同じ料金でより遅い更新しか得られなくなったとして提訴し、裁判所に関連する取り決めの差し止めを求めました。

有料ユーザーは2026年9月18日、Anthropic PBC、OpenAI OPCO LLC、SpaceXAI、Google LLCがAI開発のペースを制限する協定を結び、Sherman Antitrust ActのSection 1に違反した疑いがあるとして、米国カリフォルニア州北部地区連邦地方裁判所に提訴しました。事件名はBuist v. Anthropic PBC、事件番号は3:26-cv-10693です。訴状は、競合各社が製品の改善速度を共同で決めることは競争の制限に当たり、契約者は同じ料金を払い続けながら、通常の競争下より遅い製品改善しか受けられなくなったと主張しています。

訴状によると、争いの発端はAnthropic CEOのDario Amodeiが《We Must Pace the Frontier》と題する文章を公表し、業界全体の協調を呼びかけたことです。その後、SpaceXAI創業者のElon Muskが支持を表明し、OpenAI CEOのSam Altmanも賛同し、Google DeepMind共同創業者のDemis Hassabisは正しい方向性だと評価したとされています。原告はこれを生産量を制限するcartelと位置付け、集団訴訟の認証、差し止め命令、4社が連邦反トラスト法に違反したことを確認する宣言的判決を求めています。原告代理人はTrial Lawyers for Justiceで、被告4社はいずれもコメント要請に直ちに回答しませんでした。

原文を読む →

Anthropic、エンタープライズ市場でAstraに対抗する新モデルを発表か

前瞻与传闻

Anthropic、エンタープライズ市場でAstraに対抗する新モデルを発表か

Reutersは3人の情報筋の話として、Anthropicが企業市場で注目を集めるOpenAI GPT-6 Astraに対抗するため、新モデルの投入を検討していると報じたが、公開の可否や時期は未定としている。リーク情報を発信するleoは、3つのClaudeモデルがテスト中だと述べたが、公式確認は得られていない。

2026年9月19日、Reutersは3人の情報筋の話として、Anthropicが企業市場で注目を集めるOpenAI GPT-6 Astraに対抗するため、新モデルの公開を検討しているものの、公開するかどうかやその時期は決定していないと報じた。同報道によると、同社は次期モデルの安全性を引き続き評価しており、金利上昇、競争激化、予定されるIPOを背景に、モデルへの投資と収益性のバランスも検討している。リーク情報を発信するleoは別途、新版Fable、Opus、Sonnetが複数のClaudeインターフェースやアカウントで非公開テストされていると述べた。この情報はAnthropicから確認されておらず、3モデルが全面公開されたことを意味しない。

原文を読む →

OpenAI、GPT-6 SolとGPT-6 Lunaを発表か

前瞻与传闻

OpenAI、GPT-6 SolとGPT-6 Lunaを発表か

OpenAIのチームメンバーであるTiboは、一部の新情報を来週公開し、残りを今後数カ月にわたり発表する予定だと説明した。GPT-6 SolとGPT-6 Lunaはユーザーの提案に由来する名称で、公式確認はない。

OpenAIのチームメンバーであるTiboは、チームが来週に一部の新情報を先行公開し、残りを今後数カ月にわたり順次発表する予定だと説明したが、OpenAIはGPT-6 SolまたはGPT-6 Lunaの存在や公開時期を確認していない。Sam Altmanは以前、自身が最も期待している当初公開予定だった内容が来週に延期されたと述べた。Tiboはまた、Sam Altmanらと基調講演を準備しており、紹介する項目が多いため、それらがどのように組み合わさるのかをユーザーに説明する必要があるとした。同氏の説明では、現在の内容だけで約3回の開発者イベントを開催できるという。Tiboが続いてコミュニティにほかに何を望むか尋ねたところ、あるユーザーがGPT-6 SolとGPT-6 Lunaの優先公開を提案し、Tiboが「What else do you want」と返信したことから関連する推測が生じた。OpenAI DevDayは現地時間9月29日に開催予定だが、原文には年の記載がない。

原文を読む →

Google、Gemini 4 Proを発表か

前瞻与传闻

Google、Gemini 4 Proを発表か

複数の第三者テスターとプラットフォームは、GoogleがArenaでGemini 4 Proを別のモデル名で非公開テストし、コード生成と画像タスクを試していると主張した。Googleはモデル、成績、価格、公開時期を確認していない。

複数の第三者テスターとプラットフォームは以前、GoogleがArenaでGemini 4 Proを別のモデル名で非公開テストしていると主張したが、Googleはこの情報を確認しておらず、一般公開の時期も発表していない。これらのテスターとプラットフォームは、同モデルがコード生成と画像タスクで優れた能力を示したとしている。一方、ベンチマークテストに関連する画像が外部で流通したが、この画像はGPT-Imageを使用して生成されたものと鑑定されている。Gemini 4 Proの具体的なモデル、内部コードネーム、テスト成績、価格についても、Googleは現時点で確認していない。

原文を読む →

MiniMax、MiniMax-M3.1を発表か

前瞻与传闻

MiniMax、MiniMax-M3.1を発表か

MiniMaxがオープンソースで公開するMiniMax Code CLIの複数箇所にMiniMax-M3.1が登場し、テスト設定では最大1,000,000のコンテキストと128,000の出力が確認された。モデルはまだ実際には内蔵されておらず、公式から追加情報は出ていない。

MiniMax-M3.1という名称は、MiniMaxが公式にオープンソースで公開しているMiniMax Code CLIの複数ファイルに記載されているが、現時点では実際の内蔵モデルにはなっておらず、公式も追加情報を明らかにしていない。関連コードは、過去のモデルフィールドの復元、managed catalog、モデル一覧、パラメーター解析、キューの永続化などに分布している。テスト設定には、450,000、512,000、1,000,000という3種類のコンテキスト値と、8,192、16,000、128,000という3種類の出力値が含まれ、複数のthinking effort段階も扱われている。コミュニティで流通している別のスクリーンショットには、公式スタッフの1人が同モデルの近日公開を予告した様子が写っているが、現時点で公式発表に関する追加の詳細はない。

原文を読む →

月之暗面、Kimi K3.1を発表か

前瞻与传闻

Kimiの知乎認証機関アカウントは、「3.1」が冒頭から抜け、「4159」から始まる円周率の数字列を投稿し、その後削除した。Kimi K3.1の公開を示唆したとの見方が出たが、投稿は同バージョンに直接言及せず、公開時期も示していない。

Kimiの知乎認証機関アカウントが、冒頭の「3.1」を欠いた円周率の数字列を投稿したことで、Kimi K3.1が公開されるとの推測が生じたが、投稿は同製品を確認する内容ではなく、現在は削除されている。数字列は「4159」から始まり、欠けた部分が「K3.1」のバージョン番号と対応するため、公開を示唆した可能性があると解釈された。投稿自体はKimi K3.1に直接言及せず、公開時期、製品能力、提供範囲、利用方法も説明していない。この推測について追加の確認は得られていない。

原文を読む →