Epoch 0
ZH · EN
デイリー AI ニュース
2026-10-09
出典:橘鸦 AI 早报 · 30 件
OpenAI、GPT-6.1 SolにUltrafastモードを導入
开发生态
OpenAI は API、Codex、ChatGPT Work で GPT-6.1 Sol の Ultrafast モードを展開中。公式発表では速度は Sol Standard の最大 8 倍で、API 料金は入力と出力それぞれ 100 万 token 当たり 12 米ドルと 60 米ドルとなる。
OpenAI が GPT-6.1 Sol 向けに提供する Ultrafast モードは、API、Codex、ChatGPT Work で展開が進んでおり、すべての対応地域で利用可能で、米国と EU のデータレジデンシーに対応している。API はすべてのユーザーに開放され、料金は入力 100 万 token 当たり 12 米ドル、出力 100 万 token 当たり 60 米ドルとなる。Codex と ChatGPT Work では、Pro 500 のほか、条件を満たす従量課金の Enterprise とクォータ課金の Edu サブスクリプションが対象で、Enterprise は管理者による権限の有効化が必要となる。公式によると、Ultrafast の速度は Sol Standard の最大 8 倍で、知能水準は Astra に近いという。
原文を読む →
OpenAI、デスクトップアプリのCodexに高速なsteeringを導入
开发生态
OpenAI は ChatGPT デスクトップアプリの Codex で steering を更新し、タスク実行中に追加した指示への応答を速めている。ユーザーは追加メッセージで現在のタスクを調整するか、次回の実行まで処理を待つかを選べる。
OpenAI は ChatGPT デスクトップアプリで、応答を速めた Codex steering を展開しており、ユーザーがタスク実行中にメッセージを送って実行過程を調整できる。追加メッセージの処理方法は Settings → General → Follow-up behavior で設定でき、現在の実行を調整するか、次回の実行まで待つかを選択する。ユーザーはこれにより Codex の進め方を修正し、不足情報を補い、タスクの方向を変更できる。OpenAI Codex チームの Tibo は、改良後の steering は即時に反映され、モデルが調整により速く応答し、実行中に方向を修正することで無駄な作業を避けられると説明している。
原文を読む →
阶跃星辰、Step 5 Previewを複数プラットフォームで1週間無料提供
开发生态
StepFun は Step 5 Preview の OpenRouter への導入を発表した。OpenCode、Cline、NousResearch、KiloCode などでは発表当日から順次、1週間の無料アクセスを提供し、モデル資料と API ドキュメントも公開した。
StepFun は、Step 5 Preview が OpenRouter で利用可能になり、OpenCode、Cline、NousResearch、KiloCode などのプラットフォームでも発表当日から順次、1週間の無料アクセスを提供すると発表した。同時に公開した資料には、モデル概要、ベンチマーク、デモ、技術仕様、API ドキュメントが含まれ、ユーザーは既存のワークフロー内でこのモデルに直接切り替えられる。公式は、このモデルが agentic および専門業務向けにフラッグシップ級の知能を提供し、タスクのコストが大きく低下すると説明している。原文には具体的なコストや低下率は記載されていない。
原文を読む →
Vercel AI GatewayにGlyph Clusterが登場、匿名提供期間中は無料
开发生态
Vercel は AI Gateway で、stealth 期間中に無料で利用できる Glyph Cluster を提供している。対象は Gateway credits を購入済みの Pro および Enterprise チームで、コーディングの推論に対応する一方、ZDR は提供されず、入力と応答が学習に使われる可能性がある。
Vercel は AI Gateway に stealth 段階の Glyph Cluster を追加し、AI Gateway credits を購入済みの Pro および Enterprise チームは、この期間中に無料で利用できる。呼び出し時のモデル名は stealth/glyph-cluster で、AI SDK、OpenAI 互換の Chat Completions および Responses APIs から利用できるほか、AI Gateway に接続した coding Agent でも選択できる。Claude Code、Codex、Cursor などでの接続手順は、最新版の Vercel CLI をインストールし、setup を実行してから Agent 内でモデルを選択する流れとなる。
公式説明によると、Glyph Cluster はコーディングと長いコンテキストの分析向けの reasoning model で、計画、情報の統合、定量的推論、大規模な入力にまたがる資料の比較に対応するほか、コードレビュー、不具合の説明、デバッグ、変更の提案、実装案の分析も行える。function calling とストリーミング応答に対応するが、入力はテキストのみで、画像やファイルは受け付けない。利用できるツールはユーザー定義の function tools に限られ、structured outputs には対応しない。ZDR は提供されず、このモデルに送信する prompts と responses は学習やモデル改善に使われる可能性がある。model playground でも試用できる。
原文を読む →
Claude、試験機能DashboardsとMotionを公開
产品应用
Claude は Dashboards と Motion の2つの beta 機能を発表し、それぞれ有料プランと Team・Enterprise 向けに提供した。Docs、Slides、Design も beta を終了し、Free を含む全プランで利用できる。
Claude は今回の発表時点で Dashboards と Motion の beta を公開し、Docs、Slides、Design を正式機能に移行した。Dashboards は有料プラン、Motion は Team と Enterprise が対象で、残る3機能は Free を含む全プランで利用できる。公式によると、ユーザーが Claude で作成した文書、プレゼンテーション、デザインは4500万件を超えている。Enterprise では Dashboards と Motion はデフォルトで無効になっており、管理者が Organization settings > Artifacts で有効にできる。
公式の説明によると、Dashboards は BigQuery、Databricks、Snowflake などのデータプラットフォームや Salesforce に接続し、自然言語の質問からダッシュボードを生成して、データの変化に合わせて更新する。ユーザーはクエリやチャートの最終更新時刻を確認でき、ダッシュボードを Amplitude、Grafana、Hex などに送って分析を続けることもできる。Motion はコードでテキスト、チャート、図形、画像をアニメーション化し、エディターでの修正や Claude への変更依頼、MP4 への書き出しに対応する。公式によると、Motion は video generation model を使用せず、映像素材や AI による人物を生成しない。制作物は Adobe、Descript、Runway などで引き続き編集できる。
原文を読む →
Google Cloud、Geminiの業務用エージェントを発表
产品应用
Google Cloud は Gemini at Work 2026 で統合型の業務用 Agent「Gemini」を発表し、質問応答、コンテンツ生成、コード実行を単一の API にまとめた。同社によると、Google Cloud 顧客の約 80% が同社の AI 製品を利用している。
Google Cloud は Gemini at Work 2026 で、業務向けの統合型 Agent「Gemini」の提供を発表したが、原文では具体的な提供開始日は明らかにされていない。公式説明によると、ユーザーは単一のインターフェースと単一の API を通じてタスクの目標を渡し、Gemini が作業を計画し、ツールを呼び出して企業システムに接続することで、質問応答、ナレッジワーク、画像・メディア生成、コードの作成と実行を行う。また、Gmail、Drive、Docs、Slides、Sheets、Chat、Calendar 内で直接動作し、同じ記憶、スキル、制御設定を引き継ぐという。
同社の説明によると、Gemini はクラウド上でタスクを継続実行し、デバイスやチャネルをまたいで記憶とコンテキストを保持するため、ユーザーがコンピューターを閉じた後も、数時間または数日かかる作業を続けられる。独立した ID を持つ一時的な sub-agents を作成し、並列または逐次実行のワークフローを調整できる。基盤となるモデルは Agent と分離されており、現在は Gemini シリーズのモデルと Anthropic の Claude モデルを利用できる。公式発表では、ID・権限管理、安全な sandboxing、network gateways に加え、Smart Routing やリアルタイムの支出上限など、ガバナンスとコスト管理の仕組みも示された。同社は Fortune 100 企業の約 90% が Gemini Enterprise を利用しているとしている。
原文を読む →
腾讯のWorkBuddy、独立したファイルブラウザーを導入
产品应用
Tencent WorkBuddy は独立したファイルブラウザーを提供開始した。同じウィンドウ内のタブで複数のローカルファイルを閲覧・編集でき、右側の AI チャット欄で内容を処理できる。公式説明によると、ローカルでの閲覧・編集はポイントを消費せず、AI 処理はタスクの複雑さに応じてポイントを消費する。
Tencent WorkBuddy は独立したファイルブラウザーを提供開始し、ユーザーはシステム上でファイルをダブルクリックするか、右クリックメニューの「開く方法」からファイルウィンドウにアクセスできる。同じウィンドウで複数のファイルを扱え、各ファイルが一つのタブになる。ローカルでダブルクリックして開いたファイルは、現在アクティブなファイルウィンドウに追加され、最後のタブを閉じるとウィンドウ全体が閉じる。未対応のファイル形式には、WorkBuddy で開くための項目は表示されない。開いたファイルはそのまま閲覧・編集でき、上部のツールバーはファイル形式に応じた機能を提供する。未保存の変更があるタブやウィンドウを閉じる際には、保存するか保存しないかを選ぶ確認が表示される。
ウィンドウ右側の AI チャット欄は初期状態では折りたたまれており、右上のボタンで展開できる。AI 編集を使った場合も自動的に展開される。ユーザーは AI に現在のファイルの要約、書き換え、文章の推敲、内容の補足を依頼できるほか、本文を選択して引用付きで質問し、修正結果を文書に反映させることもできる。公式説明によると、ブラウザーが読み取るのはユーザーが自ら開いたファイルだけで、ディスクの巡回やスキャンは行わない。ローカルでの閲覧・編集はポイントを消費せず、AI 処理は実際のタスクの複雑さに応じてポイントを消費する。ファイルの内容は今回のタスクの処理にのみ使用され、ユーザーが自ら共有するか第三者のストレージにアップロードする場合を除き、第三者には共有されない。
原文を読む →
JetBrains、Mellum2.1をオープンソース化、強化学習でコーディングエージェントを強化
模型发布
JetBrains は、コーディング Agent 向けの Mellum2.1 をオープンソースとして公開した。総パラメータ数は 12B、アクティブパラメータ数は 2.5B で、Apache 2.0 ライセンスを採用する。同社によると、今回の更新では主に強化学習によってリポジトリ内でのコード操作能力を改善した。
JetBrains は Hugging Face で Mellum2.1 を公開したが、原文には具体的な公開日は記載されていない。このモデルは Mellum2 の mixture-of-experts アーキテクチャを維持し、総パラメータ数は 12B、アクティブパラメータ数は 2.5B で、Apache 2.0 ライセンスの下でオープンソースとして提供される。自前のハードウェアで動作するコーディング Agent と sub-agents を対象としている。今回の更新は post-training に集中し、主に強化学習を採用した。同社によると、数千の実環境で数百万回の sandbox 実行を行う訓練により、コードベースの探索、ファイルの編集、変更の確認が可能になった。JetBrains は同じ評価設定で Mellum2、Qwen3.5-9B、Gemma 4 E4B と比較した。同社の説明では、Mellum2 に対して最も改善した分野は agentic coding であり、高負荷時のスループットは Qwen3.5-9B の約 2 倍、単一リクエストでは MTP の使用により速度が約 1.6 倍になる。llama.cpp、Ollama、LM Studio 向けの GGUF ビルドと、vLLM の speculative decoding 向けの MTP head は未公開である。
原文を読む →
Hugging Face、遺伝子アノテーションモデルCarbon-Aをオープンソース化
模型发布
Hugging Face は遺伝子アノテーションモデル Carbon-A とデータベースを公開した。公式発表によると、22,617 種から 5億6,600万の新たな遺伝子候補を発見し、モデル、学習データ、技術レポートも公開して、一部の予測を実験で検証している。
Hugging Face は Carbon Annotation Database と遺伝子アノテーションモデル Carbon-Annotator(Carbon-A)を公開したが、原文には具体的な公開日は記載されていない。公式発表によると、このモデルは 22,617 種から 5億6,600万の新たな遺伝子候補を発見し、そのうち数千種はこれまで研究されていなかった。データベース、モデル、学習データ、技術レポートは、HuggingFaceBio の Carbon Annotation Database Collection で入手できる。チームは ActiveSite、UCSD と協力し、新たに予測された遺伝子の一部を実験で検証した。
Carbon-A は 12億パラメータを持ち、RefSeq のアノテーションで学習し、DNA からタンパク質をコードする領域を直接予測する。98,304 塩基対のコンテキストウィンドウを使用して両鎖のヌクレオチド単位の予測を出力し、単一モデルで哺乳類、その他の脊椎動物、無脊椎動物、植物、菌類、原生生物を扱う。公式レポートによると、42 のベンチマークゲノムでマクロ平均ヌクレオチド F1 は 0.944 となり、ヌクレオチド、exon、遺伝子の各レベルで評価対象のベースラインを上回った。非標準の遺伝暗号を使う Tetrahymena thermophila では、ヌクレオチド F1 は 0.960 だった。
原文を読む →
LightOnAI、LightOnOCR-3をオープンソース化
模型发布
LightOnAI は LightOnOCR-3 をオープンソース化し、複雑な文書をアプリケーションが直接利用できる構造化コンテンツに変換する。公式説明によると、このモデル群は文字の書き起こしに加え、レイアウト要素の位置特定、画像説明、グラフからのデータ抽出に対応する。従来の LightOnOCR は Hugging Face で 450 万回を超えるダウンロードを記録している。
LightOnAI は、複雑な文書をアプリケーションが直接利用できる構造化コンテンツに変換するためのエンドツーエンド OCR モデル群 LightOnOCR-3 をオープンソース化した。原文には公開日の記載がない。公式説明によると、このモデル群は文字の書き起こしだけでなく、レイアウト要素の識別と位置特定、画像説明の生成、グラフや科学的な図からのデータ抽出も行う。LightOnOCR-3 は従来の LightOnOCR を基に開発されたもので、後者の Hugging Face でのダウンロード数は 450 万回を超えている。この数字は LightOnOCR のものであり、新たに公開された LightOnOCR-3 のものではない。
原文を読む →
Odyssey、世界モデルOdyssey-3を発表
模型发布
Odyssey は世界モデル Odyssey-3 を公開し、研究プレビューの提供を開始した。公式発表によると、Pro は Physics-IQ Verified の video-to-video テストで報告済み最高スコアの 66.1 を記録し、モデルは環境シミュレーションや制御方策の学習にも利用できる。
Odyssey は世界モデル Odyssey-3 を公開し、研究プレビューの提供を開始した。このモデルは autoregressive diffusion transformer を採用し、過去の観測と最新の入力から、物体の動きや相互作用、時間に伴う状況の変化を予測する。開発者は prompt から環境を生成し、生成中に移動したりイベントを加えたりして、モデルの反応を観察できる。プレビューは一人称・三人称のナビゲーションと独立したカメラ移動に対応する。公式説明によると、Odyssey-3 Pro は Physics-IQ Verified の video-to-video テストで報告済み最高スコアの 66.1、image-to-video テストで 54.7 を記録した。このテストは実際の物理実験の動画を使ってモデルの予測を評価し、流体力学、光学、固体力学、磁気学、熱力学を対象とする。
WorldMark 自身の captions を使い、13 項目の指標スコアの平均を取った公式評価では、Odyssey-3 は 4 カテゴリーのうち、一人称の様式化環境、三人称の実写環境、三人称の様式化環境で 1 位となった。公式は、モデルを具体的な物理システムに適用する際には、その機械とタスクに必要な挙動を別途評価する必要があるとも説明している。適応方法には、対になった観測と動作を使った action decoder または policy の学習が含まれる。公式によると、モデルは数十時間のロボット実演だけで操作タスクを完了し、把持失敗後のグリッパーの向きの調整や、通常とは異なる位置に落ちた物体の回収など、実演に含まれない復帰動作も示した。インドの実際の道路での運転への適応では、チームは Odyssey-3 backbone を凍結し、20 時間の運転データだけで policy を学習させ、車両前方の waypoints の予測によって閉ループ運転を実現した。
原文を読む →
Grok Imagine Video 1.5 Liteが登場、1080pで1秒あたり0.14ドル
模型发布
Grok Imagine は API を通じて Video 1.5 Lite を提供開始し、テキストからの動画生成と画像からの動画生成に対応した。料金は解像度別の秒単位で、480p、720p、1080p はそれぞれ 1 秒あたり 0.02、0.03、0.14 米ドルとなる。
Grok Imagine は、動画生成モデル Video 1.5 Lite が Grok Imagine API で利用可能になったと発表した。テキストからの動画生成と画像からの動画生成の 2 つの機能を提供する。料金は動画の解像度によって異なり、秒単位で課金される。480p は 1 秒あたり 0.02 米ドル、720p は 1 秒あたり 0.03 米ドル、1080p は 1 秒あたり 0.14 米ドル。原文には具体的な提供開始日や、この 3 種類以外の解像度の料金は記載されていない。
原文を読む →
Ghosttyの開発者、ターミナルプロトコルOSC 7501を公開
技术与洞察
原文を読む →
DeepSeek-V4の長文コンテキスト処理に周期的な弱点、研究が指摘
技术与洞察
原文を読む →
Epoch AI、実際の業務を対象とした評価を公開
技术与洞察
原文を読む →
人類数学協会、OpenAIのボイコットを呼びかけ
技术与洞察
原文を読む →
谷歌のAMIE研究が『ランセット』に掲載
技术与洞察
原文を読む →
Claudeの新利用ポリシー:継続的な虐待行為で利用停止の可能性
行业动态
原文を読む →
Anthropic、重要インフラとオープンソースソフトウェアを守るCyber Missionを始動
行业动态
原文を読む →
米連邦研究計画Genesis Mission、業界パートナー11社から24億ドルの拠出約束を獲得
行业动态
原文を読む →
OpenAIの年換算売上高は約500億ドル、従来報道を約200億ドル下回るとの報道
行业动态
原文を読む →
OpenAIを解雇された安全性研究者、公開書簡で違反行為を否定
行业动态
原文を読む →
OpenAI、偽記者や偽シンクタンクを装ってプロパガンダを広めたロシア・イランのアカウントを停止
行业动态
原文を読む →
Manusの親会社・蝴蝶效应、5億ドル超を調達
行业动态
原文を読む →
Arena、シリーズBで2億ドルを調達、アラインメント指数を公開
行业动态
原文を読む →
中国系とみられる攻撃者、AIツールで韓国の銀行を攻撃しデータを窃取
行业动态
原文を読む →
Ecosia、Mistralの品質の遅れに不満、中国のオープンソースモデルに切り替え
行业动态
原文を読む →
Harness、Augment Codeの一部資産を買収
行业动态
原文を読む →
Isomorphic Labs、新たな資金調達を交渉中、評価額は少なくとも400億ドルとの情報
前瞻与传闻
原文を読む →
阶跃终端、初のエージェント搭載スマートフォンを10月13日に発表へ
前瞻与传闻
原文を読む →