デイリー AI ニュース

2026-08-27

出典:橘鸦 AI 早报 · 19 件

2026-08-27
2026-08-27 2026-08-26 2026-08-25 2026-08-24 2026-08-23 2026-08-22 2026-08-21 2026-08-20 2026-08-19 2026-08-18 2026-08-17 2026-08-16

智谱、GLM-5.3-Flashを正式リリースしオープンソース化

要闻

智谱、GLM-5.3-Flashを正式リリースしオープンソース化

智譜は GLM-5.3-Flash を公開し、MIT License でオープンソース化しました。重みは HuggingFace で公開され、総パラメータ数は 320B、活性化パラメータ数は 18Bで、テキスト、画像、動画の入力と 1M のコンテキストに対応します。

GLM-5.3-Flash は智譜から正式に公開され、モデルの重みは HuggingFace から取得でき、MIT License が適用されます。総パラメータ数は 320B、活性化パラメータ数は 18Bで、テキスト、画像、動画をネイティブに入力でき、コンテキスト長は 1M です。同社の説明によると、疎な注意機構と線形注意機構を組み合わせた初のオープンソースのフロンティアモデルで、多様体制約付きハイパーコネクションによって scaling を強化しています。IndexPool はインデクサーの 4 個のキャッシュベクトルを 1 個に圧縮し、1M コンテキストでのレイテンシーとメモリ使用量を抑えます。視覚能力は Coding ループに組み込まれ、コード、ブラウザ、グラフィカルインターフェースを連携させ、フロントエンド開発、ゲーム構築、Blender 3D シーン、BUA と CUA による実環境操作に対応します。思考モードは無効化できず、thinking.type は enabled のみをサポートします。

正式公開前、智譜は Ox Alpha というコードネームで OpenCode と OpenRouter において同モデルをテストしました。公式発表によると、GLM-5.3-Flash は Artificial Analysis Intelligence Index v4.1.1 で 57 点を獲得し、6 つの coding および agentic ベンチマークで GLM-5.2 を上回りました。智譜は、国産チップのクラスターで大規模トラフィックを処理したのは今回が初めてで、Ox Alpha のテスト期間中も全トラフィックに国産チップの計算資源を使用したと説明しています。同一ハードウェア上の初期ベースラインと比べ、エンドツーエンドのサービス性能は 3 倍となり、ハードウェア効率と token 当たりのコストは主要な NVIDIA GPU と同等の水準に達したとしています。GLM Coding Plan で利用できる同モデルの割り当ては GLM-5.3 の 3 倍で、ユーザーの割り当てもリセットされました。中国国内の API の通常価格は GLM-5.3 の 10 分の 1で、2 週間限定の 50%割引も提供されます。

原文を読む →

阿里、Qwen3.8-Flashモデルをリリース

要闻

阿里、Qwen3.8-Flashモデルをリリース

AlibabaのQwenはQwen3.8-Flashを公開し、Qwen3.8-Flash-Nextの重みも開放した。モデルはToken当たり6Bパラメータを有効化し、262Kのコンテキストをネイティブでサポートする。入力と出力の料金は100万Tokens当たりそれぞれ1元と3元。

AlibabaのQwenはQwen3.8-FlashをQwen AIプラットフォームで提供開始し、同時にオープンソース版Qwen3.8-Flash-Nextの重みをHugging FaceとModelScopeで公開した。後者はQwen4の新アーキテクチャを先行公開するモデルと位置付けられている。モデル本体は125Bパラメータで構成され、別途51BのN-gram Embeddingを備え、Token当たり6Bパラメータを有効化する。ネイティブのコンテキスト長は262Kで、YaRNにより1Mまで拡張できる。アーキテクチャの変更はAttention、Residual、Embedding、Optimizationに及び、GDN+QSAハイブリッドAttention、Gated Residual、N-gram Embedding、Muon Optimizerを導入した。公式によると、学習コストはQwen3.7-Plusの約1/9で、コーディング、オフィス業務、マルチモーダルAgentタスクでより高い性能を示す。プラットフォームの入力と出力の料金は、100万Tokens当たりそれぞれ1元と3元。

原文を読む →

OpenAI、5.5-miniの誤ルーティング問題を修正し謝罪

要闻

OpenAI、5.5-miniの誤ルーティング問題を修正し謝罪

OpenAI のスタッフ Adam Fry は、ルーティングのリグレッションにより、Pro と Thinking のリクエストの約 3% が誤って 5.5-mini に振り分けられていたと説明した。問題はすでに修正され、同氏は謝罪した。

Adam Fry はこの不具合について投稿した時点で、OpenAI が関連するルーティングのリグレッションを修正済みだと述べ、自らも謝罪した。同氏の説明によると、システムはそれまで、意図せず Pro と Thinking のリクエストの約 3% を 5.5-mini に送っていた。これに先立ち、複数のユーザーは、Chat モードで推論強度を高めに選択すると、通知なしにリクエストが GPT-5.5-mini へ切り替えられると報告していた。

原文を読む →

Google、音声文字起こしモデルGemini 3.5 Transcribeをリリース

模型发布

開発者はGoogleのサービスを通じて音声テキスト変換モデルGemini 3.5 Transcribeを利用できるようになった。公式によると、最終的な文字起こしまでの所要時間はChirp 3と比べて70%短縮された。

GoogleはGemini 3.5 Transcribeを公開し、Google AI StudioのGemini APIとGemini Enterprise Agent Platformを通じて開発者向けに提供している。このモデルはvoice agents、リアルタイム字幕、通話後分析を対象とし、生の音声を整理・フォーマット済みのテキストへ直接変換する。公式の説明では、リアルタイムの言語切り替え、streaming transcription、複数話者の識別、単語単位のタイムスタンプ、カスタム語彙の認識、発話中の不要語の除去に対応する。

公式はArtificial Analysisの測定を引用し、最終的な文字起こしまでの所要時間がChirp 3より70%短縮されたとしている。主要な言語と地域を対象とするFLEURS benchmarkでは、streaming modeのWERが5.50%、non-streaming use-casesでは5.04%だった。公式の説明によると、このモデルはGboard、Antigravity、Gemini app、Chrome、AndroidのRambler、macOS版Gemini appでも使用されている。Agora、Fishjam、LangChain、LiveKit、Pipecat、Vercel、Vision Agentsは、Gemini Live APIを通じて関連する開発・デプロイ機能を提供する。

原文を読む →

Antigravity CLIに音声モードが登場、agentとの対話が可能に

开发生态

Antigravity CLIに音声モードが登場、agentとの対話が可能に

Antigravity CLI の最新バージョンに音声モードが追加され、ユーザーは /voice の実行または F5 キーで agent と音声対話できる。この機能は Gemini 3.5 Transcribe を採用し、SSH 経由でローカルマイクを利用することにも対応する。

最新バージョンの Antigravity CLI は、ユーザーが agent と直接音声で対話できるようになり、/voice コマンドまたは F5 キーから起動できる。公式によると、CLI の音声モードと Antigravity インターフェースのマイクボタンには、新しい音声テキスト変換モデル Gemini 3.5 Transcribe が採用され、文字起こし時に「あー」「えー」などのフィラーを自動で削除する。/voice には mic-serve サブコマンドも追加され、SSH 接続経由でローカルマイクを利用できる。

原文を読む →

Claude Code、フィードバックレポートを自動作成し、ユーザーの承認後に送信可能に

开发生态

Claude Code、フィードバックレポートを自動作成し、ユーザーの承認後に送信可能に

Claude Codeは、実行失敗、自身の誤りの検出、ユーザーからの問題指摘を受けてフィードバック報告を自動作成し、ユーザーの確認、修正、承認後にAnthropicへ送信できるようになった。この機能は/configで無効化または調整できる。

Claude Codeでフィードバック報告の自動起草機能が提供され、報告はユーザーが確認、修正、承認を終えた後にのみAnthropicへ送信される。実行が失敗した場合、Claudeが自身の誤りを検出した場合、ユーザーが問題を明示的に指摘した場合に起動し、生成後はユーザーが内容を確認して修正したうえで、送信を承認するかどうかを決められる。AnthropicのスタッフであるThariqの説明によると、この機能は新しいSendFeedbackツールで実装されており、ユーザーは先に/feedbackを実行してから報告を手作業で書く必要がなくなった。関連する自動起草と送信の動作は、/configから無効化または調整できる。

原文を読む →

Claude in Chrome、すべての有料サブスクリプションプランに正式開放

产品应用

Claude in Chrome、すべての有料サブスクリプションプランに正式開放

Claude公式はClaude in ChromeをすべてのClaude有料プランに正式提供し、ユーザーはブラウザ内でタブをまたぐ操作を自律実行させられるようになった。各操作は実行前にsafety classifierが安全性と元の依頼との一致を検証する。

すべてのClaude有料プランのユーザーは、Chrome Web StoreからClaude in Chromeをインストールできる。このツールはgenerally availableとなり、ブラウザ操作の自動承認機能も追加された。既存のログイン状態を利用して、ページの閲覧、テキストの読み書き、リンクのクリック、ページ間の移動、フォーム入力を行えるほか、複数タブにまたがるタスクを処理し、desktop、mobile、web appsで会話を継続できる。自動承認は設定で無効にし、操作ごとの手動確認に戻せる。元の依頼と一致しない操作はブロックされる。

防御機構には、tool resultsをスキャンするprobesも含まれる。prompt injectionの疑いが検出されるとClaudeに警告が送られ、必要に応じてユーザーへ確認する。公式によると、専門のred-teamersが用意した、より強い攻撃を使う現行評価では、追加の防御を適用する前にモデルへ到達した攻撃の成功率は、Claude Opus 4.5で17.6%、Claude Opus 5で3.8%だった。probesとsafety classifierを有効にした場合、Claude Sonnet 5、Claude Opus 5、Claude Mythos 5ではいずれも0%、Claude Fable 5では0.3%だった。公式説明では、成功した突破は手動検証により、すべて深刻度の低いシナリオと確認された。Enterprise管理者はOrganization Settingsで承認済みドメインに制限できる。ローカルファイルや他のアプリケーションを扱う場合は引き続きClaude desktop appが必要で、このツールは他のChromiumブラウザには対応しない。

原文を読む →

Claude、Coworkに内蔵ブラウザを導入、今後1週間以内に提供開始

产品应用

Claude、Coworkに内蔵ブラウザを導入、今後1週間以内に提供開始

Claude Coworkは内蔵ブラウザの提供を開始しており、今後1週間以内にデスクトップ版の全有料プランへ展開します。サイドパネル上でWebサイトの操作やフォーム入力、タスク全体の実行が可能で、別途インストールする必要はありません。

Claude Coworkは内蔵ブラウザを段階的に展開しており、今後1週間以内にデスクトップ版の全有料プランで利用可能になります。Webサイトを扱うタスクでは、ブラウザがCoworkのサイドパネルに直接表示されます。公式によると、Claudeはそこでページの移動、フォーム入力、タスク全体の実行を行えます。この機能はデスクトップアプリに統合されているため、ブラウザを追加でインストールする必要はなく、ユーザー自身のブラウザやそのログイン状態からも独立しています。

原文を読む →

Grok Bot、SuperGrokとCursor Proの契約者に開放、週間利用枠もリセット

产品应用

Grok Bot、SuperGrokとCursor Proの契約者に開放、週間利用枠もリセット

SuperGrokとCursor Proの全契約ユーザーがGrok Botを利用できるようになり、全ユーザーの週間利用上限もリセットされた。Michael Truell氏は、同製品の成長速度が自身の見てきたどの製品よりも速いと述べた。

Grok Botの公式アカウントは、同サービスをSuperGrokとCursor Proの全契約ユーザーに開放し、同時に全ユーザーの週間利用上限をリセットしたと発表した。Michael Truell氏は、Grok Botの成長速度が自身の見てきたどの製品よりも速いと述べた。同氏の説明によると、ユーザーがGrok Botに委任しているタスクは、小規模ECの運営、顧客向けイベントの調整、本番環境向けソフトウェアのテスト、日常の退屈な作業など、複数の実務に及んでいる。

原文を読む →

谷歌、Gemini Liveに大規模な生産性向上アップデートを導入

产品应用

GoogleはGemini Liveの生産性向上アップデートを開始し、Sparkによる複数ステップのタスク、Daily Brief、Gmailの音声管理、Personal Intelligenceを追加した。公式によると、ユーザーの63%がGeminiと音声でやり取りしている。

Googleは現在、Sparkとの統合、Daily Brief、Gmailの受信トレイ操作、Personal Intelligenceを含む音声ベースの生産性機能をGemini Liveへ順次提供している。ユーザーが自然言語で複雑な複数ステップのタスクを作成すると、SparkがGoogle Docs、Sheets、Drive、ウェブを横断してバックグラウンドで実行し、数日または数週間にわたる継続的な処理やスケジュール済みの作業にも対応する。Daily Briefは、GmailとCalendarにある当日の重要な更新をまとめ、音声でToDoの概要を伝える。公式によると、ユーザーの63%がGeminiに音声で話しかけている。

Gmailでは、Gemini Liveが音声指示に基づいてメールを検索、要約、スター付け、アーカイブ、削除でき、新着メールや特定の送信元から届いた緊急メールの有無にも回答する。Personal Intelligenceは、過去の会話と、接続済みのGmail、Photos、Search、YouTubeの情報を組み合わせて質問に答える。継続中の会話では、メールからイベントへの招待を取り出し、家族用のCalendarイベントを作成して移動時間を追加するといった依頼を、Gemini LiveからSparkへ渡してバックグラウンドで処理できる。利用するには、Gemini Personal Intelligenceの設定でアプリとの接続を選択し、Gemini app内のLiveアイコンをタップする必要がある。

原文を読む →

OpenAI、ChatGPT WorkとCodexで可視化チャートを生成できる$visualizeを紹介

产品应用

OpenAI、ChatGPT WorkとCodexで可視化チャートを生成できる$visualizeを紹介

OpenAI Developers は製品デモを転載し、ChatGPT Work と Codex で利用できる $visualize 機能を紹介しました。その説明によると、ユーザーはこのコマンドを入力することで、情報を可視化コンテンツに変換できます。

OpenAI Developers は、スタッフの Katia Gil Guzman によるデモを引用して転載し、ChatGPT Work と Codex の $visualize 機能を紹介しました。デモでは、ユーザーが $visualize コマンドを入力すると、情報を可視化コンテンツへ変換できると説明しています。紹介内容は ChatGPT Work と Codex の両方を対象としており、いずれも同じ $visualize コマンドの呼び出しが中心となっています。元記事には具体的な提供開始日や、生成できるグラフの種類は記載されていません。

原文を読む →

Manus、データ復旧を開放し、サービスは通常の安定稼働に復帰

产品应用

Manus、データ復旧を開放し、サービスは通常の安定稼働に復帰

Manus はデータ復旧機能を開放し、サービスが現在は通常どおり安定稼働していると発表した。データをバックアップ済みのユーザーは任意のタイミングで復旧でき、期限は設けられず、影響を受けたアカウントには Welcome Back Bonus も付与される。

Manus はデータ復旧機能の提供を開始し、公式アカウントを通じて、サービスは通常の状態に戻り、安定して稼働していると発表した。復旧操作はデータを事前にバックアップしていたユーザーが対象で、指定された期日までに完了する必要はなく、各自の都合に合わせて開始できる。同社の説明によると、データ復旧に期限はなく、都合のよいタイミングで操作できる。今回のサービスで影響を受けたアカウントには、Welcome Back Bonus という名称の特典も提供される。

原文を読む →

OpenAI、Hugging Face侵害事件の技術レポートを公開

技术与洞察

OpenAI、Hugging Face侵害事件の技術レポートを公開

原文を読む →

Anthropic、Claudeの集約対話に関する研究を公開

技术与洞察

原文を読む →

リーク情報:Fable 5.1は早ければ木曜日にリリース、Web版ですでに段階的展開

前瞻与传闻

リーク情報:Fable 5.1は早ければ木曜日にリリース、Web版ですでに段階的展開

原文を読む →

月之暗面、Kimi K3の収益分配を巡りクラウド大手3社と交渉か

前瞻与传闻

月之暗面、Kimi K3の収益分配を巡りクラウド大手3社と交渉か

原文を読む →

MiniMax:M3 Proのパラメータ規模は約3Tに拡大する見通し

前瞻与传闻

原文を読む →

Anthropic、Nscaleと約450億ドルのコンピューティング能力リース契約を締結と報道

前瞻与传闻

Anthropic、Nscaleと約450億ドルのコンピューティング能力リース契約を締結と報道

原文を読む →

Altman、OpenAIは2026年末までにAGIと呼べる内部システムを保有する見通しと発言

前瞻与传闻

Altman、OpenAIは2026年末までにAGIと呼べる内部システムを保有する見通しと発言

原文を読む →