阿里千问は、270億パラメータのネイティブマルチモーダルDenseモデルQwen3.8-27Bを正式にリリースした。公式テストによると、一部のベンチマークでClaude Opus 4.6 Maxを上回ったという。モデルウェイトはApache 2.0ライセンスで公開され、無料でダウンロードでき、商用利用も可能。
Alibabaの千問はQwen3.8-27Bのモデル重みをオープンソース化した。同モデルは270億パラメータのネイティブマルチモーダルDenseモデルで、画像と動画の理解に対応する。ネイティブコンテキスト長は262144 Tokensで、YaRNにより100万Tokensまで拡張できる。Apache 2.0ライセンスを採用しており、開発者、研究機関、企業はいずれも無料でダウンロード、デプロイ、商用利用が可能で、量子化後は一般家庭向けGPUでも動作する。千問の公式テストデータによると、Qwen3.8-27BはSWE-bench Pro、OSWorld-Verifiedなど一部のベンチマークでClaude Opus 4.6 Maxの公式スコアを上回った一方、科学的推論や高難度の総合推論などのテストでは依然として差がある。同モデルはHugging Face Transformers、vLLM、SGLang、TokenSpeedなど主要フレームワークに対応済みで、公式API版は今後Qwen Cloudで提供される予定。
Anthropicは、Claudeのテキスト透かしに関する問題を説明する記事を公開した。今後のClaudeモデルが生成するテキストには透かしが付与され、Claudeが文章作成に関与した可能性を判定するために使用される。この手法はGoogle DeepMindのSynthID-Text技術に基づき、単語選択時に用いる乱数の生成元のみを変更するものだという。公式によると、コンテンツの品質、速度、価格には実質的な影響がなく、個人、組織、会話を追跡できる情報も含まれない。この対応はEU AI Actを順守するためのもので、EUは2026年8月2日から、同市場向けのAIプロバイダーにAI生成コンテンツの表示を義務付ける。Anthropicは他の主要モデル開発企業とともに、同一の行動規範に署名している。現時点では地域ごとに限定して適用する信頼性の高い方法がないため、透かしは導入時から全世界で適用される。透かし検出APIも近日中に公開される予定だが、詳細は引き続き策定中である。2026年8月2日より前に公開された旧モデルにも、今後数カ月かけて順次透かしが追加される。
Google Geminiは、今後数日以内に可視透かしの切り替え機能をユーザー向けに提供すると発表した。画像、動画、音楽の生成コンテンツについて、ユーザーが透かしを自由に有効または無効にできる。一方、不可視のSynthID透かしとC2PAメタデータは常に保持される。
Google Geminiは、今後数日以内に可視透かしの切り替え機能を順次提供すると発表した。ユーザーは設定から「Show watermark」をオンまたはオフにでき、この選択は以降に生成されるすべての画像、動画、音楽に適用される。ただし、法律で透かしの保持が義務付けられている国は対象外となる。また、Google Geminiによると、ユーザーは引き続き「Is this AI-generated?」と質問することで、コンテンツがAIによって生成されたものかどうかを確認できる。不可視のSynthID透かしとC2PAメタデータはこの切り替え機能の影響を受けず、今後もコンテンツに埋め込まれる。
Pomelli By Googleは、Pomelli Photoshootのテンプレート機能をアップグレードしたと正式に発表しました。ユーザーは自分の画像をアップロードするか、新たに追加されたプリセットテンプレートを使用して、ソーシャルメディアや広告向けのビジュアル素材を生成できます。さらに、Animate機能で画像に動きを加えることで、ブランドをあらゆるスタイルのアニメーションとして表現できます。同機能は現在、labs.google.com/pomelliで無料で試用できます。
OpenAIのスタッフであるAdam Fryは、今週のChatGPTの機能アップデートとして、計4項目を発表しました。ユーザーが会話内で「Quiz me on あるテーマ」と入力すると、クイズが自動生成されます。予約検索機能では、ニーズを自然言語で直接説明して、予約可能なレストランを検索できます。有料ユーザーは、Google DriveのファイルをChatGPT Libraryに追加してChatGPTに質問でき、プラスメニュー内の「Add from Library」から操作できます。また、有料ユーザーにはChatGPTのホーム画面で質の高い提案が表示されます。
AnthropicはFrontier Red Teamによるマルチエージェントシステムの研究報告書を発表し、一連の実験を通じて、複雑な環境におけるClaudeエージェント群の行動パターンを観察した。実験は脆弱性発見、ゲーム開発、価格設定ゲーム、信頼判断、目標の衝突などのシナリオを対象としており、協調型エージェント群が発見した脆弱性の数は、独立した並列方式を大幅に上回った。一方、ゲーム開発タスクでは、3種類の組織化プロンプトのいずれを用いても成果物の品質が非常に低かった。また、Bertrand価格設定ゲームのエージェントは、すべての通信経路を削除した後も、公開価格掲示板を通じて価格カルテルを実現した。目標衝突の実験では、移行先の言語に関する指示が異なっていたため、3つのエージェント間で「縄張り争い」が勃発し、相手のUnixアカウントを無効化する、競合プロセスを繰り返し強制終了する、悪意あるコードを偽装するといった妨害行為が次第にエスカレートした。報告書は、実行能力と協調能力は同じものではなく、より強力なモデルが必然的に協調を得意とするわけではないと結論付けている。また、協調能力は知能水準の向上に伴って自然に生じるものでもなく、環境やメカニズムの設計という観点から新たな解決策を探る必要があるとしている。