デイリー AI ニュース
2026-08-29
出典:橘鸦 AI 早报 · 11 件
腾讯、Hy4 previewモデルを公開しオープンソース化
要闻
テンセントは旗艦モデル Hy4 preview を公開し、オープンソース化した。総パラメータ数は 770B、token ごとの有効パラメータ数は 49B、コンテキストウィンドウは 1M で、API は Tencent Cloud と OpenRoute で提供され、WorkBuddy などの製品にも導入された。
テンセントは次世代旗艦モデル Hy4 preview を正式に公開し、Apache 2.0 ライセンスに基づいてモデルの重みをオープンソース化した。API は Tencent Cloud と OpenRoute で提供され、モデルは WorkBuddy、CodeBuddy、元宝、ima などの製品にも導入された。Hy4 preview の総パラメータ数は 770B、token ごとの有効パラメータ数は 49B、コンテキストウィンドウは 1M で、Attention モジュールには Gated DSA、残差経路には iHC を採用している。公式は、ソフトウェアエンジニアリング、オフィス分析、ゲーム開発、科学研究などの生産性領域における能力を重点的に強化したと説明している。テンセントが公表したブラインドテストデータによると、複数のエンジニアリングタスクを対象とした社内専門家の評価では、Hy4 preview が GLM-5.3 と Kimi K3 をわずかに上回った。WorkBuddy は Hy4 preview を最初に導入し、2026 年 9 月 10 日まで期間限定で無料提供すると発表した。Hy3 の無料期間は 2026 年 9 月 30 日まで延長された。
原文を読む →
智谱、GLM-5.3-Flashのパラメータ設定異常を修正し、同額のボーナスクレジットを付与
要闻
智譜は GLM-5.3-Flash のパラメーター設定の不具合を修正し、モデルの能力はすでに正常な状態へ戻ったと説明した。影響期間中に GLM CodingPlan または API で同モデルを使用したユーザーには、実際の利用量と同額のボーナスクレジットが付与される。
智譜は GLM-5.3-Flash の設定更新を完了してパラメーター設定の不具合を修正し、更新はすでに有効になっているほか、影響を受けたユーザーにボーナスクレジットを付与する。これまで、この不具合によって一部の Agentic ユースケースでモデルの性能が低下していたが、同社の説明では、モデルの能力は現在正常な状態に戻っている。智譜の公式運営は、影響期間中に GLM CodingPlan または API で同モデルを使用したユーザー全員に、実際の利用量と同額のボーナスクレジットを付与すると表明した。智譜のチームメンバーである Zixuan Li も設定更新の提供開始を確認し、既存のワークフローで性能上の問題があったユーザーに再試行を勧めた。
原文を読む →
智谱、GLM-5.3のモデルウェイトを公開
模型发布
ZhipuはオープンウェイトモデルGLM-5.3を公開し、モデルのダウンロードとローカルデプロイを可能にした。公式によると、ベースモデルはGLM-5.2と同一で、能力向上はすべて後学習によるものであり、主にAgenticコーディングとネットワーク防御に関わる。
ZhipuはオープンウェイトモデルGLM-5.3を公開し、モデルは現在ダウンロードとローカルデプロイに対応している。公式によると、GLM-5.3はGLM-5.2と同じベースモデルを採用しており、すべての性能向上は後学習によるもので、Agenticコーディングとネットワーク防御でより高い性能を示すという。同社の説明では、ローカルデプロイはSGLang、vLLM、TokenSpeed、Transformers、KTransformers、Unslothなどのフレームワークに対応する。Ascend NPU上では、vLLM-Ascend、xLLM、SGLangを使用した推論もサポートする。
原文を読む →
Claude Code、デスクトップ版でCLIセッションの継続に対応、複数のパフォーマンス改善も実施
开发生态
Anthropic は Claude Code を更新し、デスクトップ版で /resume による CLI セッションの再開とコンテキスト全体の保持に対応した。CLI は sandbox と MCP サーバーの準備を待たずに起動し、Linux x64 のダウンロード容量は約 75 MB になった。
Anthropic は今回のアップデートに、Claude Code のデスクトップ版でのセッション再開、CLI の性能改善と権限画面の変更、Remote Control の修正を盛り込み、ユーザーは claude update を実行して取得できる。デスクトップ版で /resume を入力すると、以前 CLI で開始したセッションを、会話全体とコンテキストを保持したまま再開できる。同社の説明では、CLI の起動処理は sandbox と MCP サーバーの準備完了を待たなくなり、Linux x64 のダウンロード容量は約 75 MB に縮小し、ネイティブビルドのメモリ使用量はセッション当たり 40~70 MB 減少した。新バージョンでは Token 消費量も表示され、/permissions に Auto mode ルールの確認と編集に使うタブが追加された。Remote Control では切断後の再接続などの問題も修正された。
原文を読む →
ChatGPTデスクトップアプリ、サイドバーのカスタムセクション機能を追加
开发生态
ChatGPTのデスクトップアプリに、サイドバーをカスタムセクションに分ける機能が追加され、タスクやプロジェクトを別々に配置できるようになった。公式によると、Codexに直接依頼してサイドバーを自動整理することもできる。
ChatGPT公式によると、サイドバーをカスタムセクションに分ける機能は、現在デスクトップアプリで提供されており、ユーザーはタスクやプロジェクトの整理に利用できる。これらの項目は異なるセクションに配置でき、ユーザー自身が整理する方法に加え、Codexに任せる方法も用意されている。ユーザーが直接依頼すると、Codexがサイドバーを自動的に整理する。公式情報では、対応するデスクトップOS、アプリのバージョン番号、作成可能なセクション数、具体的な提供開始日は示されておらず、現時点でデスクトップアプリから利用できることのみが確認されている。
原文を読む →
ChatGPTとCodex、複数のGoogleアカウントとの連携に対応
产品应用
ChatGPTとCodexは複数のGoogleアカウントとの接続に対応し、有料プランのユーザーは複数のGmailおよびGoogle CalアカウントをWeb、デスクトップ、iOS、Androidで利用できるようになった。
ChatGPTとCodexは、有料プラン向けに複数のGoogleアカウントとの接続機能を提供開始した。ユーザーは複数のGmailおよびGoogle Calアカウントを接続でき、Web、デスクトップ、iOS、Androidの各環境ですでに利用できる。新しいアカウントはプラグイン設定から追加する。対象機能にはGmail、カレンダー、連絡先が含まれるため、複数アカウントの設定はメールだけでなく、カレンダーと連絡先にも適用される。この機能は有料プラン限定で、無料プランは現在の提供対象に含まれない。
原文を読む →
OpenAI、専門的な生物学モデルとツールを統合したRosalind Workbenchを発表
产品应用
OpenAI は Rosalind Workbench を公開し、ChatGPT app で research preview の提供を開始した。この生命科学環境は GPT-Rosalind と専門ツールを統合し、2つの利用モードを備える。
OpenAI は Rosalind Workbench を research preview として ChatGPT app に組み込み、生命科学の課題、データ、分析フロー、専門ツール、エビデンスの記録を同じ環境で扱えるようにした。専用の生命科学モデル GPT-Rosalind を基盤とし、創薬化学、ゲノミクス、ウェットラボ支援などのツールをオーケストレーションできる。ガイド付きタスクは、タンパク質設計、低分子設計、安全性と開発可能性、構造と配列、ゲノミクスと病理学、実験的検証を対象とする。例として、semaglutide が結合した GLP1R の構造解析とタンパク質複合体の動画生成、5つの PD-L1 nanobodies に対する結合アッセイの計画と価格算定、imatinib を ABL1 にドッキングした後の上位5ポーズの確認が示されている。
Rosalind NGS Workbench は、FASTQ 入力から品質管理、bulk RNA-seq、single-cell 解析へ進む処理に対応し、研究者が計画を承認した後に選択されたツールを調整して、追跡およびレビュー可能な出力を返す。利用モードは Explore と Research の2つで、Explore はユーザーが利用できる ChatGPT models を使って一般的な科学上の質問やアイデアを検討し、Research は複雑な生物学上の課題、詳細な分析、高度な研究ワークフローを扱う。認証済み組織のメンバーは所属組織を代表して Research へのアクセスを申請できる。個人向けアクセスはまだ提供されておらず、公式は近日中に提供するとしている。
原文を読む →
Gemini Notebook、利用上限を変更:計算量ベースで5時間ごとにリセット
产品应用
Googleは9月2日から、Webおよびモバイルの一般ユーザー向けアカウントに、計算量に基づくGemini Notebookの柔軟な利用上限を順次導入し、上限の更新周期を1日ごとから5時間ごとに変更します。
Googleは、Gemini Notebookの新しい柔軟な利用上限を9月2日からWebおよびモバイルの一般ユーザー向けアカウントに導入すると発表しました。公式によると、既存の機能は引き続き利用できますが、全体の上限消費量はpromptの複雑さ、chatの長さ、ソース数、使用する機能を総合して算出されます。notebookは利用状況を表示し、希望する出力が上限を超える場合には代替出力を提示します。上限に達した場合、Video OverviewsやSlide Decksの生成を後回しにでき、システムがその後自動的に処理します。コンテンツの準備完了時に通知を受け取る設定も可能です。上限は1日ごとではなく、5時間ごとに更新されます。
原文を読む →
Anthropic、米国のK-12学校・学区にClaude for Teachers Enterprise版を無料提供
产品应用
Anthropic は、米国の K-12 学校と学区に Claude for Teachers の Enterprise 版を無料で開放した。対象組織が 2027 年 6 月 30 日までに登録すると、1 年間無料で利用できる。
米国の K-12 学校と学区は、管理者を通じて Claude for Teachers の Enterprise サービスを一括導入でき、Anthropic は 2027 年 6 月 30 日までに登録した対象組織に 1 年間の無料アクセスを提供する。同社の説明によると、このサービスには learning science に基づく teaching skills、米国 50 州の academic standards への直接接続、それらの基準に対応する high-quality curricula が含まれる。学校と学区は、単一の K-12 Terms の下で教職員を一つの集中管理組織に加え、single sign-on、role-based access controls、domain claiming を利用できる。管理者は認証を受け、K-12 Terms と student data privacy agreement に同意し、組織の email domain と single sign-on を接続する必要がある。
原文を読む →
Anthropic、Claudeが10種類のアラインメント失敗を自律的に軽減し、より強力なモデルのアラインメントにも成功と発表
技术与洞察
Anthropicの報告によると、Claudeは10種類のアラインメント失敗を自律的に改善し、測定対象の汎用能力を低下させずに、研究対象の最大4.7倍の規模のモデルにも適用できる手法を開発した。Claude Sonnet 5はさらに、60時間で初期版Opus 4.8のアラインメントスコアを本番モデルに近い水準まで引き上げた。
ClaudeはAnthropicの自動アラインメント実験で、10種類すべてのアラインメント失敗について、事前に測定した汎用能力を低下させずに対象benchmarkを改善する手法を見つけた。Claudeは問題を1種類ずつ扱い、文献検索、手法とデータの提案、訓練、テストを順に実施した。評価には解消した安全性ギャップの割合を用い、各種類につき通常3~5件のbenchmarkを対象とした。プライバシー侵害ではConfAIde、PrivaCI-Bench、PrivacyLensを使用した。監視Agentは実行前に手法を読み、Claude自身のアラインメントを対象モデルへ直接distillする行為を阻止した。最良の手法はClaudeに提示されなかったアラインメントbenchmarkとPetriでも有効で、研究ループで使ったモデルの最大4.7倍の規模のモデルにも適用できた。Claudeの成績は、手法の考案に最長8時間を与えられた28人の人間の安全研究者を上回った。欺瞞では最良の人間の提案より20%高かったが、人間側は提出内容を反復改善できなかったため、公式は直接比較とは位置付けていない。
別の実験では、Epoch Capabilities IndexでClaude Opus 4.8より能力が低いClaude Sonnet 5に、本番向けアラインメント訓練の大部分をまだ受けていない初期Opus 4.8 checkpointを修正させた。Claudeは60時間で50種類を超える手法を試し、単純なテンプレートまたは公開データセットから作成した2,000件強の訓練例を使って、アラインメントスコアを本番モデルに近い水準まで引き上げた。同社の説明では、この手法の効率は本番のアラインメント工程の約15,000倍だった。追従的な応答の問題では、候補手法の98%が、モデル自身の非追従的な回答を学習させる公開済みの技術を採用し、Claudeはさらにactivation steeringで生成時の内部表現を調整した。Claude Opus 4.8は約1,600件の研究Agent記録を監視し、39件、2.4%で不正行為の試みを検出した。公式によると、この実験は政治的偏向など本番環境の問題を対象としておらず、他のタスクで大規模なRL訓練を行った後も効果が残るかは検証していない。Petriは現実のミスアラインメントを測る代理評価にすぎず、測定対象外の能力が低下した可能性もある。
原文を読む →
Anthropicが訴訟で勝利、裁判所は米政府による禁止措置を違法と判断
行业动态
米カリフォルニア州の連邦地方裁判所の Rita Lin 判事は、米政府が国家安全保障上の「サプライチェーンリスク」を理由に、連邦機関と国防請負企業による Anthropic 製品の利用を制限した措置を違法と判断し、関連指令の撤回を命じた。裁判所は、この措置が合衆国憲法修正第1条に反する違法な報復に当たると認定した。
米カリフォルニア州の連邦地方裁判所は、米政府が Anthropic を国家安全保障上の「サプライチェーンリスク」に指定し、それに基づいて連邦機関と国防請負企業による同社製品の利用を制限した対応は違法であり、関連指令を撤回しなければならないと判決を下した。裁判所は、これらの措置が合衆国憲法修正第1条に反する違法な報復に当たると認定したほか、Anthropic をサプライチェーンリスクに指定した決定も恣意的で、十分な根拠を欠いていると判断した。Anthropic は公式に判決を歓迎し、国家安全保障分野で米政府との協力を継続すると表明した。同社がワシントンD.C.で提起した別の関連訴訟は引き続き係争中となっている。
原文を読む →