Epoch 0
ZH · EN
デイリー AI ニュース
2026-08-26
出典:橘鸦 AI 早报 · 27 件
AlibabaのQwen、Qwen3.8-Flash-Nextを本日オープンソース化すると予告
要闻
AlibabaのQwenチームは、Qwen3.8-Flash-Nextを北京時間8月26日23:00にオープンソース化する予定だと予告した。このマルチモーダルMoEモデルは次世代Qwen4アーキテクチャを基盤としており、現時点でモデルの重みは公開されていない。
AlibabaのQwenチームは、北京時間8月26日23:00にQwen3.8-Flash-Nextをオープンソース化する予定で、ModelScopeコミュニティとHugging Faceに予告を掲載した。現在も公開までのカウントダウン中で、モデルの重みはまだ提供されていない。同チームの説明によると、Qwen3.8-Flash-Nextは次世代Qwen4アーキテクチャを基盤に構築したマルチモーダルMoEモデルである。公式は、これらのアーキテクチャ改善を先行公開する目的について、今後登場する完全なQwen4モデルファミリーに向けた準備をコミュニティが進められるようにするためだとしている。その他の詳細はまだ公表されていない。
原文を読む →
OpenAI、Jalapeño推論チップの実測データを公開
要闻
OpenAIは、初の自社開発カスタム推論チップJalapeñoの初回実測結果を公表した。3モデルを対象としたInferenceXテストで、ピーク時のワット当たり性能は比較対象システムの1.5~1.9倍、エンドツーエンド遅延は1.7~3.6倍低減した。
OpenAIはJalapeñoの初回実測性能データを公表し、同社初の自社開発カスタム推論チップである同製品を今年末までに自社のコンピューティングインフラへ導入する計画を示した。テストにはInferenceXベンチマークを使用し、GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1Tを対象とした。公式によると、Jalapeñoは単一アーキテクチャで、より高いスループット、より低いレイテンシ、ワット当たりでより多くのAI計算能力を提供し、ピーク時のワット当たり性能は比較対象システムの1.5~1.9倍、エンドツーエンド遅延は1.7~3.6倍低減した。説明によると、第2世代チップは本格的な開発段階に入り、第3世代チップも初期形状が固まっている。OpenAIはNVIDIAおよびその他のパートナーのアクセラレーターも引き続き導入する。
原文を読む →
Codex、有料ユーザーの利用量をリセットし、PlusとBusinessの5時間制限を復活
要闻
OpenAIはCodexの有料利用枠を調整し、Plus、Team、Proユーザーの利用枠をリセットするとともに、Plusの5時間の利用上限を復活させた。コミュニティによるとTeamも同じ制限の対象で、デスクトップ版では設定済みのサードパーティモデルのネイティブ表示も始まった。
OpenAIはCodexのPlus、Team、Proユーザーの利用枠をリセットし、Plusプランの5時間の利用上限を復活させたほか、Codexデスクトップ版では設定済みのサードパーティモデルのネイティブ表示が始まった。公式は、この上限の復活について、計算リソースの負荷を平準化し、ユーザーが週間利用枠を早期に使い切るのを避けるためだと説明している。コミュニティからはその後、Teamプランも同じ制限の対象になったとの報告があった。ユーザーによる実測では、デスクトップ版のセッションはproviderごとに分離されなくなった一方、CLIのセッションは引き続きproviderごとに分離されている。
原文を読む →
OpenAI、1席100ドルのChatGPT Business Premiumシートを正式提供
开发生态
OpenAI は ChatGPT で Business Premium シートの提供を開始し、1シート当たりの価格を100ドルに設定した。5時間の利用制限を撤廃し、標準シートの5倍の利用枠を提供する。
OpenAI は、ChatGPT Business Premium シートがChatGPTで利用可能になったと発表し、1シート当たりの価格を100ドルとした。Greg Brockman氏は、多くのユーザーからの要望を受けて提供を開始したと説明した。同社の説明によると、Premium シートには5時間の利用制限がなく、標準シートの5倍の利用枠が設定される。Tibo氏は、このプランは価格が100ドルの Pro プランに近いが、チームと小規模企業向けに設計されていると述べた。
原文を読む →
ChatGPT Work、ユーザーに代わってWebサイトにログインする機能を追加
开发生态
ChatGPT Work は、Plus、Pro、Business ユーザー向けに、Web版とモバイル版でWebサイトへの代理ログイン機能を順次提供しています。公式によると、ログイン時にChatGPTがユーザー名やパスワードを見ることはありません。
ChatGPTの公式アカウントは、発表日当日から、ChatGPT WorkのWebサイトへの代理ログイン機能をWeb版とモバイル版でPlus、Pro、Businessユーザー向けに順次提供すると発表しました。この機能はcomputerとbrowserを使ってWebサイトを開き、ログインします。公式の説明では、ログイン手順はChatGPT Workが代行し、その全過程でChatGPTがユーザーのユーザー名やパスワードを見ることはありません。公式はまた、通常はユーザー自身がブラウザを開き、項目ごとにクリックして完了させるタスクも、ChatGPT Workに処理させることを試せるとしています。
原文を読む →
ChatGPTブラウザ拡張機能、Edge、Brave、Opera、Vivaldiに対応
开发生态
OpenAI の ChatGPT ブラウザ拡張機能が Edge、Brave、Opera、Vivaldi に対応し、タブのコンテキストをデスクトップ版と Codex に渡してブラウザ上のタスクを実行できるようになった。Opera では side chat はまだ利用できない。
OpenAI の ChatGPT ブラウザ拡張機能は、Microsoft Edge、Brave、Opera、Vivaldi に新たに対応し、現在のタブのコンテキストを ChatGPT デスクトップ版のタスクに取り込めるようになった。Codex はユーザーが閲覧している内容に基づいて動作でき、拡張機能は購読解除や CRM へのデータ入力などの Web 操作もブラウザ上で実行できる。ユーザーは任意のタブから side chat を通じて ChatGPT の全機能を利用できるが、この機能は現時点で Opera には提供されておらず、公式は近日中に提供すると説明している。
原文を読む →
ChatGPTのスケジュールタスクが更新、Githubなどのアプリの変更をトリガーに実行可能に
开发生态
ChatGPT 公式は、Web 版とモバイル版の ChatGPT Work におけるスケジュールタスクを拡張した。Plus と Pro ユーザーは Slack、Gmail、Github の変化を契機に応答を実行でき、無料ユーザーにも最大 3 件のタスク枠が順次提供される。
ChatGPT 公式は、Web 版とモバイル版の ChatGPT Work でスケジュールタスクを更新したと発表した。Plus と Pro ユーザーは、Slack、Gmail、Github で発生した変化をトリガーに設定し、固定スケジュールだけに依存せずタスクを自動で応答させられる。スケジュールタスク機能は ChatGPT の無料ユーザーにも順次提供されており、無料ユーザーが作成できるタスクは最大 3 件となる。ユーザーは普段利用しているタスクを共有でき、受け取った側は自分の用途に合わせてカスタマイズして利用できる。
原文を読む →
OpenAI、WebMCP対応とハッカソンを発表
开发生态
OpenAI は ChatGPT デスクトップブラウザと ChatGPT Sites への WebMCP 対応を進め、対応サイトのツールを呼び出せるようにする。同時に、6 つのパートナーと期間 10 日間の WebMCP Challenge を開始する。
OpenAI Developers は、ChatGPT デスクトップアプリの内蔵ブラウザと ChatGPT Sites が WebMCP への対応を進めていると発表した。OpenAI は同時に、Google Chrome、Cloudflare、Shopify、Vercel、Render、Netlify と期間 10 日間のハッカソン「WebMCP Challenge」を開催する。WebMCP は実験的なオープン標準で、Web サイトが構造化されたツールを Agent に直接提供できる。ユーザーが対応サイトにアクセスすると、ChatGPT または Codex が、そのサイトから公開されたツールを自動的に使用してタスクを実行できる。
原文を読む →
Cursor、課金方式とプラン上限を改定
开发生态
Cursor は Auto の一律料金を廃止し、実際にルーティングされたモデルに応じた課金へ変更する。大半のリクエストは従来より高くなる一方、自社モデルのプラン枠を引き上げ、Grok モデルの付帯枠も以前の倍増に続いて恒久的に再拡大する。
Cursor は Auto の一律料金を廃止し、自社モデルのプラン枠と Grok モデルの利用可能枠を引き上げた。Grok の変更は、再度の恒久的な引き上げとなる。新しい Auto の料金は、各リクエストが実際にルーティングされたモデルに基づいて算出される。公式によると、大半のリクエストは従来の一律料金より高くなる。自社モデルのプラン枠の変更には Auto も含まれる。Grok については、Grok 4.6 の利用需要が増加したため、以前に倍増した Grok モデルの付帯枠をさらに増やし、今回の追加分を恒久的な変更としたという。
原文を読む →
Command Code、支付宝での支払いに対応
开发生态
Command Code は、製品の決済手段に Alipay(支付宝)を追加し、同サービスで利用可能になったと公式に発表した。同時に、複数のコミュニティユーザーが中国語インターフェースと中国語ドキュメントの追加を求めた。
Command Code は、製品が Alipay(支付宝)による支払いに新たに対応し、この決済手段を新しい選択肢として追加したと公式に発表した。今回の発表の中心は決済オプションの更新で、Alipay 対応が明示された製品変更となる。同時に、複数のコミュニティユーザーが中国語ローカライズに関する要望を出しており、具体的には中国語インターフェースと中国語ドキュメントの追加を求めている。決済対応は Command Code の公式発表であり、中国語インターフェースと中国語ドキュメントはコミュニティユーザーからの要望で、両者はこの情報内で異なる段階にある。
原文を読む →
商汤のSenseNova U1.5 Lite画像生成モデル、Token Planに対応
开发生态
SenseTimeは、画像生成モデル SenseNova U1.5 Liteを日日新 SenseNova Token Planに追加したと発表した。パブリックベータ期間中は5時間ごとに1,500件の無料リクエストを提供し、透かしなしの高解像度原画像も無料で生成できる。
SenseTimeはパブリックベータ期間中、新世代の画像生成モデル SenseNova U1.5 Liteを日日新 SenseNova Token Planに正式導入し、同モデルの無料利用枠を開放した。無料枠は5時間ごとに1,500件のリクエストとして計算され、画像生成リクエストで watermark パラメータを false に設定すると、透かしなしの高解像度原画像を無料で取得できる。公式によると、透かしなしの高解像度原画像を生成する機能は今後有料化されるが、原文ではパブリックベータの終了時期、有料化の具体的な日付、価格は示されていない。
原文を読む →
Grok 4.6、OpenCode Goで提供開始
开发生态
OpenCode は公式アカウントを通じ、Grok 4.6 が OpenCode Go で提供開始され、サブスクリプションユーザーに開放されたと発表した。現在利用可能で、利用枠は 5 時間ごとに 169 リクエストとなる。
OpenCode は公式アカウントを通じ、Grok 4.6 が OpenCode Go で提供開始され、OpenCode Go のサブスクリプションユーザーに開放されたと発表した。同モデルは現在利用可能で、対象は OpenCode Go のサブスクリプションユーザーに限定される。利用枠は 5 時間単位で計算され、各 5 時間の区間に 169 リクエストを送信できる。今回公式が公表した情報は、モデル名、提供プラットフォーム、利用可能な状態、対象ユーザー、リクエスト枠であり、それぞれ Grok 4.6、OpenCode Go、現在利用可能、サブスクリプションユーザー、5 時間ごとに 169 リクエストとなる。
原文を読む →
OpenCode、悪用を受け5ドルのスターター割引を終了したと公式発表
开发生态
OpenCode は初月 5 ドルの入門割引を終了し、現在の最低価格を月額 10 ドルに変更した。公式スタッフの dax は、このプランが大量の不正利用を招いたと説明し、今後は不正利用されにくい新たな方式を探すとしている。
OpenCode は初月 5 ドルの入門割引を削除し、現在の最低価格を月額 10 ドルに変更した。この価格変更はコミュニティユーザーが最初に発見し、その後、OpenCode の公式スタッフである dax が初月割引を料金プランから削除したことを認めた。dax の説明によると、割引を終了した理由は、このプランが大量の不正利用を招いたためだという。公式は、入門割引を設けるという考え自体は引き続き支持しているが、今後は不正利用されにくい新たな方式を探す必要があるとしている。現在公表されている最低価格は月額 10 ドルで、初月 5 ドルの割引は料金設定に含まれていない。
原文を読む →
Anthropic、ClaudeのチャットとCoworkのメモリを統合
产品应用
Anthropic は Claude chat と Cowork の Memory を統合し、双方でユーザーのコンテキストを共有、反映できるようにした。Free、Pro、Max の web、desktop、mobile ではデフォルトで有効だが、センシティブな topic の保存はデフォルトで無効となる。
Anthropic は、Claude chat と Cowork が使用する Memory を単一の仕組みに統合し、Cowork が cloud でタスクを実行する際に chat で蓄積されたコンテキストを参照し、タスクから得た情報を chat に戻せるようにした。公式によると、Claude は会話終了後に要約を作成するのではなく、会話中に topic 単位で Memory へ情報を書き込むため、プロジェクトの期限、作業上の好み、指標の定義などを以後の会話や Cowork のタスクで利用できる。ユーザーは Memory をいつでも一時停止またはリセットでき、Settings > Memory の Topics で短いファイルを個別に確認、編集、削除できる。1 か所を修正すると、それ以後のすべての会話で修正後の内容が使用される。
同社の説明では、健康、人種、民族、宗教的信条、政治的立場、性自認など、個人的またはセンシティブな topic はデフォルトで保存されない。ユーザーが「include sensitive topics in memory」を有効にすると、Claude が該当情報を保存するたびに通知が表示され、有効化後に現れた内容だけが記録される。有効化前の情報が遡って保存されることはなく、この設定はいつでも無効にできる。有効化した場合でも、Claude は SSN、government ID numbers などの機密性の高い識別番号、criminal history、immigration status、AUP に違反する内容を保存せず、更新できない場合はユーザーに通知する。Memory は Free、Pro、Max の web、desktop、mobile でデフォルトで有効となる。iOS と Android では最新版の app への更新が必要になる。Team と Enterprise では admin が組織での利用可否を管理し、各ユーザーは個別に有効化する必要がある。
原文を読む →
豆包工作が正式リリース、PC版のダウンロードで30日間のサブスクリプション特典
产品应用
Doubaoは、生産性向けのAgent製品「Doubao Work」を正式に公開した。PC版のダウンロードまたはDoubao PC版の最新版への更新で30日間のサブスクリプション特典を受け取れ、既存ユーザーの有効期間も30日間延長される。
Doubaoは生産性Agent「Doubao Work」を正式に公開し、公開日以降、Doubao WorkのPC版をダウンロードするか、Doubao PC版を最新版に更新したユーザーに30日間のサブスクリプション特典を提供する。既存のDoubaoサブスクリプションユーザーは、特典の受け取り後に有効期間がさらに30日間延長される。公式によると、同製品はユーザーの目標に基づいてタスクを分解し、ツールを呼び出し、複雑なワークフローを継続的に実行でき、文書、表計算、PPTなどの業務に対応する。PCとブラウザの操作も可能で、実行過程はユーザーに表示され、いつでも操作を引き継げる。飛書とも深く統合されており、同社の説明では、Agentが企業内のコンテキストを利用することで、タスクをより正確に完了できる。
原文を読む →
千问APPとPC版の「工作助理」、阿里云Token Planの利用枠との連携に対応
产品应用
千問のAPP版とPC版がAlibaba Cloud Token Planに対応した。ユーザーがAPI Keyを連携すると、「Work Assistant」でPCやブラウザの操作、skillを呼び出してoffice文書を納品する作業などをサブスクリプション枠で処理でき、消費したTokenは同枠から直接差し引かれる。
千問はAPP版とPC版にAlibaba Cloud Token Planとの連携機能を実装し、ユーザーはAPI Keyを連携することでToken Planのサブスクリプション枠を利用できるようになった。この機能はすでに利用可能となっている。連携後、千問の「Work Assistant」が複雑なタスクを処理する際に発生したToken消費量は、ユーザーのToken Planサブスクリプション枠に直接計上され、同枠から差し引かれる。原文に記載されたタスクには、PCとブラウザの操作、skillを呼び出してoffice文書を納品する作業が含まれ、いずれも連携したユーザーの枠を利用できる。
原文を読む →
ChatGPT、Stickers生成機能をリリース
产品应用
ChatGPT は Stickers 機能を公開し、ユーザーは ChatGPT Images で写真やアイデアを透明背景付きのカスタムスタンプに変換して、iMessage または WhatsApp で共有できるようになりました。
ChatGPT は Stickers の提供開始を発表し、ユーザーはサイドバーで「Images」を選択してから「Stickers」をクリックすると、作成画面に進めます。この機能は ChatGPT Images を通じて、ユーザーがアップロードした写真や入力したアイデアをカスタムスタンプに変換し、生成結果の背景を透明にすることにも対応します。完成したスタンプは iMessage または WhatsApp で共有できます。公式の説明によると、背景を透明にする機能は Stickers に限らず、ほかの画像にも利用できます。
原文を読む →
Google Labs、リアルタイム共同作業型vibe codingツール「Play with Putty」を発表
产品应用
Google Labs は、共同作業型 vibe coding 実験ツール Play with Putty を発表し、ウェイティングリストの受け付けを開始しました。公式によると、複数人でツールや Web サイトをリアルタイムに共同構築でき、現時点では米国在住の 18 歳以上のみが申し込めます。
Google Labs は実験プロジェクト Play with Putty を発表し、同時にウェイティングリストを開設しました。条件を満たすユーザーは参加登録が可能です。Play with Putty は共同作業型 vibe coding ツールと位置付けられており、公式によると、複数人でツールや Web サイトをリアルタイムに共同構築できます。この実験の対象は、米国在住の 18 歳以上のユーザーに限定されています。Google Labs は、ウェイティングリストに登録したユーザーに対し、プロジェクトチームへのフィードバック提供も呼びかけています。
原文を読む →
Perplexity、ローカルAgentアプリ「Portable Computer」を発表
产品应用
Perplexity はローカル AI Agent「Portable Computer」を投入し、最初に NVIDIA DGX Spark に対応した。同デバイスを所有する Pro と Max ユーザーに提供され、許可を得た上でクラウドモデルを呼び出せる一方、機密文書はローカルに保持する。
Perplexity は 2026 年 8 月 26 日、NVIDIA DGX Spark 向けのローカル AI Agent「Portable Computer」を公開し、同デバイスを所有する Pro と Max ユーザーへの提供を開始した。アプリには PPLX 27B が組み込まれ、Qwen 3.8 27B にも対応する。タスクにより強い推論能力が必要な場合は、ユーザーの許可を得てクラウド上の frontier model を呼び出せる一方、機密文書はデバイス上に保存される。Perplexity はナレッジワーク、Web リサーチ、文書解析に関する一連のテスト結果も公表し、プライバシー、コスト、ローカル実行効率における製品の優位性を示すものだと公式に説明した。同社によると、今後は対応範囲をさらに多くの NVIDIA ハードウェアとモデルへ拡大する。
原文を読む →
Apodex、Apodex 1.1モデルファミリーを発表、35Bのmini版をオープンソース化
模型发布
Apodex は Apodex 1.1 モデルファミリーを公開し、フルモデルをオンラインワークベンチに導入した。35B の mini 版は重みを公開してローカル展開に対応し、オープンソースの FrontierAgent は ReAct と Agent Team の 2 モードを提供する。
Apodex は Apodex 1.1 モデルファミリーを公開し、フルモデルを公式オンラインワークベンチに導入したほか、35B の Apodex 1.1 mini の重みを公開してローカル展開に対応した。公式によると、フルモデルは専門業務、科学研究、金融分析、深層検索などの複雑なタスクで最先端の Agentic 性能を提供する。併せてオープンソース化された FrontierAgent はローカル展開可能な研究用ワークベンチで、ReAct と Agent Team の 2 モードを備え、Docker を事前にインストールせずに macOS と Linux で 1 つのコマンドから実行できる。ベースモデルの API は主要な API プラットフォームを通じて順次提供される予定で、同社の説明では、モデルの重み、技術レポート、開発者向けドキュメントの準備も進められている。
原文を読む →
IBM、企業向けAgentic AI「Granite 4.2」をオープンソースで公開
模型发布
IBMはオープンモデルファミリーGranite 4.2を公開した。3B、8B、30Bの3つのパラメータ規模を用意し、企業向けAgentic AIワークフローを対象に、512Kのコンテキストウィンドウと3つの推論モードを備える。
IBMは、企業向けAgentic AIワークフローを対象とするオープンモデルファミリーGranite 4.2を公開し、3B、8B、30Bの3つのパラメータ規模を用意した。公式モデルカードによると、同シリーズは完全思考、思考なし、低労力の3モードに対応し、コンテキストウィンドウは512Kとなる。言語モデルにはApache 2.0ライセンスが適用され、同社の説明ではクラウド、オンプレミス、エッジ環境にデプロイでき、Hugging FaceやOllamaなどのプラットフォームですでに提供されている。IBMは同時に、パラメータ数470MのGranite Speech 5.0 Turbo CTCと、その音声モデルの非商用版も公開した。
原文を読む →
腾讯、マルチモーダル埋め込みモデルWeMM-Embeddingをオープンソース化
模型发布
TencentはWeChat Visionチームが開発したWeMM-Embeddingをオープンソースで公開した。テキスト、画像、動画、ビジュアル文書、インターリーブされたマルチモーダル入力を統一的にエンコードでき、2Bモデルは256次元でMMEB-v2のフル次元における画像・動画性能の98.7%を維持する。
Tencentは、WeChat Visionチームが開発した汎用マルチモーダルembeddingモデル群WeMM-Embeddingをオープンソース化した。モデルはテキスト、画像、動画、ビジュアル文書、インターリーブされたマルチモーダル入力に対応するが、現時点で音声には対応しない。embeddingは最終層のhidden stateにある専用の<embedding> token位置から取得し、その後L2 normalizationを行う。プロジェクトは推論と再現にtransformers==5.2.0を推奨しており、それより新しいバージョンでは前処理の挙動が異なる可能性があると説明している。SentenceTransformerはローカルパスまたはHugging Face model idから直接読み込め、SentenceTransformer.encode()でテキスト、画像、動画を処理する。MRLの次元は--dimensionで選択し、省略するとフル次元を出力する。
対応する次元dを使用する場合、プロジェクトはフルembeddingを切り詰めた後、再度正規化する方式を指定している。公式によると、2BモデルはMMEB-v2で256次元を使用した場合、フル次元版の画像・動画性能の98.7%を維持する。技術レポートのTable 1は78データセットを集計し、画像・動画タスクにはHit@1、ビジュアル文書タスクにはNDCG@5を使用する。Table 2は190タスクを対象とし、V3-Allには78件のMMEB-v2タスク、53件のテキストタスク、47件のagentタスク、11件の音声タスク、MCMRが含まれ、非対応タスクは0点として扱われる。リポジトリにはTIGER-AI-Lab/VLM2Vec pipelineを小幅に変更したMMEB-v3評価コードがあり、テスト済みバージョンはvLLM 0.27.0とSGLang 0.5.9である。Tencentのコードは別途記載がない限りApache License 2.0で提供され、第三者コンポーネントには元のライセンスが適用される。
原文を読む →
MiniMax、H3エコシステム統合インデックスリポジトリを公開
模型发布
MiniMax は H3 の GitHub 統合インデックスリポジトリを公開し、関連プロジェクトの追跡を開始した。INT8、NVFP4、GGUF と 8GB の VRAM 制限に対応する量子化ガイドのほか、推論高速化、Agent スキル、Apple Silicon 対応を収録する。
MiniMax は、H3 を中心に構築されたプロジェクトを集約・追跡する GitHub インデックスリポジトリ「Awesome MiniMax H3 Integrations」を公開した。リポジトリ内の量子化ガイドは INT8、NVFP4、GGUF を扱い、8GB の VRAM 制限に対応する内容も含む。推論高速化の項目には LoRA の高速化や Sol-Attn などのツールが収録され、開発者向けツールにはネイティブ Agent スキルと Apple Silicon をサポートする h3.c が含まれる。公式は、H3 エコシステムが急速に発展していると説明している。
原文を読む →
Apple、新型Mac miniとMac Studioを発表
行业动态
AppleはMac StudioにM5 MaxまたはM5 Ultraを搭載し、最大512GBのunified memoryとM3 Ultraの4.3倍のピークAI演算性能を提供する。2026年9月22日に発売する。
Appleは、M5 Maxと新しいM5 Ultraを搭載した新型Mac Studioを2026年9月22日に発売すると発表した。M5 Maxモデルは18コアCPUと最大40コアGPUを備え、GPUの各コアにNeural Acceleratorsを内蔵し、最大128GBのunified memoryに対応する。M5 Ultraモデルは36コアCPU、最大80コアGPU、最大512GBのunified memoryまで拡張される。公式によると、M5 UltraのピークAI演算性能はM3 Ultraの最大4.3倍、M1 Ultraの最大9.8倍で、メモリ帯域幅は1.2TB/sと前世代比で50%高い。
新型Mac Studioは、Wi-Fi 7とBluetooth 6に初めて対応し、Thunderbolt 5も搭載する。複数のMac StudioはThunderbolt 5とRDMAを利用してクラスタを構成できる。公式の説明では、4台のMac Studioで構成するクラスタのAI inference性能は、単体の最大3倍となる。ソフトウェア面では、新しいCore AI frameworkがApple silicon上でのAIモデルの構築、実行、デプロイを担い、unified memory、CPU、GPU、Neural Engineを利用できるほか、フルスケールのLLMのローカル展開やカスタムモデルのappへの組み込みに対応する。AppleのオープンソースMLX frameworkは、Mac上でモデルを実行、学習、fine-tuneするために使用される。
原文を読む →
Anthropic、500万ドルの助成プログラムを開始
行业动态
原文を読む →
Stability AI、シリーズBで7600万ドルを調達
行业动态
原文を読む →
Claude CodeのCLAUDE.mdへの固執が物議
其他
原文を読む →