- 会員限定
- 2026/10/09 11:29 掲載
マイクロソフト、コーディングAI「MAI-Code-1.1-Flash」発表 端末で動くローカル版も
2026年6月に開いた年次開発者会議Microsoft Buildで発表したモデルと比べ、コードの品質が高く、トークン効率は25%良く、コストは4分の1になったという。すでにGitHub Copilotで本番稼働している。
GitHub Copilot CLIではTerminal-Bench 2.1のスコアが22%、.NETのタスクが15%向上した。コードの残存率は4%上昇し、再訪率は9%増えた。トークンの生成は25%速く、タスクの完了に使うトークンも25%少ないとしている。
あわせて、端末上で動かせるローカル版も明らかにした。Microsoftの公式ブログによると、総パラメーター数が1,370億、有効パラメーター数が68億のMoE(Mixture of Experts)モデルで、約3.3ビットの量子化と投機的デコーディングを使う。サイズは53GBで、BF16のクラウド版から約80%小さい。256Kのコンテキストは維持しており、ダウンロードして実行できる。推奨は120GB超のRAMで、ローカルモデルの呼び出しに推論課金は発生しないという。
最大128GBの統合メモリを備えるSurface Laptop Ultra(エヌビディアのRTX Spark搭載)では、256Kコンテキスト時のピークメモリ使用量が75.5GBだった。
GitHub Copilotは月末までに、タスクごとにローカルとクラウドのどちらで処理するかを自動で振り分ける「Auto」と、ローカルモデルを明示的に選ぶ方法の両方を提供する。実験的アクセスは、GitHub Copilotのアプリ、CLI、Visual Studio Codeで始まる。
エージェントが実行するコマンドは、WindowsチームのオープンソースライブラリであるMicrosoft Execution Containers(MXC)でサンドボックス化できる。ただし、ローカルで推論しても、セッションが完全にオフラインになるわけではないとしている。
では、「約80%減」のローカル版は、クラウド版の性能をどこまで保てているのか。背景には、オープンな競合モデルと並べた比較表と、マイクロソフト自身が注記で示した測定条件がある。
・ローカル版がクラウド版を上回った測定結果と、その裏にある問題数
・75.5GBのピークメモリが示す、実機で動かすための条件
・ローカルでも安全にはならない、サンドボックスの境界
今すぐビジネス+IT会員に
ご登録ください。
すべて無料!今日から使える、
仕事に役立つ情報満載!
-
ここでしか見られない
2万本超のオリジナル記事・動画・資料が見放題!
-
完全無料
登録料・月額料なし、完全無料で使い放題!
-
トレンドを聞いて学ぶ
年間1000本超の厳選セミナーに参加し放題!
-
興味関心のみ厳選
トピック(タグ)をフォローして自動収集!
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR