- 会員限定
- 2026/10/10 09:30 掲載
米マイクロソフト、判断特化の小型AI「Decision-1」公開 入力100万トークン0.042ドル
判断モデルは、文章や回答を生成する大規模言語モデル(LLM)とは違い、ソフトウェアがそのまま実行できる構造化された出力を返すことに特化したAIの一種。ビジネス+ITでも、TypeSafe AIが判断特化AIで調達した8億7,000万ドルや、クラウドフレアの決定モデル公開を伝えている。
Decision-1は、公開モデルの「Qwen3.5-9B」(90億パラメータ)に追加学習(ポストトレーニング)を施して作った。あらかじめ決めた選択肢を与えると、それぞれに較正した確率を返す。はい/いいえ、多肢選択、段階評価に対応し、AIの回答やエージェントの行動を基準に沿って採点する用途にも使える。
価格は入力100万トークンあたり0.042ドル(約6.6円)で、出力は無料。同社は今後、マイクロソフト自身のAI「MAI」やOpenAIなどのモデルを土台にし直す方針も示した。
性能について同社は、学習に使っていない約15万問からなる36のベンチマークで最高の精度を記録したと説明している。処理の速さ(P50レイテンシー)は、次点の「Quyet-1.0-Large」の約4.5倍、「GPT-6 Sol」の約35倍だという。入力の言い換えや選択肢の並べ替えでは判断が一度も変わらず、8種類の摂動を加えたときに判断が変わる割合は平均1.3%だった。安全性は11のベンチマーク、5,250件の依頼で検証したとしている。数値はいずれも同社の評価で、第三者による検証結果ではない。
社内での試験も紹介した。XBOX Researchは、1万件を超えるゲームへの意見やレビューを決まったテーマに分類させたところ、品質はGPT-6 Solと同等水準で、速度は14倍超、費用は200分の1だったという。Copilotチームは、応答の品質測定でGPT5.6 Lunaと競える水準を保ちつつ、速度は100倍になったとしている。Microsoft Discoveryでは、実験計画を見直す処理で、LLMによる採点より46倍安定し、速度は約3倍になった。
では、マイクロソフトが掲げる「最速・最高精度」は、競合の公開情報と並べるとどこまで通用するのか。背景には、OpenAIが公開ベータで出している同種APIの価格と、公式ブログが示さなかった数値がある。
・OpenAIの同種APIと並べた、価格差と速度の読み方
・JevBench首位争いに4Bモデルまで入る、競合の顔ぶれ
・確信度の較正、実測値が公式ブログに見当たらない
今すぐビジネス+IT会員に
ご登録ください。
すべて無料!今日から使える、
仕事に役立つ情報満載!
-
ここでしか見られない
2万本超のオリジナル記事・動画・資料が見放題!
-
完全無料
登録料・月額料なし、完全無料で使い放題!
-
トレンドを聞いて学ぶ
年間1000本超の厳選セミナーに参加し放題!
-
興味関心のみ厳選
トピック(タグ)をフォローして自動収集!
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR