- 2026/10/01 12:22 掲載
コヒアが埋め込みAI「Embed 5」、金融文書や図表入りPDFの検索精度で他社モデル上回る
Embed 5は、精度を重視した「Embed 5 Pro」と、応答速度とコストを重視した「Embed 5 Fast」の2種類で構成される。いずれも文脈長は128Kトークンで、100以上の言語に対応し、テキストに加えて画像や、画像とテキストを組み合わせた入力も扱える。料金はテキスト100万トークンあたりProが0.12ドル(約19円)、Fastが0.08ドル(約12円)。Cohere APIのほか、Microsoft Foundry、Amazon SageMakerで一般提供を始めた。
2つのモデルは同じベクトル空間を共有しているため、文書はProでインデックス化し、検索のクエリはFastで処理するといった組み合わせが、インデックスを作り直さずにできるという。同社はこの使い方を推奨しており、Fastの文書処理のスループットはProの平均2.4倍としている。
性能面では、表やグラフを含む文書の検索ベンチマーク「ViDoRe V3」で、Proが平均85.8を記録し、前世代のEmbed 4から8.8ポイント向上したと同社は説明する。比較対象としたVoyage 4 Largeは83.7、グーグルのGemini Embedding 2は83.2、オープンAIのtext-embedding-3-largeは75.5だった。金融文書でも、FinanceBenchやFinQAなど3つの公開ベンチマークで首位になったとしている。一方、日本語の評価ではProが87と、Gemini Embedding 2の90を下回った。
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR