EVIEとは

EVIEとは、Tencentが2026年8月に公開した、質問と関連の強い文書ページを画像のまま探すAIモデルです。表やグラフ、段組みなどの見た目も手がかりに、検索結果の順位を付けます。回答文を作るチャットAIではなく、読むべきページを絞る検索部品と捉えると分かりやすいでしょう。

EVIEが質問文と文書ページを細かい特徴ベクトルに変換し、部分ごとに照合して関連ページを上位に並べる流れを示した図。

英語表記:EVIE-Preview-4.5B

2026年8月23日時点の公式名には「Preview」(試作版)が含まれます。モデル本体はApache-2.0という商用利用も認める条件で公開されていますが、公開先のHugging Faceの表示は「どの事業者にも配備されていない」。申し込めばすぐ使えるクラウド型のサービスは無く、動かすなら自社でGPUを用意します。完成した業務サービスというより、技術チームが自社の検索基盤に組み込んで試す公開モデルです。

EVIEはどのように文書を探す?

土台にしているのは、中国のアリババが公開しているQwenシリーズの「Qwen3.5-4B」で、公式記載では約45.4億パラメータです。EVIEは質問文と文書ページを、それぞれ複数のベクトルに変換します。ベクトルとは、AIが意味や画像の特徴を比べるための数字の列です。

1ページを1本の要約値に押し込めず、語句や画像の部分ごとの手がかりを残すのが特徴です。質問の各部分に最も近いページ側の部分を照合し、関連度にまとめます。会議資料の全体に付箋を1枚だけ貼るのではなく、表、図、見出しごとに小さな付箋を付け、質問と照らす感覚に近い仕組みです。

公式モデルカードは、グラフ、表、科学レポート、決算などの開示資料、スキャンした帳票などを対象に挙げています。文字列が一致するかだけでなく、「売上の変化を示す図」のような問いで候補ページを絞る用途が想定されます。

OCRやRAGとどこが違う?

OCRの主な役割は、画像に写った文字をテキスト化することです。EVIEはページ全体を画像として検索するため、表の位置や図の構成も手がかりにできます。一方、正確な数値の取り出しや文字列処理まで代替するものではありません。

RAGは、社内情報などから根拠を探し、その内容を生成AIへ渡して回答を作る全体構成です。EVIEが担うのは、その手前にある検索候補の絞り込み。EVIEの検索スコアが高くても、後段の生成AIが正しい回答を作るとは限りません。根拠表示、回答の検証、アクセス権の維持は別に設計します。

企業での試し方と導入判断

候補になるのは、売上資料のグラフ、開示資料の表、製品マニュアルの図、スキャンした帳票など、文字列検索だけでは見つけにくい文書群です。まず、正解ページが分かっている少量の自社文書と実際の質問を用意し、通常のOCR後の文字列検索などと比べるのが現実的です。

確認するのは平均点だけではありません。必要なページが上位へ入る率、検索時間、索引(検索用の目録)の容量、GPUの運用コスト、文書の更新方法を見ます。ViDoReは、図表を含む文書の検索精度を測る公開テスト。Tencentのモデルカードは、その最新版ViDoRe V3で1位と公表していますが、2位との差は0.04ポイントの僅差です。比較の出発点にはなっても、自社特有の表記、画像品質、日本語の問いで同じ精度が出る保証ではありません。

機密文書に使う場合は、元のPDFや画像だけでなく、検索用に作ったベクトルとキャッシュも保護対象です。「モデルを動かせるか」だけでなく、権限のない利用者の検索結果にページが混ざらないことを要件に含めます。

EVIEを選ぶ前に確認したいこと

  • 提供段階:Preview版の変更に追従する方針。
  • 入力対象:文書全体を画像で探す明確な必要性。
  • 評価データ:日本語と自社帳票を含む正解付きの質問。公式が挙げる質問文の言語に日本語は入っていません。
  • 運用基盤モデル、索引、GPU、アクセス制御を維持する担当と予算。
  • 後段の検証生成AIが作る回答と出典の独立した検査。

Topic128次元でも、100万ページなら約179.2GiB

EVIEの公式試算では、1ページを768個の視覚トークンで表す設定のとき、100万ページ分の検索用データは約179.2GiBです。1本のベクトルが細くても、1ページから何本作るかで容量は膨らみます。しかも公式表で1位の点数が出ているのは、その2倍以上の1,792個で表す設定のほうで、こちらは約420.5GiBに増えます。「コンパクト」はサーバー容量が小さいという意味ではなく、比較対象より1本あたりの幅が狭いと読むのが安全です。

EVIEに関するよくある質問

EVIEは日本語の文書も検索できますか?
公式モデルカードは、日本語のページを検索対象に含むと明記しています。一方で、質問文の言語として挙げているのは英語・フランス語・ドイツ語・イタリア語・スペイン語・ポルトガル語・中国語の7つで、日本語は入っていません。公開テストViDoRe V3の質問言語6つにも日本語はありません。日本語の帳票と日本語の質問で、自社に必要な取得率を必ず測ってください。
EVIEを使えば文書を外部APIへ送らずに済みますか?
公開モデルなので、自社が管理する環境で動かす構成は可能です。実際に外部送信が発生しないかは、モデルの取得先、ログ、監視ツール、ストレージを含むシステム全体で確認します。
文書検索がEVIEで高得点なら、生成AIの回答も正確ですか?
同じではありません。検索は適切なページを上位に出す評価で、回答の解釈や引用の正確さは別の評価対象です。検索精度と回答精度を分けて測ります。

EVIEに関連する記事