ふくふくHukuhuku Inc.
EP.16RAG 13分公開: 2026-09-01

使われない RAG にしない ── 定着の設計

精度は出ているのに使われない。社内向けの仕組みで最も多い失敗です。技術ではなく定着の問題として、何が効くかを整理します。

#RAG#運用#組織#まとめ
執筆 / 監修
松尾 亮合同会社ふくふく 代表社員

データ基盤・データパイプライン構築 / BI / 生成 AI 活用支援を専門とするエンジニア (28 年)。 本記事は AI 利用ポリシーに基づき、生成 AI の補助で執筆 → 人間が監修・編集して公開しています。

プロフィール詳細
シェア

精度は出ているのに使われない。社内向けの で最も多い失敗がこれです。

この連載では技術的な話を扱ってきましたが、区切りとして定着の話をします。技術の問題ではないので、これまでとは違う観点になります。

1. なぜ使われないのか

理由は、精度以外にあることがほとんどです。

使われない理由
理由実態
存在を知らない最も多い。作ったが周知されていない
既存のやり方のほうが速い詳しい人に聞けば30秒で済む
信用していない一度誤った答えを見た
入口が遠い別のページを開く必要がある
何を聞けるか分からない質問の仕方が分からない
そもそも困っていない解決すべき課題が無かった

1行目が最も多く、最も対処が簡単です。作ったことを知らせる、使い方を示す。それだけで利用が立ち上がることがあります。技術的な改善に時間をかける前に、まず周知が足りているかを確認してください。

最下行が最も深刻です。解決すべき課題が無かったなら、精度をいくら上げても使われません。技術の問題ではなく、対象の選定の問題です。

3行目は取り返しにくい

一度誤った答えを見た人は、戻ってきません。初期の品質が、その後の定着を長く左右します。だから対象を絞って、確実に答えられる範囲から始めるほうが、結果として広がります。

2. どこから始めるか

全社に一斉に出さないでください。対象を絞ります。

  1. 1今の方法で明確に困っている業務を探す — 課題があるところから
  2. 2答えが文書に書かれている領域を選ぶ — 検索で答えられる範囲
  3. 3質問の型が限られている領域を選ぶ — 精度を出しやすい
  4. 4少人数で始める — 反応を見て直せる
  5. 5うまくいったら、その人たちに広めてもらう — 実感が伴う

2番目が重要です。答えが文書に書かれていない質問には、RAG は答えられません。「規程はどうなっているか」は答えられますが、「この案件はどう進めるべきか」は答えられません。対象の選定を誤ると、精度以前に成立しません

5番目が広げ方として最も有効です。実際に助かった人が話すほうが、作った側が説明するより伝わります。

3. 既存のやり方と比べる

定着するかは、既存のやり方と比べてどうかで決まります。ここを見誤ると、「良いものを作ったのに使われない」という状況になります。

既存のやり方との比較
既存のやり方RAG が勝てるか条件
詳しい人に聞く難しいその人が忙しい・不在のとき
文書を検索する勝てるどこにあるか分からない場合
過去の資料を探す勝てる散らばっている場合
推測で進める勝てる根拠が必要な場合
そもそも調べない勝てる調べる価値に気づけば

1行目が現実です。詳しい人に聞けば30秒なら、RAG を開く理由がありません。ただしその人が不在のとき、深夜のとき、聞きにくいときには価値があります。

「聞きにくい」は軽視できない要因です。新しく入った人、他部門の人、何度も同じことを聞くのが気まずい人。人に聞かなくて済むというのは、それ自体が価値になります。

4. 入口を近づける

別のページを開く必要があるというだけで、利用は大きく落ちます。すでに使っている場所に置くのが原則です。

入口の位置と利用
置き場所利用のされやすさ
専用のページ低い(開く動機が要る)
普段使う画面の中高い
チャットの中高い(既にそこにいる)
既存の検索窓と統合最も高い

最下行が理想です。「これまでの検索窓が賢くなった」という形なら、新しい習慣を作らずに済みます家庭の運用設計 EP.06 で扱った「すでに使っているものを優先する」と同じ発想です。

質問の例を置く

何を聞けるか分からないという理由への対処です。実際に答えられる質問の例を3〜5個置くだけで、使い始めの障壁が下がります。例を見れば、応用も効きます。

5. 何を測るか

定着しているかは、回数だけでは分かりません

定着を測る指標
指標何が分かるか
利用回数全体の量。ただし一部の人に偏りうる
繰り返し使う人の割合定着しているか
一度試して離れた人の割合期待と実態のずれ
出典が展開された割合信用されているか(EP.15)
答えられなかった質問対象範囲のずれ

3行目が最も示唆に富みます。一度試して離れた人が多いなら、初回の体験が悪いということです。精度なのか、速度なのか、期待とのずれなのか。離れた人に聞くのが最も確実です。

5行目も有用です。答えられなかった質問を集めると、利用者が本当に知りたいことが見えます。それが対象範囲の外なら、範囲を広げるか、期待を調整するという判断になります。この記録は LLM時代のテスト戦略 EP.08 で扱った評価セットの材料としても、そのまま使えます。

6. 連載を振り返って

ここまで16回、RAG の実装と運用を扱ってきました。区切りとして、通底していたものを整理します。

連載を通じた論点
論点扱った回
精度が出ない原因は分解できるEP.01-05
RAG が最適とは限らないEP.06
検証できる部分は決定的に検証するEP.11、EP.15
運用で静かに壊れるEP.14
技術が正しくても使われない本回

最下行が、この連載の締めとして言いたいことです。精度を上げる技術は、この数年で大きく進みました。しかし使われる仕組みになるかは、別の問題として残っています。

そして EP.06 で扱ったとおり、RAG が最適解とは限りません。全文検索で足りるかもしれないし、詳しい人に聞くほうが速いかもしれない。技術を使うことが目的にならないよう、対象の選定から考えてください。

精度が出ているのに使われない仕組みは、精度が出ていない仕組みと、実務上は同じ価値しかない。

ここまでのまとめ

使われない理由は精度以外にある(存在を知らない、既存のほうが速い、一度誤った答えを見た)。対象を絞って、確実に答えられる範囲から始める。答えが文書に書かれていない質問には答えられないので、対象の選定を誤ると成立しない。入口はすでに使っている場所に。測るのは回数ではなく、繰り返し使う人の割合。ここまでの内容への反応や、扱ってほしい論点があれば記事下のリアクションからお寄せください。続編は随時追加していきます。

シェア

この記事の感想を教えてください

あなたの 1 クリックで、本当にこの記事は更新されます。「もっと詳しく」「続編希望」が一定数集まった記事は、 ふくふくが 実際に内容を拡充したり続編記事を公開 します。 送信したリアクションはお使いのブラウザに記録され、再カウントされません。

シリーズの外も探す:

まずは、現状を聞かせてください。

要件が固まっていなくて大丈夫です。現状診断と方針提案までを無料でお手伝いします。

無料相談フォームへ hello [at] hukuhuku [dot] co [dot] jp