B バイナンス · 世界最大級の暗号資産取引所バイナンス 登録 → AD OKX OKX · 世界の大手暗号資産取引所OKX 登録 → AD
🤖 AIの基礎 · 第7講 / 10

ハルシネーションと検証 — もっともらしさを疑う方法

AIの答えはもっともらしさに従うため、もっともらしいけれど間違った内容が混ざることがあります。どんな答えが危ないかを知り、確かめる習慣をつければ、AIを安全に使えます。

⏱ 約17分 ✍️ 確認問題 4問 更新 2026-10-08
🎯 この講義の学習目標
  • ハルシネーションとは何か、なぜ起こるのかを言語モデルの仕組みから説明できる
  • ハルシネーションが起こりやすい質問の種類を見分けられる
  • AIの答えを確かめる具体的な方法を使える
  • ハルシネーションを減らすプロンプトを書ける

1.ハルシネーションとは何か

ハルシネーションとは、AIが事実ではない内容をまるで事実のように語る現象を指します。存在しない本のタイトルと著者、ない法律の条文、間違った日付、実際とは異なる引用文を、なめらかな文章でつくり出します。英語で「幻覚」を意味する言葉から、こう呼ばれています。

ハルシネーションが危ないのは、間違った答えが間違っているように見えないからです。正しい答えと同じ自信のある口調、同じ整った形式で出てきます。文章が自然であることは、内容が正しいことの証拠にはなりません。

2.なぜ起こるのか

第4講で、言語モデルは次に来る最ももっともらしいトークンを選ぶと述べました。モデルは「この文は事実か」を確かめる仕組みではなく、「この文はもっともらしいか」を計算する仕組みです。広く知られた事実は学習データに何度も出てくるので、もっともらしさと事実がほぼ一致します。しかし、まれな事実、学習以降の出来事、正確な数字のように、データにあまり出てこない内容では、両者がずれることがあります。

たとえば、あまり知られていない研究の著者を尋ねると、モデルはその分野で「もっともらしい名前」と「もっともらしい学術誌の名前」を組み合わせて答えることがあります。わからないと言うより、もっともらしい答えを書き続けるほうが、モデルにとって自然な場合があるからです。モデルやサービスをつくる側も、こうしたことを減らすためにさまざまな仕組みを加えていますが、原理上、完全にはなくせないと考えておくのが安全です。

3.ハルシネーションが起こりやすい質問

すべての答えを同じように疑う必要はありません。危ない質問の種類を知っておけば、確認にかける労力を節約できます。

確認が必要な度合い
質問の種類危険度理由
出典・引用・参考文献・リンク高いもっともらしいタイトルと著者を組み合わせてつくり出すことがある
正確な数字・日付・統計高い似た数字が多く、混ざりやすい
最近の出来事・最新の制度・価格高い学習以降の情報は知らない
あまり知られていない人物・小さな地域・特定の会社の事情中〜高学習データにあまり出てこなかった
法律・医療・税金のように、間違えると被害が大きい情報高い(被害の大きさが基準)小さな誤りでも影響が大きい
文章の手直し・要約・形式の変換低い与えた資料の範囲で作業するので、つくり話の余地が少ない(それでも要約が原文と合っているかは見る)

4.答えを確かめる五つの習慣

確認は難しくありません。重要な答えにだけ以下の習慣を当てはめても、かなりのハルシネーションを取り除くことができます。

  • 一次資料で確かめる:法律は法令の原文、制度は担当機関の公式な案内、統計は公表した機関の資料で確かめる
  • 出典は自分で探す:AIが教えてくれた本・論文・記事のタイトルを検索し、本当に存在するか、その内容が正しいかを見る
  • 数字は計算し直す:計算結果は計算機や表で自分で検算する(数学の基礎の講座がここで役立つ)
  • 聞き方を変えてもう一度尋ねる:質問を変えたり、新しい会話でもう一度尋ねたりして、答えが揺れる部分を探す
  • 根拠を求める:答えの根拠と確かでない部分を示させ、その部分から確かめる
例題AIに「集中力に関する有名な研究を三つ教えて」と尋ねたら、研究のタイトル、著者、発表年がきれいに出てきました。この答えを報告書に使う前に、何をすべきでしょうか。
  1. 出典・引用はハルシネーションの危険が高い種類だということを、まず思い出します。
  2. タイトルと著者を学術検索や図書館の検索で探し、本当に存在するかを確かめます。
  3. 存在するなら、原文の要旨だけでも読んで、AIが要約した内容と同じかどうかを比べます。
  4. 見つからない研究は報告書から外し、確認できたものだけを出典とともに書きます。
答え三つの研究すべてについて、実在するかどうかと内容を自分で確かめてから、確認できたものだけを使います。

5.自分でやってみる検証 — 数字を一つたどる

五つの習慣を、実際の答えの一つに当てはめてみましょう。以下の答えは説明のためにつくった例です。こうした答えは文章がなめらかで計算の根拠まで付いているので、そのまま信じてしまいがちです。

AIの答えが間違う理由が、すべてハルシネーションというわけではありません。原因が違えば確かめ方も変わるので、間違った答えに出会ったら、どんな種類の誤りなのかもあわせて考えるとよいでしょう。

  • 計算ミス:段階が長くなるほど、数字を書き写す途中で間違えやすい — 計算機や表計算ソフトで検算する
  • 古い情報:学習以降に変わった制度・価格・人物の情報を、以前の基準で語る — 日付の入った公式資料で確かめる
  • 質問の誤解:聞いていないことに答えたり、条件を一つ落としたりする — 質問の条件を答えと一つずつ照らし合わせる
  • 与えた資料の読み違い:貼り付けた資料にない内容を要約に混ぜる — 要約の各文が原文のどの部分に当たるかを示させる
例題AIに「100万円を年5%の複利で3年預けたらいくらになる?」と尋ねたら、「毎年5万円ずつ利息が付くので、3年後には115万円になります」という答えが出てきました。この答えをどう確かめればよいでしょうか。(税金・手数料は考えません)
  1. 手順1:危ない種類かどうかを見ます:正確な数字を尋ねる質問なので、確認が必要です。
  2. 手順2:自分で計算し直します:複利では毎年1.05を掛けます。1,000,000 × 1.05 = 1,050,000、× 1.05 = 1,102,500、× 1.05 = 1,157,625円。
  3. 手順3:違いの原因を探します:115万円は、元本にだけ利息を付ける単利の計算(1,000,000 × (1 + 0.05 × 3) = 1,150,000)です。答えの中の「毎年5万円ずつ」という言葉が、すでに単利だというサインでした。
  4. 手順4:正してもう一度尋ねます:「単利ではなく複利で、毎年掛けていく過程を表で見せてください」と頼めば、過程を一行ずつ照らし合わせられます。
答え複利なら1,157,625円です。115万円は単利で計算した値なので、質問と合っていません。
確かめた結果を短く記録しておきましょう。どんな種類の質問でAIがよく間違えたかがたまっていけば、次からどこを先に確かめるべきかをすばやく決められます。

6.ハルシネーションを減らすプロンプト

確認とあわせて、最初からハルシネーションが起こりにくいように尋ねる方法もあります。最も効果的なのは、根拠となる資料を直接渡すことです。信頼できる資料を貼り付けて「この資料の範囲でだけ答え、なければないと言ってください」と頼めば、つくり話の余地は大きく減ります。

わからないと言ってもよいと許可することも役に立ちます。「確かでなければ、わからないと答えてかまいません」「推測した部分には(推測)と示してください」のように書けば、答えの中の不確かな部分が見えてきます。反対に、「必ず五つそろえてください」のように個数を強いると、知っていることが三つしかないとき、残りの二つをつくり出す危険が大きくなります。

  • 誤り: このテーマに関する統計を五つ教えて。正しい: このテーマに関して、あなたが比較的確かに知っている統計があれば教えてください。それぞれ公表した機関と基準の年もあわせて書いてください。確かでなければ、個数をそろえようとせずに「要確認」と書いてください。個数を強いず、出典と不確かさを示させれば、確かめるべき点がはっきりします。
AIに「この答えで間違っている可能性が最も高い部分はどこですか」と尋ねるのも、よい出発点です。ただし、その自己点検も間違うことがあるので、最終的な確認は人が一次資料で行います。

📌 要点まとめ

  • ハルシネーションとは、AIが事実ではない内容を事実のように自信をもって語る現象である
  • 原因は、モデルが事実ではなく、もっともらしさを計算しているからである
  • 出典・数字・最新の情報・まれな事実・被害の大きい情報は、必ず確かめる
  • 一次資料での確認、出典の自分での検索、数字の検算、聞き直し、根拠の要求が基本の習慣である
  • 根拠となる資料を渡し、わからなければわからないと言わせ、個数を強いなければ、ハルシネーションは減る

✍️ 確認問題

まず自分で解いてから「解答と解説」を開いてください。

Q1. 次のうち、ハルシネーションの危険が最も低い依頼はどれでしょうか。

⭕ 正解です

❌ もう一度考えてみましょう

解答と解説
正解 ③ 私が貼り付けた議事録を三行に要約して

与えた資料の範囲で要約する作業は、つくり話の余地が少ないものです。それでも、要約が原文と合っているかは一度確かめます。

Q2. ハルシネーションが起こる根本的な理由として、最も適切なものはどれでしょうか。

⭕ 正解です

❌ もう一度考えてみましょう

解答と解説
正解 ② モデルが事実かどうかではなく、もっともらしさに従って文章をつくるから

言語モデルは次に来るもっともらしいトークンを選ぶ仕組みなので、もっともらしさと事実がずれるところでハルシネーションが起こります。

Q3. 「関連する判例を必ず五つ探して」というプロンプトの問題点は何でしょうか。

⭕ 正解です

❌ もう一度考えてみましょう

解答と解説
正解 ② 個数を強いることで、知らない判例をつくり出す危険を大きくする

知っていることが少ないとき、個数をそろえようとして、もっともらしい判例をつくり出すことがあります。法律の情報は、公式の判例検索で必ず確かめます。

Q4. AIが教えてくれた統計の数値を確かめる最もよい方法を、一文で書いてください。

解答と解説
解答例 その統計を公表した機関の公式な資料(一次資料)を自分で探し、数値と基準の年を確かめる

ほかのブログや、もう一度AIに尋ねるだけでは不十分です。公表した機関の元の資料が、最も確かな確認方法です。

🤖 AIにはこう聞いてみましょう

コピーして [ ] の部分を自分の状況に書き換えて使います。答えはそのまま信じず、本文と比べて確かめましょう。

重要な答えをもらう前に、不確かさを明らかにしたいとき

次の質問に答えてください。ただし、答えの各文の末尾に、確かさの度合いを(確実)/(ほぼ確実)/(推測)のいずれかで示し、私が自分で確かめるべき項目と確かめる先(どんな種類の機関や資料か)を、最後に箇条書きでまとめてください。質問:[質問]

すでにもらった答えを点検したいとき

あなたがいま出した答えのうち、事実関係が間違っている可能性が高い部分を三か所選び、理由とともに教えてください。特に、数字、日付、名前、出典を中心に見てください。

資料だけを根拠に答えてほしいとき

以下の資料だけを根拠に答えてください。資料にない内容は決して付け加えず、「資料になし」と書いてください。答えたあとで、それぞれの内容が資料のどの文から来たのかを、そのまま引用してください。
[資料]
質問:[質問]
参考
  • 生成AI活用ガイドの多くに共通して載っている、事実確認の原則の一般的な内容
  • 自然言語処理の分野で使われる「ハルシネーション(幻覚)」という概念の一般的な定義

学習目標をすべて達成できたら完了を押しましょう。

🤖 AIの基礎

  1. 1AIとは何か — ルールと学習
  2. 2機械学習の基本 — データ・モデル・学習・評価
  3. 3ニューラルネットワークの直観 — 小さな計算が集まって判断になる
  4. 4大規模言語モデルはどうやって言葉をつくるのか
  5. 5プロンプトの基礎 — 望むことを正確に伝える
  6. 6プロンプトの応用 — 役割・例・段階・形式
  7. 7ハルシネーションと検証 — もっともらしさを疑う方法
  8. 8個人情報・著作権・倫理 — 責任をもって使う
  9. 9AIと働く方法 — 任せる、確かめる、つなげる
  10. 10AI時代の学習戦略 — 基礎が質問をつくる
📚 あわせて読みたい
🧠生成AIができることと限界→ ✍️質問(プロンプト)の上手な書き方→ 🔍AIの回答を検証する→ 📚勉強・仕事での使い方と剽窃の注意→
← AI時代の基礎学力講座