AIが出した参考文献がデータベースで見つからない場合、検索ミスではなく、AIが創作した可能性の方が高いです。著者、誌名、年号、巻号まで整っているのに、その論文だけが存在しない。これは大規模モデルの最も典型的な幻覚の一つで、モデルの仕事は「文献らしく見える文章を生成すること」であって、データベースから実在の論文を検索することではないからです。真偽の判断に勘は要りません。以下の4ステップで、1件あたり10分ほどで検証できます。
なぜこれほど「らしく」なるのか
モデルは訓練データの中で膨大な引用形式を見てきました。どの分野がどの雑誌に出すか、タイトルの付け方、著者名の並び方——その統計的パターンを身につけています。「出典を出して」と頼めば、そのパターンに沿ってその場で組み立てます。書式が整っているほど真実の証拠にはなりません。書式の正確さこそ、モデルの最も得意な部分だからです。
4ステップ検証法
第一に、タイトルを原文のまま検索する。完全なタイトルをGoogle Scholar、知網、PubMedに一字一句そのまま入れて探します。実在の論文なら原文ページがほぼ必ず見つかります。単語が散発的に一致するだけで、全文検索で何も出なければ、まず偽物として扱ってください。
第二に、DOIを確かめる。正規の論文の多くには10.xxxx/xxxxxという形のDOIがあり、doi.orgやCrossrefで引けます。DOIが引けない、あるいは引けた論文とタイトルが一致しなければ、その引用は即座に破棄です。
第三に、雑誌の巻号を照合する。雑誌の公式サイトで該当年の巻号一覧を見て、その号が実際に出たか、ページ範囲が合うかを確認します。創作引用はここで露見しがちで、たとえば2019年に第40巻など存在しない雑誌が典型です。
第四に、著者を調べる。氏名に研究分野を加えて検索し、その人物が実在するか、その分野で論文を出しているかを見ます。偽の引用では「実在の研究者だが分野が違う」か、そもそも存在しない人物がよく混ざります。
これが出たら即アウト
タイトルが見つからずDOIも無効——この二つが重なれば、それ以上の検証は不要です。誌名と年だけを挙げ、巻号もページもない引用は、未検証として扱うのが既定です。もう一つ厄介な型もあります。論文自体は実在するのに、AIの言う内容はその論文に書かれていないケース。引用する前に少なくとも要旨を読み、自分の文を本当に裏づけるか確認してください。
次からの正しい使い方
論文、報告書、申請資料を書くとき、汎用チャットモデルに文献を空想させないこと。安全な手順は、先に自分でデータベースから実在の文献を見つけ、要旨や全文をAIに渡して要約、比較、推敲をさせることです。あるいは、オンライン検索付きで出典リンクを返すツールを使い、一件ずつ開いて確かめること。署名して提出するものについては、上記4ステップを通らない引用は1件も参考文献表に入れてはいけません——学術の場では、引用の捏造の責任はツールではなく提出者にあります。