AI調査の出典チェックシート|URL・本文・主張の確認を分けて記録する
URLがあること、資料を取得したこと、内容を読んだこと、主張の裏付けを確認したことは別です。
このページは、AIを使って調査する編集者、企画担当者、開発者のための実用品です。調査結果の重要な主張を1つ選び、下のシートへ記入してください。「どの資料の、どの箇所まで確認したか」と「何をまだ断定できないか」が残ります。
本ページの項目名と判定方法は当サイトの提案です。W3Cなどの規格そのものを転載したものでも、規格準拠を認証する仕組みでもありません。
版1.0/根拠確認日:2026年9月8日
まず使う:主張1件の確認シート
以下をコピーして使えます。秘密情報や個人情報を、未承認の外部AI・共有先へ貼り付けないでください。
確認したい主張:
使う目的・対象読者:
【資料と版】
資料ID・版ID:
発行元・正式名称:
発行日・改訂日(不明は不明):
正本URL:
実際の取得先URL:
取得日:
保存先・版を区別する情報:
【今回の取得と読解】
取得方法・結果:
本文を取得できたか:
読んだ範囲(ページ・節・表):
読めなかった範囲と理由:
OCR等の読み取り誤りが残る箇所:
【主張の点検】
主張を支える具体的な箇所:
原文にある条件・対象・例外:
自分が追加した計算・推論:
単位・期間・母集団の一致:
反対の根拠・未解決の矛盾:
【結論と次の一手】
判断:採用/条件付き採用/保留/不採用
公開してよい表現:
断定してはいけない表現:
残る確認・担当・期限:
確認者・確認日:
再確認が必要になる条件:
全資料を完全に読むことが常に必要なわけではありません。しかし、読んでいない範囲まで「確認済み」に含めないことは必要です。重要な条件が別章に参照されているなら、その条件も確認します。
4段階を混ぜない
| 段階 | 記録する事実 | まだ言えないこと |
|---|---|---|
| 発見 | URL・資料名を見つけた | 本文が存在し、読めるとは限らない |
| 取得 | 対象の本文を受け取った | 内容を理解・検証したとは限らない |
| 読解 | 特定の節・表と条件を読んだ | 数字の転記や解釈が正しいとは限らない |
| 検証 | 対象の主張を原文・条件・計算と照合した | 資料全体や別の主張まで正しいとは限らない |
検索結果の短い説明は本文の代用品にしません。HTTP 200でもログイン画面や別のページが返る場合を想定し、タイトル・本文・対象資料の一致を確認します。
記入例:数字は合っていても、主張は間違う
以下は説明用の架空例です。実在する企業・調査・導入成果ではありません。
ある報告書に「回答した利用者40人のうち30人が便利と回答」と書かれていたとします。AIの草稿は「全社員の75%で生産性が向上」と要約しました。
確認したい主張:全社員の75%で生産性が向上した
資料ID・版ID:SAMPLE-S1/v1
発行元・正式名称:架空企業/利用者アンケート
正本URL:架空例のため実在URLなし
読んだ範囲:架空の表2と調査対象の説明
原文の対象:任意アンケートの回答者40人
原文の結果:便利と答えた回答者30人
自分の計算:30 ÷ 40 = 75%
不一致:回答者を全社員へ拡張している
不一致:便利という主観回答を生産性の実測へ置き換えている
判断:元の主張は不採用
公開してよい表現:この架空例では、回答者の75%が便利と答えた
断定してはいけない表現:全社員の生産性が75%改善した
残る確認:実例に使う場合は、抽出方法・未回答者・実測指標を確認
この場合、「資料を読めた」「計算が合った」だけでは足りません。誰について、何を測った数字かまで一致させます。
取得できなかったときの扱い
RFC 9110では、403はサーバーが理解した要求を拒否した状態、412は要求ヘッダーに指定した前提条件が成立しなかった状態として説明されています。どちらも、それだけで資料が存在しないという意味にはなりません。[1]
| 起きたこと | 残す記録と判断 |
|---|---|
| 403で取得できない | 拒否と未取得を記録。同じ認証で自動反復しない。許可された公式の公開先を探す |
| 412が返る | 前提条件不一致を記録。安全条件を外して無理に再送しない |
| タイムアウト | 応答を確認できなかった事実を残す。不存在や内容の誤りと区別する |
| 別URLへ転送された | 元URLと最終URLを残す。転送だけで最新版と判断しない |
| PDFの文字を読めない | 未読範囲を明示。空の資料と判定せず、ページの確認可能な表現を利用する |
| 旧版だけ読めた | 旧版で確認した事実と、現在も有効かの判断を分ける |
アクセス制御の回避、認証情報の使い回し、無制限の再試行を勧めるものではありません。必要な根拠が取得できない主張は保留し、別の裏付けがある主張の調査は進められます。
調査が増えたら、1行にすべてを詰め込まない
最初は上のシートで十分です。ただし同じ資料へ何度もアクセスしたり、1資料から複数の主張を使ったりすると、1行の「確認済み」だけでは履歴が分からなくなります。その段階では次の4つを分けます。
資料・版には、発行元、正式名称、URL、改訂日、保存物の同一性を記録します。取得試行には、その版へいつ・どの許可された方法でアクセスし、何が返ったかを残します。主張には検証したい文章を、検証記録には読解範囲、照合内容、確認者、判断を残します。
W3C PROV-DMは、情報の来歴を実体・活動・責任主体とその関係で扱います。この考え方を参考にすると、原本、抽出した表、AIの要約、確認作業を同一物として扱わずに済みます。[2]
資料S1の版V1
├─ 取得試行F1:取得できず
└─ 取得試行F2:許可された公開先から取得
└─ 抽出表T1:S1/V1の表2から作成
└─ 主張C1の検証R1:条件付き採用
後の取得が成功しても、前の失敗記録は上書きしません。原本のハッシュは保存したバイト列の同一性の確認に使えますが、内容の正しさ、最新性、利用許可まで保証するものではありません。原本保存も、権利・保存期限・組織の取り扱い規則に従ってください。
公開前に確認する5つの問い
原文がその主張を本当に支えているか。 数字だけでなく対象・条件・例外を照合します。
原文と自分の推論を分けたか。 推計や解釈を発行元の断言へ変えません。
古い資料を現在の状況として扱っていないか。 発行日と確認日を別にします。
確認できない部分を読者に伝えたか。 都合のよい部分だけを採用しません。
別の人が同じ箇所へ戻れるか。 URLに加え、版・節・表などを残します。
GoogleのData Cardsも、データの出所、収集方法、用途、判断の理由を、利用者が理解できる形で記述することを重視しています。[3] このシートの目的も記録欄を増やすことではなく、次の判断で根拠を再利用できる状態を作ることです。
次に確認すること
出典の確認はAI業務全体の受入条件の一部です。権限、止め方、責任、費用まで合わせて確認する場合は、AIエージェントを本番で任せる前の10問へ進んでください。
出典と適用範囲
[1] RFC 9110: HTTP Semantics — 15.5.4、15.5.13。HTTP応答の意味の根拠です。出典シートの完成基準を規定するものではありません。
[2] W3C PROV-DM — 実体・活動・責任主体と来歴の関係。本ページの項目名は独自の簡略化です。
[3] Google Research: Data Cards — 利用者を中心に据えたデータ文書化。AI調査全般の有効性を実証した資料とは扱っていません。
外部資料の確認日:2026年9月8日。テンプレートの有用性は利用環境に依存し、誤りの完全防止を保証しません。



コメント