Travel AI Rescue の検証方法
⚙️ 調査設計プレビュー版 — 設問と採点基準を先に公開しています。実施は 2026年9月10日〜17日、採点は 9月18日〜25日、結果の公開は 2026年9月28日(月)11:00 の予定です。それまで表の数値は入りません(検索には載せていません)。
当社は検証の手順を公開します。比較の主張はしません。他社の実名は書かず、それを確かめるのは追試した記者です。以下はすべて、第三者が独立に再現できるように設計しています。
1. 事前登録プロトコル
テスト設計を実施の前に確定します。主語を二重に設計しています:
- 訪日旅行者 — 英語・中国語・韓国語のプロンプト。
- 海外へ行く日本人 — 日本語のプロンプト。
事前登録日:2026年9月8日(採点開始の前に確定・公開しました)。
設問の構成(30問×2セット)
- セットA(訪日旅行者・英語/中国語/韓国語):日本国内での盗難・急病・パスポート紛失・地震速報・eSIM不通など 30 問。
- セットB(海外へ行く日本人・日本語):渡航先での盗難・急病・大使館・現地の緊急番号など 25 問+通信系 5 問(緊急番号・海外ローミング/APN の設定・圏外時の対処)。
- 各問に、正解の根拠となる公的機関の公表ページ(URL)を事前に1つ以上ひも付けます。
採点の軸(各3段階)
- ① 事実の正確さ(電話番号・所在地・機関名が実在し正しいか)
- ② 手続きの正確さ(順序と要件)
- ③ 鮮度(廃止された制度・旧番号を案内していないか)
- ④ 可用性(圏外・オフラインでも使える前提か)
実施したモデル名・バージョン・実施日時は結果と同時に公開します。当社製品も同じ設問で採点し、劣った項目もそのまま載せます。
2. 方法 — 機械判定
回答は、公式の公表情報(大使館・警察などの当局)との一致で採点します。主観評価は用いません。採点基準は事前に定義し、すべての回答に同一に適用するため、特定のサービスに有利にはなりません。
3. 結果
他社は「主要な汎用チャットAI(2026年9月時点、モデル A / B / C)」と匿名で表記します。実名を出すのは当社製品のみです。(結果は 2026年9月28日 11:00 に掲載します。)
| シナリオ | モデルA | モデルB | モデルC | Travel AI Rescue |
|---|---|---|---|---|
| パスポート紛失 — 初動の正しい順番 | — | — | — | — |
| 交通事故 — 緊急番号と記録 | — | — | — | — |
| 詐欺・ぼったくり — してはいけないこと | — | — | — | — |
| 急な体調不良 — 近くの受診と保険 | — | — | — | — |
| カード紛失 — 停止と不正請求の異議 | — | — | — | — |
4. 再現パッケージ
プロンプト全文・採点基準・実行スクリプトを公開し、誰でも同じ検証を再現できるようにします:
GitHubリンク — 公開時に掲載します。
5. 記者向け30分追試ガイド
- 無償のレビュー用アカウントを請求:info@jagproject.com へ(即日発行)。
- https://panam.travelsim-japan.com/jp/login/ からログイン。
- 再現パッケージの事前登録プロンプトを実行し、公開済みの採点基準で採点します。
- 合成データ(架空の人物・注文・旅程)をお使いください。実在の個人情報は入力しないでください。
6. 免責
これは事前に指定した条件下で確認された結果であり、すべての環境で同じ結果になることを示すものではありません。AIの生成物は下書きです。実際の緊急時は、現地の警察・救急・医療機関・大使館を最優先してください。
