2026-09-05
ANES 2024: シンセティック回答と事後実査回答の比較検証
ANESの選挙前後の実査データを活用し、マッチングされた300人を対象に事後28問の回答を検証。回答フォーマットとプロファイル接地(グラウンディング)の影響を個別に測定しました。
合成回答者、ペルソナ条件付きAI、評価手法、シミュレートされたエビデンスの限界に関する Minds Research Lab の実験・ベンチマーク・技術論文。
ANESの選挙前後の実査データを活用し、マッチングされた300人を対象に事後28問の回答を検証。回答フォーマットとプロファイル接地(グラウンディング)の影響を個別に測定しました。
CESの比較検証では、マッチングされた300名の回答者を対象に、二値選択、順序尺度、複数選択からなる27問を評価し、集計レベルの適合度と個人レベルの予測を切り分けて検証しています。
ターゲット分離型のGSSパイロット検証において、360名および17問を対象に4つの回答条件を比較し、確率推定の効果とプロファイルの付加価値を検証します。
5カ国を対象としたPISA比較検証。生徒600人とホールドアウトされた10問を評価し、加重分布誤差ならびに国や言語に関する明確な制約条件を提示します。
5つの公開調査データセット(301体のMindによるZ世代の本番環境テストを含む)から明らかになった合成オーディエンスの精度と、プロファイル接地が効果を発揮する領域。
アウトカムブラインド(結果非開示)の検証において、301名の固定されたZ世代のMindsによる903件の回答と、公表されている英国Food Standards Agencyの調査分布を比較しました。その結果、総合近似度は93.99%に達しました。