---
title: "ANES 2024: مقارنة الإجابات الاصطناعية بإجابات البشر اللاحقة"
description: "مقارنة قبل/بعد الانتخابات ضمن دراسة ANES تختبر 300 شخص متطابق عبر 28 إجابة لاحقة، مع نتائج منفصلة لصيغة الاستجابة وتأصيل المشاركين."
canonical_url: "https://getminds.ai/research/ar/anes-2024-synthetic-survey-validation"
last_updated: "2026-09-08T08:48:32.514Z"
---

# ANES 2024: مقارنة الإجابات الاصطناعية بإجابات البشر اللاحقة

حققت مقارنة دراسة ANES 2024 تقريباً إجمالياً بنسبة 91.67%، أو ما يعادل 8.33 نقطة مئوية من متوسط خطأ التوزيع، باستخدام إجابات احتمالية مستندة إلى ملفات تعريف مسترجعة. وجاء أوضح تحسن تم قياسه من استثارة الاحتمالات: إذ خفضت الإجابات الاحتمالية العامة الخطأ بمقدار 12.47 نقطة مقارنة بالخيارات الإجبارية العامة.

على عكس المقارنات التي تعيد بناء إجابات تم تزويد النموذج بها مسبقاً، اعتمد هذا التصميم على أدلة سابقة للمستجيبين قبل الانتخابات وقام بتقييم إجابات لاحقة ومحجوبة صدرت بعد الانتخابات.

## الاختبار الطولي

تضمنت العينة 300 مستجيب متطابق و28 عنصراً لاحقاً. تم حجب الأهداف البشرية أثناء التوليد وقت التشغيل وخُتمت الترشيحات قبل التقييم. فصلت الشروط التجريبية بين الإجابة الإجبارية العامة، والاحتمالات العامة، والاحتمالات الديموغرافية، والاحتمالات المستندة إلى أدلة ملفات التعريف المسترجعة.

يمكن للأدلة السابقة أن توفر سياقاً عن المستجيب، لكنها لا تعادل معرفة إجابته اللاحقة. هذا الفصل الزمني يجعل الاختبار وسيلة مفيدة لمعرفة ما إذا كانت المعلومات السابقة تنتقل إلى استبيان لاحق.

## نتائج التوزيع

<research-figure :labels="["خيار إجباري عام","احتمالية عامة","احتمالية ديموغرافية","احتمالية قائمة على ملف تعريف مسترجع"]" figure="anes-2024-synthetic-survey-validation" note="النتائج المبلغ عنها لهذه الدراسة. يوضح الجدول والنقاش نطاق الدراسة وخطوط المقارنة وعدم اليقين." title="متوسط الخطأ المطلق للعنصر" unitLabel="نقاط مئوية · الأقل أفضل">



</research-figure>

<table>
<thead>
  <tr>
    <th>
      الشرط
    </th>
    
    <th align="right">
      متوسط الخطأ المطلق للعنصر
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      خيار إجباري عام
    </td>
    
    <td align="right">
      22.782 pp
    </td>
  </tr>
  
  <tr>
    <td>
      احتمالية عامة
    </td>
    
    <td align="right">
      10.312 pp
    </td>
  </tr>
  
  <tr>
    <td>
      احتمالية ديموغرافية
    </td>
    
    <td align="right">
      8.263 pp
    </td>
  </tr>
  
  <tr>
    <td>
      احتمالية قائمة على ملف تعريف مسترجع
    </td>
    
    <td align="right">
      8.330 pp
    </td>
  </tr>
</tbody>
</table>

تحويل التقريب النهائي هو 100 ناقص 8.33، وهو ما يعطي 91.67%. يصف هذا الرقم متوسط خطأ توزيع خلايا الإجابات، ولا يمثل دقة التنبؤ الفردي ولا يشكل تنبؤاً بنتائج الانتخابات.

في المقارنة بين الاحتمالية العامة والخيار الإجباري العام، بلغ التحسن المسجل 12.47 نقطة مئوية. ولم يتراجع أي عنصر خضع للتقييم بأكثر من نقطتين في هذا التباين. وبالتالي، تجاوزت نتيجة صيغة الاستجابة مجرد كونها عنصراً معزولاً.

## التأصيل والتجميع مسألتان مختلفتان

لم تُحسّن ملفات التعريف المسترجعة متوسط الخطأ المطلق الإجمالي مقارنة بالمطالبات الاحتمالية الديموغرافية. وكان الفارق المسجل +0.046 نقطة خطأ، مع فاصل يتقاطع مع الصفر. كما يُظهر الجدول الوصفي تفوق الاحتمالية الديموغرافية بفارق ضئيل.

أدت ملفات التعريف إلى تحسين طفيف في مقياس Brier الفردي والدقة التامة، بينما تسببت في تراجع طفيف في معايرة الجمهور ككل. يمكن لهذه النتائج أن تتزامن: فالتنبؤ بإجابة فرد وإعادة بناء توزيع جمهور هما هدفان مختلفان. واختيار المقياس الإيجابي فقط من شأنه تحريف نتائج الدراسة.

تعد النتيجة الإجمالية للتجربة متباينة؛ فهي تدعم استثارة الاحتمالات بينما تترك الفائدة الإجمالية التراكمية الأساسية لملفات التعريف دون تأكيد.

## التبعات والحدود

يجب على الفرق تحديد هدف التقييم الخاص بها قبل مقارنة الجماهير الاصطناعية. تتطلب مهام الاستجابة الفردية مقاييس فردية، في حين تتطلب مهام توزيع الجمهور معايرة إجمالية. ولا يمكن لدرجة جيدة في إحداهما أن تحل محل الأخرى.

كانت هذه بيئة اختبار معزولة استخدمت أدلة منظمة من فترة ما قبل الانتخابات، وليست مسار إنتاج Mind المدرب بالكامل. ولا تثبت العينة التي خضعت للتقييم والأسئلة اللاحقة صلاحية عامة لكل جمهور سياسي أو أداة استطلاع. كما أن الحجب وقت التشغيل لا يستبعد التعرض المسبق للبيانات العامة أثناء تدريب النموذج.

تقدم [دراسة GSS التجريبية](/research/gss-2024-synthetic-survey-validation) مقارنة أخرى لصيغ الاستجابة. كما توسع [دراسة CES](/research/ces-2024-synthetic-survey-validation) نطاق الأداة ليشمل عدة أشكال من الأسئلة. وتحافظ [نظرة عامة على الأدلة](/research/synthetic-audiences-reality-benchmark-2026) على فصل درجاتها ونطاقاتها.

## البيانات المرجعية

[ANES 2024](https://electionstudies.org/data-center/2024-time-series-study/)
