---
title: "مواءمة PRISM: اختبار توافق المشاركين في الإجابات المحجوبة"
description: "مقارنة تشمل 299 شخصًا و869 عنصرًا تقيس ما إذا كانت نماذج Minds المدعومة بالبيانات تعكس قيم المشاركين وأسبابهم بصورة أفضل، بالاعتماد على محكّم أعمى وحدود واضحة للمهام."
canonical_url: "https://getminds.ai/research/ar/prism-alignment-participant-fit-validation"
last_updated: "2026-09-08T21:57:51.538Z"
---

# مواءمة PRISM: اختبار توافق المشاركين في الإجابات المحجوبة

في مقارنة تأكيدية باستخدام مجموعة بيانات PRISM Alignment الخارجية، تفوقت نماذج Minds الكاملة في 32.6% من تقييمات التوافق مع المشاركين المعماة، مقارنة بنسبة 25.7% للمطالبات الديموغرافية و20.5% للمطالبات العامة. وتركزت أقوى المكاسب في التعبير عن القيم، والدقة، وانخفاض الطابع العام للردود.

تعد مجموعة بيانات PRISM هذه معيارًا مرجعيًا خارجيًا، وهي تختلف عن محرك نمذجة المصادر PRISM الخاص بشركة Minds.

## المشاركون والأهداف والشروط

قيّمت الدراسة 299 مشاركًا من المملكة المتحدة و869 عنصرًا خاصًا بمجالات المشاركين. وأنتجت ثلاثة شروط تجريبية 2,607 مخرجات خضعت للتقييم: نماذج Minds الكاملة عبر مسار الإنتاج، والمطالبات المقتصرة على البيانات الديموغرافية، والمطالبات العامة.

تم الاختيار دون معرفة النتائج مسبقًا، وحُجبت إجابات المشاركين الحقيقيين عن عملية التوليد. وقام نموذج لغوي كبير (LLM) كمحكّم أعمى فردي بتقييم مقارنات متطابقة في الطول ومجهولة المصدر بالنسبة للشروط. يُعد هذا تقييمًا آليًا للتوافق مع المشاركين، وليس تحققًا مستقلًا من قِبل مقيّمين بشريين.

## ما فضّله المحكّم

<research-figure :labels="["فوز Minds الكاملة","فوز المطالبات الديموغرافية","فوز المطالبات العامة","تعادل"]" figure="prism-alignment-participant-fit-validation" note="النتائج المبلغ عنها لهذه الدراسة. يوضح الجدول والنقاش نطاق الدراسة وخطوط المقارنة وعدم اليقين." title="الحصة من العناصر المقيّمة" unitLabel="%">



</research-figure>

<table>
<thead>
  <tr>
    <th>
      النتيجة
    </th>
    
    <th align="right">
      الحصة من العناصر المقيّمة
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      فوز Minds الكاملة
    </td>
    
    <td align="right">
      32.5662%
    </td>
  </tr>
  
  <tr>
    <td>
      فوز المطالبات الديموغرافية
    </td>
    
    <td align="right">
      25.6617%
    </td>
  </tr>
  
  <tr>
    <td>
      فوز المطالبات العامة
    </td>
    
    <td align="right">
      20.4833%
    </td>
  </tr>
  
  <tr>
    <td>
      تعادل
    </td>
    
    <td align="right">
      21.2888%
    </td>
  </tr>
</tbody>
</table>

أظهرت المقارنة الإجمالية المسجلة تفوقًا لصالح Minds بمقدار 12.04 نقطة مئوية مقارنة بالمطالبات العامة، و6.69 نقطة مقارنة بالمطالبات الديموغرافية. تمثل هذه الأرقام تقديرات المقارنة المسجلة مسبقًا، ولا ينبغي استبدالها بعملية طرح لمعدلات معروضة وموجزة بشكل منفصل.

لا يعني معدل الفوز محاكاة مطابقة لنتائج الاستطلاعات. بل يعني أن المحكّم فضّل هذا الخيار وفق معيار التوافق مع المشارك، ولا يعني إعادة إنتاج نفس النسبة من إجابات الأشخاص بدقة. كما يظل وجود نسبة تعادل كبيرة جزءًا أساسيًا من النتيجة.

## حدود المهام

حققت المهام الموجهة بالقيم والموجهة بالقضايا الجدلية الميزة الأوضح. إذ تعتمد هذه الأسئلة على أسباب المشارك ووجهة نظره المعبر عنها مسبقًا، مما يجعل التأصيل الأكثر ثراءً بالبيانات وثيق الصلة ومباشر التأثير.

لم تمتد هذه الميزة إلى كل المهام. ففي المطالبات اليومية القصيرة، حققت Minds نسبة فوز بلغت 13.8%، مقابل 30.5% للمطالبات العامة و34.0% للمطالبات الديموغرافية. وكانت المطالبات غير الموجهة أضعف أيضًا. لم يتحسن التشابه الدلالي العام بشكل ملحوظ، كما كان التشابه المعجمي مع تطابق الطول أقل من كلا خطي الأساس.

تجعل هذه النتائج الفوز الإجمالي جزئيًا، وليس تفوقًا شاملًا في دقة الاستجابة. كما أنها توضح الفارق بين التوافق مع المشارك ونسخ الصياغة اللفظية. يمكن للاستجابة أن تعكس أسباب الشخص دون أن تطابق صياغته بدقة، كما أن الإجابة اليومية السلسة لا تستفيد بالضرورة من تفاصيل إضافية في الملف الشخصي.

## ما تدعمه هذه النتائج

الادعاء المدعوم هنا أكثر تحديدًا وفائدة: نجحت نماذج Minds المدعومة بالبيانات في تحسين التوافق مع المشاركين وفق تقييم المحكّم ضمن العينة المدروسة بشكل عام، لا سيما في جوانب القيم والدقة. ومع ذلك، يظل وجود محكّمين بشريين مستقلين وتغطية مجالات إضافية أمرين ضروريين لتقديم ادعاءات أقوى بشأن الدقة.

يبحث [تأكيد المقابلات المحجوبة](/research/held-out-interview-response-validation) الأدلة السابقة والإجابات اللاحقة في مجموعتين نصيتين أخريين. وتتناول [مقارنة النماذج التأسيسية](/research/synthetic-audiences-vs-foundation-models) كيفية مقارنة سير العمل المدعوم بالبيانات مع استجابات النماذج العامة. بينما يفصل [نظرة عامة على الأدلة](/research/synthetic-audiences-reality-benchmark-2026) هذه المقاييس النوعية عن محاكاة الاستطلاعات.

## البيانات المرجعية

[PRISM Alignment Dataset](https://arxiv.org/abs/2404.16019)
