---
title: "Minds مقابل GPT-5.4 وClaude Sonnet 5 في إجابات المقابلات الحقيقية"
description: "تقييم معياري نوعي معمي يقارن بين Minds المدعومة بالأدلة وGPT-5.4 وClaude Sonnet 5 العامة بناءً على إجابات مقابلات بشرية مستبعدة للاختبار."
canonical_url: "https://getminds.ai/research/ar/minds-vs-foundation-models-qualitative-2026"
last_updated: "2026-08-13T13:07:39.010Z"
---

# Minds مقابل GPT-5.4 وClaude Sonnet 5 في إجابات المقابلات الحقيقية

ما يجعل المستجيب الاصطناعي مفيدًا ليس قدرته على إنشاء اقتباس معقول، بل قدرته على مواصلة تقديم منظور شخص حقيقي عند طرح سؤال جديد عليه.

اختبر مختبر Minds Research Lab ذلك بشكل مباشر. حيث استخدمنا 66 إجابة لاحقة مستبعدة للاختبار من 22 مقابَلًا حقيقيًا عبر مجموعتي بيانات نوعيتين عامتين ومستقلتين. وتمت مقارنة نماذج Minds المدعومة بالأدلة مع GPT-5.4 العام، وClaude Sonnet 5، واستجابة عامة من النموذج نفسه.

تفوقت Minds على GPT-5.4 بمقدار **25.49 نقطة مركبة** وعلى Claude Sonnet 5 بمقدار **30.05 نقطة**. وقام مقيّم معمي ثانٍ بإعادة إنتاج كلا النتيجتين.

<study-stats>



</study-stats>

## التقييم المعياري

استخدمت الدراسة مجموعتي نصوص مقابلات منشورة بشكل مستقل وبترخيص مفتوح:

- [مقابلات مجهولة الهوية حول انعدام الأمن الغذائي للاجئين](https://doi.org/10.6084/m9.figshare.29318549.v1)، نشرها باحثون من جامعة يوتا.
- [تفريغات مقابلات دولية حول طب الأسنان بالليزر](https://doi.org/10.6084/m9.figshare.28456946.v1)، نشرها باحثون من جامعة خون كاين.

بالنسبة لكل مشارك، أمكن للمواد المبكرة أن تزوّد المستجيب الاصطناعي بالمعلومات، بينما تم احتجاز الإجابات اللاحقة لغرض التقييم. تلقّت النماذج سؤال المقابلة نفسه وتعليمات صيغة الإجابة نفسها. ولم تتلقَ النماذج التأسيسية العامة أي ذاكرة أو ملف شخصي للمشارك.

تم توليد جميع الإجابات المرشحة قبل استخدام الإجابات المستبعدة لغرض التقييم العددي. وتم تعشية تسميات الإجابات المرشحة حتى لا يستطيع المقيّم معرفة النموذج الذي أُنتجت منه كل إجابة.

## النتائج

<table>
<thead>
  <tr>
    <th>
      المرشح
    </th>
    
    <th align="right">
      الدرجة المركبة
    </th>
    
    <th align="right">
      نسبة الفوز
    </th>
    
    <th align="right">
      الفارق مقارنة بـ Minds
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      <strong>
        Minds
      </strong>
    </td>
    
    <td align="right">
      <strong>
        67.66
      </strong>
    </td>
    
    <td align="right">
      <strong>
        72.7%
      </strong>
    </td>
    
    <td align="right">
      -
    </td>
  </tr>
  
  <tr>
    <td>
      GPT-5.4
    </td>
    
    <td align="right">
      42.17
    </td>
    
    <td align="right">
      16.7%
    </td>
    
    <td align="right">
      <strong>
        Minds +25.49
      </strong>
    </td>
  </tr>
  
  <tr>
    <td>
      Claude Sonnet 5
    </td>
    
    <td align="right">
      37.61
    </td>
    
    <td align="right">
      0.0%
    </td>
    
    <td align="right">
      <strong>
        Minds +30.05
      </strong>
    </td>
  </tr>
  
  <tr>
    <td>
      استجابة عامة من النموذج نفسه
    </td>
    
    <td align="right">
      35.24
    </td>
    
    <td align="right">
      3.0%
    </td>
    
    <td align="right">
      <strong>
        Minds +32.42
      </strong>
    </td>
  </tr>
</tbody>
</table>

بلغ الفاصل الزمني 95% المجمع حسب المشاركين **+15.99 إلى +34.56** مقارنة بـ GPT-5.4 و**+21.86 إلى +38.12** مقارنة بـ Claude Sonnet 5. وكانت النتائج إيجابية بشكل مستقل لكلتا مجموعتي نصوص المقابلات.

أعادت نسخة التقييم الثانية إنتاج تحسينات بلغت **+26.13** و**+30.68** نقطة. واتفق المحكّمان على المرشح الفائز في 81.8% من الإجابات الفردية.

## المجالات التي تفوقت فيها Minds

قاس مقياس التقييم ما هو أبعد من الفصاحة الظاهرية. حيث قارن كل إجابة مرشحة مع الإجابة اللاحقة الحقيقية للشخص عبر:

- المحاذاة الدلالية
- وجهة النظر والقيم
- الموضوعات والأسباب
- التحديد والدقة
- الصوت والأسلوب
- ملاءمة الطول
- العمومية
- الحقائق الشخصية غير المدعومة

ظهرت أكبر ميزات Minds في المحاذاة الدلالية، ووجهة النظر، والأسباب، والتحديد، والصوت المعرف. بعبارة أخرى، لم تكن إجابات Minds تبدو أكثر صقلاً فحسب، بل كانت أكثر قدرة على الحفاظ على ما يهتم به ذلك الشخص، وكيف يشرحه، والتفاصيل التي يستخدمها بطبيعته.

لم يكن هذا التفوق ناتجًا عن طول النص؛ حيث بلغ متوسط إجابات المرشحين ما بين 52 إلى 60 كلمة تقريبًا عبر جميع الشروط.

## لماذا يختلف هذا عن طلب تمثيل شخصية من ChatGPT

يتميز النموذج العام بقدرات فائقة، لكن السؤال وحده لا يحتوي على تاريخ الشخص. وعليه بالتالي تقديم إجابة تبدو معقولة لشخص ما بشكل تجريدي.

تم بناء Mind للحفاظ على مشارك بحثي مستمر. حيث يمكنها نقل المعرفة المعتمدة، وسياق البحث السابق، ووجهة النظر المميزة عبر الأسئلة الجديدة. يتيح ذلك للنموذج الأصغر أو الأقل تكلفة التفوق على نموذج عام أضخم بكثير عندما تعتمد المهمة على معرفة الشخص بدلاً من معرفة العالم.

هذه هي أطروحة Minds المركزية في شكل قابل للقياس: **يمكن لعمق الشخصية والذاكرة ذات الصلة أن يكونا أكثر أهمية من الحجم الخام للنموذج التأسيسي.**

## التحقق النوعي الإضافي

اختبر برنامج البحث الأوسع نفسه أيضًا:

- [PRISM](https://arxiv.org/abs/2404.16019)، باستخدام 299 مشاركًا لم تُعدَّل بياناتهم و869 استجابة بشرية مؤهلة عبر القيم، والموضوعات المثيرة للجدل، والموجهات غير الموجهة.
- مجموعة [التاريخ الشفهي لـ NASA](https://www.nasa.gov/history/history-publications-and-resources/oral-histories/nasa-list/)، باستخدام إجابات لاحقة لاختبار الاستمرارية عبر المقابلات المهنية الطويلة.
- عينة مستبعدة للاختبار مكونة من مجموعة لغوية من 21 شخصًا من مجموعة نصوص مقابلات اللاجئين.

عبر PRISM، سجلت ملفات Minds الكاملة ما يقرب من **10 إلى 12 نقطة أعلى** من الهندسة التوجيهية العامة والديموغرافية. وفي العينة المستبعدة للاختبار الخاصة بالمجموعة اللغوية المستقلة، تحسن شرط Mind بمقدار **20.77 نقطة** مقارنة والاستجابات العامة بشكل عام.

## ماذا يعني هذا لأبحاث العملاء

تُعد النماذج التأسيسية العامة مفيدة للعصف الذهني وردود الفعل المعقولة. بينما صُممت Minds لمعيار مختلف: الحفاظ على مشاركين متميزين عبر تفاصيل الدراسة.

يجعل هذا Minds ذات أهمية خاصة للمقابلات الاستكشافية، واستجابات المفاهيم، واختبار الرسائل، واكتشاف الاعتراضات، وأبحاث لجان الشراء، والمتابعات القائمة على الشخصيات (Personas)، وتحويل أرشيف البحث الحالي إلى جمهور تفاعلي.

تغطي نتيجة النماذج المحددة مصادر المقابلات وإصدارات النماذج التي تم اختبارها. ويواصل Minds Research Lab توسيع التقييم المعياري عبر المجالات واللغات وأشكال الأسئلة، مع الحفاظ على المقارنة الأساسية راسخة في الإجابات البشرية الحقيقية.

للاطلاع على الأدلة الكمية، اقرأ [تقييمات استطلاعات الرأي الحقيقية](/research/survey-approximation-benchmarks-2026). وللاطلاع على البرنامج الكامل، اقرأ [التقييم المعياري لأبحاث Minds لعام 2026](/research/real-world-validation-benchmarks-2026).

## مصادر التقييم المعياري العامة

- [تفريغات مقابلات اللاجئين بجامعة يوتا](https://doi.org/10.6084/m9.figshare.29318549.v1)
- [تفريغات المقابلات الدولية لطب الأسنان بالليزر](https://doi.org/10.6084/m9.figshare.28456946.v1)
- [مجموعة بيانات المحاذاة PRISM](https://arxiv.org/abs/2404.16019)
- [التواريخ الشفهية لـ NASA](https://www.nasa.gov/history/history-publications-and-resources/oral-histories/nasa-list/)

## التوثيق المقترح

Minds Research Lab. “Minds vs GPT-5.4 and Claude Sonnet 5 on Real Interview Answers.” August 11, 2026. [https://getminds.ai/research/minds-vs-foundation-models-qualitative-2026](https://getminds.ai/research/minds-vs-foundation-models-qualitative-2026)
