هل يمكن للذكاء الاصطناعي إعادة إنشاء استطلاع حقيقي للأغذية خاص بالجيل Z؟ Minds تحقق تقريبًا بنسبة 93.99%
عبر ثلاثة أسئلة تتعلق بتكرار الوجبات و21 خلية لخيارات الإجابة، سجلت Minds متوسط خطأ قدره 6.01 نقطة مئوية، ووصلت إلى تداخل في التوزيع بنسبة 78.98%، وأكملت كل استجابة مخططة.
طرح استطلاع حقيقي في المملكة المتحدة سؤالاً على الشباب حول عدد المرات التي يتناولون فيها الطعام بالخارج أو يشترون وجبات جاهزة للفطور والغداء والعشاء. وقد طرحت عملية التحقق التطبيقية غير المعلومة النتائج مسبقًا هذه الأسئلة نفسها على جمهور مغلق مكون من 301 من Minds الممثلة للجيل Z، وقارنت توزيعات الاستجابة الإجمالية بالنتائج البشرية المنشورة.
وكانت النتيجة الرئيسية هي تقريب إجمالي بنسبة 93.99% لتوزيعات الاستطلاع الحقيقي. وعبر 21 خلية لخيارات الإجابة، بلغ متوسط الفجوة 6.01 نقطة مئوية. واكتملت بنجاح جميع استجابات أسئلة Mind المخطط لها والبالغ عددها 903 استجابة.
يقيم التحليل التوافق التوزيعي الإجمالي. ولا يعامل هذه النتيجة كدقة تنبؤ فردية أو كدليل على أن الأداء نفسه سينطبق على كل جمهور ونوع سؤال.
النتيجة في عرض واحد
| نتيجة التحقق | القيمة | ماذا تعني |
|---|---|---|
| التقريب للاستطلاع الحقيقي | 93.99% | 100% مطروحًا منها متوسط فجوة النقاط المئوية عبر 21 خلية لخيارات الإجابة |
| متوسط الفجوة مقارنة بالاستطلاع الحقيقي | 6.01 pp | متوسط الفرق المطلق بين النسب المئوية لـ Minds والاستطلاع الحقيقي |
| متوسط تداخل التوزيع | 78.98% | مقدار التداخل في كل توزيع كامل للإجابات |
| الاستجابات المكتملة | 903 / 903 | أجابت جميع الـ 301 Minds على الأسئلة الثلاثة بأكملها |
| ارتباط بيرسون | 0.804 | توافق قوي عبر الـ 21 نسبة مئوية الحقيقية والاصطناعية |
| ارتباط سبيرمان | 0.834 | توافق قوي في كيفية ترتيب خيارات الإجابة |
سؤال البحث والبيانات المرجعية
يعتمد تكرار الوجبات على الروتين، أو العمل أو الدراسة، والميزانية، والراحة، والسياق الاجتماعي، والتوافر المحلي. ولذلك، فإنه يوفر اختبارًا عمليًا لما إذا كان بإمكان الجمهور الاصطناعي إعادة إنتاج توزيع كامل لاستجابات المستهلكين بدلاً من مجرد إنتاج تعليقات نوعية تبدو معقولة.
جاء المرجع من دراسة Food and You 2، الموجة 10 التابعة لـ Food Standards Agency في المملكة المتحدة. وقد أُجري العمل الميداني في الفترة من 9 October 2024 إلى 7 February 2025، وصدرت مجموعة البيانات العامة في 25 September 2025. واستخدم التحليل النتائج المنشورة للأشخاص الذين تتراوح أعمارهم بين 16 و24 عامًا، مع قاعدة أسئلة بشرية تبلغ 257 لكل عنصر تم تقييمه.
وكانت الأسئلة الثلاثة المسجلة هي:
- كم مرة تتناول الطعام بالخارج أو تشتري طعامًا جاهزًا للفطور؟
- كم مرة تتناول الطعام بالخارج أو تشتري طعامًا جاهزًا للغداء؟
- كم مرة تتناول الطعام بالخارج أو تشتري طعامًا جاهزًا للعشاء؟
وكان لكل سؤال سبعة خيارات إجابة مسجلة. وبناءً على ذلك، قارن التحليل التأكيدي 21 نسبة مئوية اصطناعية وبشرية.
الجمهور: 301 من Minds المستمرة الممثلة للجيل Z
مثلت اللجنة الاصطناعية الشباب الذين تتراوح أعمارهم بين 16 و24 عامًا في إنجلترا وويلز وأيرلندا الشمالية. واحتوت المجموعة المغلقة على تنوع في العمر، والجنس، والدولة، والدخل، والروتين، والسياق الاجتماعي. وتم اختيار جميع الـ 301 Minds قبل فحص النتائج الحالية.
تكوين اللوحة
- 116–1829%
- 219–2137%
- 322–2434%
- 1إناث65%
- 2ذكور35%
- 1إنجلترا84%
- 2ويلز8%
- 3أيرلندا الشمالية8%
لقد كان هؤلاء أعضاء جمهور مستمرين وليسوا شخصيات مؤقتة تم إنشاؤها لسؤال واحد. وتم تأسيس اللجنة على 20,500 عنصر معرفي ممثلة بـ 14,671 جزءًا مسترجعًا، مما يسمح بإعادة استخدام المجموعة الاصطناعية نفسها عبر مهام بحثية متعددة.
تصميم الدراسة والتقديرات المستهدفة
استخدمت الدراسة تصميم تكرار مسجل مسبقًا للمجموعة نفسها:
- إغلاق الجمهور الاصطناعي المكون من 301 شخصًا.
- طرح أسئلة الاستطلاع الأصلية مع خيارات الإجابة الأصلية.
- حجب النسب المئوية للاستطلاع الحقيقي عن بيئة تشغيل Minds.
- تجميع كافة إجابات Mind البالغ عددها 903 في ثلاثة توزيعات كاملة.
- مقارنة كل نسبة مئوية لخيارات الإجابة الاصطناعية بالنتيجة البشرية المنشورة.
بدلاً من حصر عدم اليقين في تصويت حاسم واحد، مثلت Minds مدى احتمالية اختيار كل عضو في الجمهور لكل إجابة متاحة. ثم دُمجت هذه الاحتمالات في التوزيع النهائي للجنة.
| عنصر التصميم | المواصفات المسجلة |
|---|---|
| العينة الاصطناعية | 301 من Minds المستمرة للأعمار من 16 إلى 24 عامًا |
| المرجع البشري | توزيعات الشباب المنشورة في Food and You 2؛ القاعدة n=257 لكل سؤال |
| الأداة | 3 أسئلة حول تكرار الوجبات × 7 خيارات |
| الاستجابات المخططة | 903 استجابة لأسئلة Mind |
| نقطة النهاية الرئيسية | متوسط الخطأ المطلق غير الموزون بالنقاط المئوية عبر 21 خلية |
| نقاط النهاية الثانوية | تداخل التوزيع، وتباعد جينسن-شانون، وارتباط بيرسون r، وارتباط سبيرمان rho |
| عزل النتائج | حجب النسب المئوية البشرية وملفات المقارنة المرجعية عن بيئة التشغيل |
يُعرَّف التقريب المئوي بأنه 100% − متوسط الخطأ المطلق بالنقاط المئوية. ومتوسط تداخل التوزيع هو 1 − مسافة التباين الكلي كمتوسط عبر الأسئلة الثلاثة. ويقيس تباعد جينسن-شانون الاختلاف في شكل التوزيع بالبتات، حيث يشير الصفر إلى توزيعات متطابقة.
سجل كل سؤال نتيجة أعلى من 91
متوسط الفجوة مقارنة بالواقع
النتائج المبلغ عنها لهذه الدراسة. يوضح الجدول والنقاش نطاق الدراسة وخطوط المقارنة وعدم اليقين.
- تكرار الفطور2.98
- تكرار الغداء6.48
- تكرار العشاء8.56
| السؤال | التقريب للاستطلاع الحقيقي | متوسط الفجوة مقارنة بالواقع |
|---|---|---|
| تكرار الفطور | 97.02% | 2.98 pp |
| تكرار الغداء | 93.52% | 6.48 pp |
| تكرار العشاء | 91.44% | 8.56 pp |
| جميع خلايا خيارات الإجابة الـ 21 | 93.99% | 6.01 pp |
سجل الفطور أدنى معدل خطأ على مستوى الخلايا، بينما سجل العشاء الأعلى. ولم تكن النتيجة الإجمالية مدفوعة بسؤال واحد فقط: فقد حقق كل سؤال تقريبًا يزيد عن 91% مقارنة بتوزيع الاستطلاع الحقيقي الخاص به.
فحوصات التوزيع الثانوية
نظرًا لأن متوسط الخطأ المطلق وحده لا يصف شكل التوزيع بشكل كامل، فقد تضمن التحليل أربعة فحوصات تكميلية.
- متوسط تداخل التوزيع بنسبة 78.98%: ظهرت معظم كتلة الاستجابة في الأماكن نفسها في النتائج الحقيقية والاصطناعية.
- تباعد جينسن-شانون بقيمة 0.0602: كانت الأشكال العامة متقاربة؛ ويعني الصفر توزيعات متطابقة.
- ارتباط بيرسون بقيمة 0.804: مالت النسب المئوية الكبيرة والصغيرة إلى التحرك معًا.
- ارتباط سبيرمان بقيمة 0.834: تم ترتيب خيارات الإجابة بشكل مشابه حسب مدى انتشارها.
تشير المقاييس الأربعة جميعها إلى الاتجاه نفسه: ضمن هذه الأداة، كانت توزيعات Minds قريبة من المرجع البشري في كل من المستوى المطلق والشكل النسبي. ويتم الإبلاغ عن الارتباط كمقياس مصاحب ولا يحل محل مقاييس خطأ المستوى.
اكتمال الاستجابة والتأسيس المعرفي
حملت كل واحدة من الإجابات المقبولة البالغ عددها 903 مصدرًا وإثباتًا:
- استخدمت 889 إجابة معرفة مسترجعة من Mind؛
- استخدمت 14 إجابة الملف الشخصي الجوهري لـ Mind؛
- تم وضع علامة غير مدعومة على 0 إجابة؛ و
- أكملت 301 من أصل 301 من Minds كل سؤال.
تثبت حقول المصدر هذه أن عملية التشغيل استخدمت مسار Mind المستمر بدلاً من الإجابات غير المدعومة. وهي لا تثبت بمفردها أن كل ذاكرة مسترجعة كانت ضرورية سببيًا للتوزيع النهائي.
التفسير العملي
ضمن النطاق المختبر، تدعم النتيجة استخدام لجنة اصطناعية مؤسسة معرفيًا لإجراء أبحاث سريعة وتكرارية مثل:
- اختبار ادعاءات الحملات قبل الإنفاق الإعلامي؛
- مقارنة مفاهيم المنتجات أو التعبئة والتغليف؛
- استكشاف سبب تفاعل شرائح الجمهور المختلفة بشكل مختلف؛
- تحسين أسئلة الاستطلاع قبل العمل الميداني؛ و
- تحديد أقوى الاتجاهات للتحقق البشري اللاحق.
تدعم النتيجة العمل التوجيهي والمقارن السريع. ومع ذلك، فإن الادعاءات عالية المخاطر، والقرارات التنظيمية، وتحديد حجم السوق بدقة، والأسئلة الخارجة عن النطاق المعتمد قد تظل تتطلب مستجيبين مستقطبين وتصميم دراسة بشرية مناسبًا.
النطاق والقيود
كان هذا تحققًا مستقلًا لـ Minds باستخدام بيانات عامة من Food and You 2. وقد أنتجت Food Standards Agency الاستطلاع المرجعي ولكنها لم ترعَ دراسة Minds أو تؤيدها أو تراجعها.
| تدعم هذه الدراسة | لا تثبت هذه الدراسة |
|---|---|
| التوافق الإجمالي الوثيق في ثلاثة توزيعات لتكرار وجبات الشباب في المملكة المتحدة | دقة تنبؤ بنسبة 93.99% على المستوى الفردي |
| تنفيذ إنتاج كامل لـ 301 من Minds و903 استجابة | أداءً عالميًا عبر الجماهير أو البلدان أو المجالات أو أنواع الأسئلة |
| التوافق عبر مقاييس متوسط الخطأ المطلق (MAE)، والتداخل، والتباعد، والارتباط | دليل سببي على أن التأسيس المعرفي وحده هو الذي أنتج التوافق الملاحظ |
| عزل النتائج في بيئة التشغيل | الاستبعاد الكامل للتعرض غير المباشر لاستطلاع عام من خلال التدريب المسبق أو مجموعة المعرفة المستمرة |
هذا تكرار للمجموعة نفسها والأداة نفسها يغطي ثلاثة أسئلة وثيقة الصلة من استطلاع واحد. ولم يتم مطابقة المستجيبين البشريين والاصطناعيين بشكل فردي، ويقارن التحليل التوزيعات الإجمالية. ولم يتم تقدير أي فاصل زمني لعدم اليقين في أخذ العينات من البيانات البشرية الدقيقة لهذه النتيجة العامة. ويتطلب الأمر مزيدًا من التحقق على جماهير وأدوات منفصلة قبل تقديم ادعاء أوسع بالدقة.
المصادر
- Food and You 2 Survey: Wave 10 dataset، Food Standards Agency، 2025.
- Food and You 2: Wave 10 research report، Food Standards Agency، 2025.
الأسئلة الشائعة
ما مدى تطابق Minds مع استطلاع Food and You الحقيقي؟
عبر 21 نسبة مئوية لخيارات الإجابة، حققت Minds تقريبًا إجماليًا بنسبة 93.99% مقارنة بالاستطلاع الحقيقي. وبلغ متوسط الفجوة 6.01 نقطة مئوية، بينما بلغ متوسط تداخل التوزيع 78.98%.
هل يعني التقريب بنسبة 93.99% أن Minds تتوقع إجابة كل فرد بشكل صحيح؟
لا. يُحسب التقريب البالغ 93.99% بطرح متوسط فجوة النقاط المئوية عبر 21 خلية استطلاع إجمالية من 100%. وهو يقيس مدى تطابق توزيع الجمهور مع الاستطلاع الحقيقي، وليس ما إذا كان قد تم التنبؤ بكل إجابة فردية بشكل صحيح.
هل كان هؤلاء مستجيبين حقيقيين؟
لا. لقد كانوا 301 من أعضاء الجمهور الاصطناعيين المستمرين الذين تتراوح أعمارهم بين 16 و24 عامًا. وقورنت إجاباتهم الإجمالية بالنتائج المنشورة لاستطلاع حقيقي أجرته Food Standards Agency في المملكة المتحدة.
هل عُرضت نتائج الاستطلاع الحقيقي على Minds؟
لا. تم تكرار الأسئلة وخيارات الإجابة، ولكن تم حجب مجموعة البيانات المرجعية والنسب المئوية الحقيقية عن بيئة التشغيل. ونظرًا لأن المصدر عام، لا يمكن استبعاد التعرض غير المباشر بالكامل من خلال التدريب المسبق للنموذج أو مجموعة المعرفة المستمرة.
ما الذي يجعل هذا مختلفًا عن توجيه الأسئلة لذكاء اصطناعي عام 301 مرة؟
كانت Minds أعضاء جمهور مستمرين مستندين إلى 20,500 عنصر معرفي و14,671 جزءًا مسترجعًا. وفي عملية التشغيل هذه، استخدمت 889 من أصل 903 إجابة معرفة مسترجعة من Mind، واستخدمت 14 إجابة الملف الشخصي الجوهري، ولم تكن هناك أي إجابة غير مدعومة.


