---
title: "Kann KI eine echte Gen-Z-Ernährungsumfrage rekonstruieren? Minds erreichte eine Annäherung von 93.99%"
description: "Eine ergebnisblinde Validierung verglich 903 Antworten von 301 persistenten Gen-Z-Minds mit den veröffentlichten Verteilungen einer Umfrage der britischen Food Standards Agency. Die aggregierte Annäherung erreichte 93.99%."
canonical_url: "https://getminds.ai/research/de/synthetic-gen-z-food-survey-validation-2026"
last_updated: "2026-09-09T06:25:18.477Z"
---

# Kann KI eine echte Gen-Z-Ernährungsumfrage rekonstruieren? Minds erreichte eine Annäherung von 93.99%

Eine reale britische Umfrage fragte junge Menschen, wie oft sie auswärts essen oder Take-away-Essen zum Frühstück, Mittag- und Abendessen kaufen. Diese ergebnisblinde, angewandte Validierung stellte dieselben Fragen einer geschlossenen Zielgruppe von 301 Gen-Z-Minds und verglich die aggregierten Antwortverteilungen mit den veröffentlichten menschlichen Ergebnissen.

Das Hauptergebnis war eine **aggregierte Annäherung von 93.99% an die realen Umfrageverteilungen**. Über 21 Antwortoptionen hinweg betrug die durchschnittliche Abweichung **6.01 Prozentpunkte**. Alle 903 geplanten Antworten auf die Mind-Fragen wurden erfolgreich abgeschlossen.

Die Analyse bewertet die aggregierte Übereinstimmung der Verteilungen. Sie interpretiert das Ergebnis nicht als individuelle Vorhersagegenauigkeit oder als Beweis dafür, dass dieselbe Leistung für jede Zielgruppe und jeden Fragetyp gilt.

## Das Ergebnis im Überblick

<table>
<thead>
  <tr>
    <th>
      Validierungsergebnis
    </th>
    
    <th align="right">
      Wert
    </th>
    
    <th>
      Bedeutung
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      Annäherung an die reale Umfrage
    </td>
    
    <td align="right">
      <strong>
        93.99%
      </strong>
    </td>
    
    <td>
      100% minus der durchschnittlichen prozentualen Abweichung über 21 Antwortoptionen hinweg
    </td>
  </tr>
  
  <tr>
    <td>
      Durchschnittliche Abweichung zur realen Umfrage
    </td>
    
    <td align="right">
      <strong>
        6.01 pp
      </strong>
    </td>
    
    <td>
      Die durchschnittliche absolute Differenz zwischen den Prozentsätzen der Minds und der realen Umfrage
    </td>
  </tr>
  
  <tr>
    <td>
      Mittlere Verteilungsüberlappung
    </td>
    
    <td align="right">
      <strong>
        78.98%
      </strong>
    </td>
    
    <td>
      Wie stark sich die jeweiligen vollständigen Antwortverteilungen überschnitten
    </td>
  </tr>
  
  <tr>
    <td>
      Abgeschlossene Antworten
    </td>
    
    <td align="right">
      <strong>
        903 / 903
      </strong>
    </td>
    
    <td>
      Alle 301 Minds beantworteten alle drei Fragen
    </td>
  </tr>
  
  <tr>
    <td>
      Pearson-Korrelation
    </td>
    
    <td align="right">
      <strong>
        0.804
      </strong>
    </td>
    
    <td>
      Starke Übereinstimmung über die 21 realen und synthetischen Prozentsätze hinweg
    </td>
  </tr>
  
  <tr>
    <td>
      Spearman-Korrelation
    </td>
    
    <td align="right">
      <strong>
        0.834
      </strong>
    </td>
    
    <td>
      Starke Übereinstimmung in der Rangfolge der Antwortoptionen
    </td>
  </tr>
</tbody>
</table>

## Forschungsfrage und Referenzdaten

Die Mahlzeitenhäufigkeit hängt von Routine, Arbeit oder Studium, Budget, Bequemlichkeit, sozialem Kontext und lokaler Verfügbarkeit ab. Sie bietet daher einen praktischen Test dafür, ob eine synthetische Zielgruppe eine vollständige Verteilung von Konsumentenantworten reproduzieren kann, anstatt nur plausible qualitative Kommentare zu generieren.

Die Referenz stammt aus der Studie **Food and You 2, Wave 10** der britischen Food Standards Agency. Die Feldarbeit lief vom 9. Oktober 2024 bis zum 7. Februar 2025, und der öffentliche Datensatz wurde am 25. September 2025 veröffentlicht. Die Analyse nutzte die veröffentlichten Ergebnisse für Personen im Alter von 16 bis 24 Jahren, mit einer menschlichen Fallzahl von n=257 für jedes bewertete Item.

Die drei registrierten Fragen lauteten:

- Wie oft essen Sie auswärts oder kaufen Essen zum Mitnehmen zum Frühstück?
- Wie oft essen Sie auswärts oder kaufen Essen zum Mitnehmen zum Mittagessen?
- Wie oft essen Sie auswärts oder kaufen Essen zum Mitnehmen zum Abendessen?

Jede Frage hatte sieben registrierte Antwortoptionen. Die konfirmatorische Analyse verglich daher 21 synthetische und menschliche Prozentsätze.

## Die Zielgruppe: 301 persistente Gen-Z-Minds

Das synthetische Panel repräsentierte junge Menschen im Alter von 16 bis 24 Jahren in England, Wales und Nordirland. Die geschlossene Kohorte wies Variationen in Bezug auf Alter, Geschlecht, Land, Einkommen, Routinen und sozialen Kontext auf. Alle 301 Minds wurden ausgewählt, bevor die aktuellen Ergebnisse eingesehen wurden.

<study-composition>



</study-composition>

Hierbei handelte es sich um persistente Zielgruppenmitglieder und nicht um temporäre Charaktere, die für eine einzelne Frage generiert wurden. Das Panel basierte auf **20,500 Wissenselementen**, die durch **14,671 Retrieval-Chunks** repräsentiert wurden, was eine Wiederverwendung derselben synthetischen Kohorte über verschiedene Forschungsaufgaben hinweg ermöglicht.

## Studiendesign und Zielgrößen

Die Studie nutzte ein vorregistriertes Replikationsdesign mit derselben Kohorte:

1. Schließen der 301-köpfigen synthetischen Zielgruppe.
2. Stellen der originalen Umfragefragen mit den originalen Antwortoptionen.
3. Fernhalten der realen Umfrageprozentsätze von der Minds-Laufzeitumgebung.
4. Aggregieren aller 903 Mind-Antworten in drei vollständige Verteilungen.
5. Vergleichen jedes synthetischen Prozentsatzes der Antwortoptionen mit dem veröffentlichten menschlichen Ergebnis.

Anstatt Unsicherheit in eine einzige harte Entscheidung zu zwingen, stellten die Minds dar, wie wahrscheinlich es war, dass jedes Zielgruppenmitglied jede verfügbare Antwort wählt. Diese Wahrscheinlichkeiten wurden anschließend zur endgültigen Panelverteilung zusammengeführt.

<table>
<thead>
  <tr>
    <th>
      Designelement
    </th>
    
    <th>
      Registrierte Spezifikation
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      Synthetische Stichprobe
    </td>
    
    <td>
      301 persistente Minds im Alter von 16–24 Jahren
    </td>
  </tr>
  
  <tr>
    <td>
      Menschliche Referenz
    </td>
    
    <td>
      Veröffentlichte Food and You 2-Jugendverteilungen; Basis n=257 pro Frage
    </td>
  </tr>
  
  <tr>
    <td>
      Instrument
    </td>
    
    <td>
      3 Fragen zur Mahlzeitenhäufigkeit × 7 Optionen
    </td>
  </tr>
  
  <tr>
    <td>
      Geplante Antworten
    </td>
    
    <td>
      903 Antworten auf Mind-Fragen
    </td>
  </tr>
  
  <tr>
    <td>
      Primärer Endpunkt
    </td>
    
    <td>
      Ungewichtete mittlere absolute Abweichung in Prozentpunkten über 21 Zellen hinweg
    </td>
  </tr>
  
  <tr>
    <td>
      Sekundäre Endpunkte
    </td>
    
    <td>
      Verteilungsüberlappung, Jensen-Shannon-Divergenz, Pearson-r und Spearman-rho
    </td>
  </tr>
  
  <tr>
    <td>
      Ergebnis-Isolierung
    </td>
    
    <td>
      Menschliche Prozentsätze und Benchmark-Dateien von der Laufzeitumgebung vorenthalten
    </td>
  </tr>
</tbody>
</table>

Die prozentuale Annäherung ist definiert als `100% − mittlere absolute Abweichung in Prozentpunkten`. Die mittlere Verteilungsüberlappung ist `1 − Gesamtvariationsabstand`, gemittelt über die drei Fragen. Die Jensen-Shannon-Divergenz misst den Unterschied in der Verteilungsform in Bits, wobei Null identische Verteilungen anzeigt.

## Jede Frage lag über 91%

<research-figure :labels="["Frühstückshäufigkeit","Mittagessenshäufigkeit","Abendessenshäufigkeit"]" figure="synthetic-gen-z-food-survey-validation-2026" note="Berichtete Ergebnisse dieser Studie. Tabelle und Diskussion erläutern Geltungsbereich, Baselines und Unsicherheit." title="Durchschnittliche Abweichung zur Realität" unitLabel="Prozentpunkte · niedriger ist besser">



</research-figure>

<table>
<thead>
  <tr>
    <th>
      Frage
    </th>
    
    <th align="right">
      Annäherung an die reale Umfrage
    </th>
    
    <th align="right">
      Durchschnittliche Abweichung zur Realität
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      Frühstückshäufigkeit
    </td>
    
    <td align="right">
      <strong>
        97.02%
      </strong>
    </td>
    
    <td align="right">
      2.98 pp
    </td>
  </tr>
  
  <tr>
    <td>
      Mittagessenshäufigkeit
    </td>
    
    <td align="right">
      <strong>
        93.52%
      </strong>
    </td>
    
    <td align="right">
      6.48 pp
    </td>
  </tr>
  
  <tr>
    <td>
      Abendessenshäufigkeit
    </td>
    
    <td align="right">
      <strong>
        91.44%
      </strong>
    </td>
    
    <td align="right">
      8.56 pp
    </td>
  </tr>
  
  <tr>
    <td>
      <strong>
        Alle 21 Antwortoptionszellen
      </strong>
    </td>
    
    <td align="right">
      <strong>
        93.99%
      </strong>
    </td>
    
    <td align="right">
      <strong>
        6.01 pp
      </strong>
    </td>
  </tr>
</tbody>
</table>

Das Frühstück wies den geringsten Fehler auf Zellebene auf, während das Abendessen den höchsten aufwies. Das aggregierte Ergebnis wurde nicht von einer einzelnen Frage dominiert: Jede Frage erreichte eine Annäherung von mehr als 91% an ihre reale Umfrageverteilung.

## Sekundäre Verteilungsprüfungen

Da die mittlere absolute Abweichung allein die Verteilungsform nicht vollständig beschreibt, umfasste die Analyse vier ergänzende Prüfungen.

- **78.98% mittlere Verteilungsüberlappung:** Der Großteil der Antwortmasse lag bei den realen und synthetischen Ergebnissen an denselben Stellen.
- **0.0602 Jensen-Shannon-Divergenz:** Die Gesamtformen lagen nah beieinander; Null würde identische Verteilungen bedeuten.
- **0.804 Pearson-Korrelation:** Große und kleine Prozentsätze tendierten dazu, sich gleichläufig zu verhalten.
- **0.834 Spearman-Korrelation:** Die Antwortoptionen wurden nach ihrer Häufigkeit ähnlich eingestuft.

Alle vier Metriken weisen in dieselbe Richtung: Innerhalb dieses Instruments lagen die Verteilungen der Minds sowohl im absoluten Niveau als auch in der relativen Form nahe an der menschlichen Referenz. Die Korrelation wird als begleitendes Maß ausgewiesen und ersetzt nicht die Metriken zur Niveauabweichung.

## Vollständigkeit der Antworten und Fundierung

Jede der 903 akzeptierten Antworten wies eine Provenienz auf:

- **889 Antworten** nutzten abgerufenes Mind-Wissen;
- **14 Antworten** nutzten das intrinsische Profil des Minds;
- **0 Antworten** wurden als ungestützt markiert; und
- **301 von 301 Minds** schlossen jede Frage ab.

Diese Provenienzfelder belegen, dass der Durchlauf den persistenten Mind-Pfad und keine ungestützten Antworten nutzte. Sie beweisen für sich genommen nicht, dass jede abgerufene Erinnerung kausal notwendig für die endgültige Verteilung war.

## Praktische Interpretation

Innerhalb des getesteten Rahmens stützt das Ergebnis die Verwendung eines fundierten synthetischen Panels für schnelle, iterative Forschung wie:

- Testen von Kampagnenaussagen vor den Werbeausgaben;
- Vergleichen von Produkt- oder Verpackungskonzepten;
- Untersuchen, warum verschiedene Zielgruppensegmente unterschiedlich reagieren;
- Verfeinern von Umfragefragen vor der Feldarbeit; und
- Identifizieren der vielversprechendsten Richtungen für eine spätere menschliche Validierung.

Das Ergebnis stützt schnelle richtungsweisende und vergleichende Arbeiten. Risikoreiche Behauptungen, regulierte Entscheidungen, präzise Marktgrößenbestimmungen und Fragen außerhalb des validierten Rahmens erfordern möglicherweise weiterhin rekrutierte Befragte und ein entsprechendes menschliches Studiendesign.

## Rahmen und Einschränkungen

Dies war eine unabhängige Minds-Validierung unter Verwendung öffentlicher Daten von Food and You 2. Die Food Standards Agency hat die Referenzumfrage erstellt, die Minds-Studie jedoch weder gesponsert, unterstützt noch überprüft.

<table>
<thead>
  <tr>
    <th>
      Diese Studie stützt
    </th>
    
    <th>
      Diese Studie belegt nicht
    </th>
  </tr>
</thead>

<tbody>
  <tr>
    <td>
      Enge aggregierte Übereinstimmung bei drei britischen Verteilungen zur Mahlzeitenhäufigkeit von Jugendlichen
    </td>
    
    <td>
      Eine Vorhersagegenauigkeit von 93.99% auf individueller Ebene
    </td>
  </tr>
  
  <tr>
    <td>
      Vollständige produktive Ausführung für 301 Minds und 903 Antworten
    </td>
    
    <td>
      Universelle Leistung über Zielgruppen, Länder, Domänen oder Fragetypen hinweg
    </td>
  </tr>
  
  <tr>
    <td>
      Übereinstimmung über MAE-, Überlappungs-, Divergenz- und Korrelationsmetriken hinweg
    </td>
    
    <td>
      Kausalen Beweis dafür, dass die Fundierung allein die beobachtete Übereinstimmung hervorgerufen hat
    </td>
  </tr>
  
  <tr>
    <td>
      Ergebnis-Isolierung zur Laufzeit
    </td>
    
    <td>
      Vollständigen Ausschluss einer indirekten Exposition gegenüber einer öffentlichen Umfrage durch Vortraining oder den persistenten Wissenskorpus
    </td>
  </tr>
</tbody>
</table>

Dies ist eine Replikation mit derselben Kohorte und demselben Instrument, die drei eng miteinander verwandte Fragen aus einer Umfrage abdeckt. Die menschlichen und synthetischen Befragten wurden nicht individuell abgeglichen, und die Analyse vergleicht aggregierte Verteilungen. Für dieses öffentliche Ergebnis wurde kein Stichprobenunsicherheitsintervall aus den menschlichen Mikrodaten geschätzt. Eine weitere Validierung an disjunkten Zielgruppen und Instrumenten ist erforderlich, bevor eine breitere Genauigkeitsbehauptung aufgestellt werden kann.

## Quellen

- [Food and You 2 Survey: Wave 10 Datensatz](https://data.food.gov.uk/catalog/datasets/e5ac7f57-61d4-4e34-8d74-fe198ab5d858), Food Standards Agency, 2025.
- [Food and You 2: Wave 10 Forschungsbericht](https://www.food.gov.uk/research/food-and-you-2/food-and-you-2-wave-10), Food Standards Agency, 2025.
