# Ein synthetisches Kodierbeispiel: fehlende Elternnachricht

**Vollständig synthetisch.** Keine Privatdaten, keine echte Archivlektüre, keine Studie und keine Kundenlieferung. Diese Darstellung und die [JSON-Fassung](f11_kodierbeispiel.json) zeigen denselben einzigen Fall.

## Vorhandene Nachricht

| Feld | Wert |
|---|---|
| Sitzungslabel | `S2` |
| Nachrichtenkennung | `a2` |
| Elternbezug | `missing_u2` |
| Rollenlabel | `assistant` |
| Erzeugendes Modell | `null` – nicht belegt |
| Modellversion | `null` – nicht belegt |
| Originaldatum | `null` – nicht überliefert |
| Exportdatum | `null` – nicht überliefert |
| Datum dieser Auswertung | 7. September 2026 |

Unveränderter Wortlaut der vorhandenen Antwort:

> Die Öffnungszeit bleibt unbekannt.

Die referenzierte Elternnachricht `missing_u2` ist nicht vorhanden. Ihr Wortlaut wird nicht ergänzt; ihre Wortzahl bleibt `null`. Das Rollenlabel `assistant` ist keine nachgewiesene Modell- oder Personenidentität.

## Kodierung

**Regel für diesen Fall:** Eine kontextabhängige Einzelschritt-Kodierung verlangt die vorhandene zugehörige Nutzernachricht.

**Entscheidung:** `exclude_missing_parent` – `a2` wird aus dieser Kodierung ausgeschlossen. Die vorhandene Antwort bleibt im Bestandsnachweis erhalten. Ein vollständiges Paar kann nicht gebildet werden; seine Wortzahl bleibt unbekannt. Der Wahrheitsgehalt der Antwort wurde nicht beurteilt.

Modell und Version bleiben `null`. Eine Gruppenzuordnung oder ein Vergleich zweier Modellversionen ist mit diesem Beispiel nicht belegt. Das ist eine Aussage über diesen Ausschnitt.

## Zähler nur für diesen Fall

| Größe | Anzahl |
|---|---:|
| Vorhandene Sitzungslabels | 1 |
| Tatsächlich vorhandene Nachrichten | 1 |
| Nachrichten mit Rollenlabel assistant | 1 |
| Nachrichten mit Rollenlabel user | 0 |
| Antwortkandidaten | 1 |
| Nicht auflösbare Elternbezüge | 1 |
| Vollständige Kontexte nach der festgelegten Regel | 0 |
| Unvollständige Kontexte nach der festgelegten Regel | 1 |
| Einbezogene Nutzer-Antwort-Paare | 0 |
| Ausgeschlossene Antworten | 1 |
| Wörter im vorhandenen Nachrichtentext | 4 |
| Wörter in eindeutigen einbezogenen Nachrichten | 0 |
| Wortsumme einbezogener Paare | 0 |
| Durch Herkunftswerte belegte Modellgruppen | 0 |

Wörter werden mit der Unicode-Regel `\b\w+\b` im vorhandenen Text gezählt; Satzzeichen zählen nicht. Null einbezogene Paare ergeben null Wörter in dieser Teilmenge. Das ist **keine** Wortzahl für den fehlenden Elterntext: dessen Wortzahl sowie die Wortzahl des unvollständigen Kandidatenpaars bleiben `null`. Zahlen anderer Sitzungen sind nicht enthalten.

Die Kontextregel gilt nur für dieses Beispiel. Für mehrstufige Dialoge sowie System- und Werkzeugnachrichten müsste der benötigte Kontext gesondert festgelegt werden.

## Quelle und Bearbeitung

Aus einer redaktionell geprüften synthetischen Dialogprobe wurden ausschließlich `a2`, der Elternbezug, das Sitzungslabel, das Rollenlabel und die vorhandenen Modellfelder übernommen. Der Antworttext blieb unverändert. Zähler wurden für diesen Ausschnitt neu berechnet; unbekannte Original- und Exportdaten wurden nicht ergänzt.

Die [OASST1-Datensatzkarte](https://huggingface.co/datasets/OpenAssistant/oasst1) beschreibt Elternbezüge und Rollen; ihr Nachrichtenbeispiel enthält ein gefülltes `model_name`-Feld. Gelesen am 7. September 2026: „Dataset Structure“, „JSON Example: Message“ und „Using the Huggingface Datasets“. Das Herkunftsfeld existiert. Ob es Modellgruppen trägt, hängt von den tatsächlich belegten Werten des jeweiligen Exports ab. Das vorliegende Beispiel verwendet eine eigene kompakte Feldstruktur und ist keine OASST1-Datenzeile oder als OASST1 gültig geprüfte Exportdatei.

Ein Hash würde nur beim Vergleich konkreter Dateiinhalte helfen; daraus folgt allein keine Veröffentlichungs- oder Zeitpriorität.

[Leere Markdown-Vorlage](f11_archivvorlage.md) · [Leere JSON-Vorlage](f11_archivvorlage.json) · [Paketnotiz](f11_liesmich.md)

