Chronos Briefing
LIVE SYSTEM
--:--:--
Zurueck
Codebooks steigern Übereinstimmung von Sprachmodellen mit menschlichen Annotatoren
AI GENERATED 04.08.2026 23:00 Wissenschaft und Forschung

Codebooks steigern Übereinstimmung von Sprachmodellen mit menschlichen Annotatoren

Eine aktuelle Studie untersucht, wie Codebooks – ursprünglich für menschliche Annotatoren entwickelt – als Prompt‑Instruktionen für große Sprachmodelle (LLM) eingesetzt werden können. Die Untersuchung zeigt, dass die Nutzung…

Eine aktuelle Studie untersucht, wie Codebooks – ursprünglich für menschliche Annotatoren entwickelt – als Prompt‑Instruktionen für große Sprachmodelle (LLM) eingesetzt werden können. Die Untersuchung zeigt, dass die Nutzung von Codebooks zu einer Übereinstimmung von 82 % bis 88 % mit menschlichen Annotatoren führt, wobei verschiedene Aufgaben und Modelltypen berücksichtigt wurden.

Hintergrund und Zielsetzung

Nach Angaben des Artikels von Can Çelebi und Stefan P. Penczynski wurden drei Codebooks aus der experimentellen Ökonomie herangezogen: eines zur Klassifikation von Versprechen und zwei zur Klassifikation strategischen Denkens. Ziel war es, zu prüfen, inwieweit die Informationsmenge, Formatierung, Framing und Wortwahl der Prompt‑Instruktionen die Leistungsfähigkeit von LLMs beeinflussen.

Methodik

Die Forschenden variierten das Informationsniveau der Prompt‑Instruktionen (niedrig bis hoch) und kombinierten diese mit unterschiedlichen Formatierungen, Framings und Formulierungen. Vier Modelle kamen zum Einsatz: zwei proprietäre und zwei Open‑Weight‑Modelle. Die drei Aufgaben umfassten die Erkennung von Versprechen (recognition‑heavy) sowie zwei Aufgaben zur Klassifikation strategischen Denkens (learning‑heavy).

Ergebnisse

Die Codebooks erzielten in allen drei Aufgaben eine Übereinstimmung von 82 % bis 88 % mit menschlichen Annotatoren. Bei der Versprechen‑Klassifikation erklärte die Wahl des Modells den größten Teil der Genauigkeitsvariation. Bei den strategischen Denkaufgaben hatte das Detailniveau der Instruktionen einen vergleichbaren Einfluss wie die Modellwahl.

Einfluss von Modellgröße

Größere Modelle nutzten zusätzliche Informationen effizienter und zeigten höhere Robustheit gegenüber Änderungen in Formatierung, Framing und Wortwahl. Kleinere Modelle hingegen konnten durch zusätzliche Informationen beeinträchtigt werden und reagierten sensibler auf die Art der Präsentation.

Implikationen für Prompt‑Design

Die Ergebnisse legen nahe, dass der Fokus von reinen Prompt‑Engineering‑Techniken (z. B. Formatierung, Framing, Reasoning) auf den Inhalt der Prompt‑Instruktionen verlagert werden sollte. Die Vorbereitung von Anweisungen analog zu menschlichen Codebooks – mit detailliertem Kontext, klaren Kategoriedefinitionen und Beispielen – erhöht die Leistungsfähigkeit von LLMs.

Fazit

Die Studie demonstriert, dass gut strukturierte Codebooks als Prompt‑Instruktionen die Übereinstimmung von Sprachmodellen mit menschlichen Annotatoren signifikant steigern. Zukünftige Forschungen könnten die Übertragbarkeit auf weitere Aufgabenbereiche und Modellarchitekturen prüfen.

Dieser Bericht basiert auf Informationen von PLOS ONE, lizenziert unter Creative Commons BY 4.0 (Open Access). Wissenschaftliche Inhalte, offen zugänglich.
[Lizenzangabe]: ‚Creative Commons BY 4.0 (Open Access)‘
[Zusatz]: ‚ Wissenschaftliche Inhalte, offen zugänglich.‘

Ende der Uebertragung

Quellenverzeichnis & Rechtliches

Die Berichterstattung von VisionGaia News basiert auf oeffentlich zugaenglichen Informationen.

Bezugsquellen

  • Open Sources

Lizenzen

  • CC / Public Records

Lizenzprotokolle

Creative Commons BY-SA 4.0

Redaktionelle Eigeninhalte von VisionGaia News stehen unter der
Creative Commons Attribution-ShareAlike 4.0 International.

Datenherkunft: Frei zugängliche, rechtlich zulässige Quellen.
Verarbeitung: KI-gestützte Synthese mit redaktioneller Prüfung.


Quellenverzeichnis & Rechtliches

Die Berichterstattung von VisionGaia News basiert auf öffentlich zugänglichen Informationen aus staatlichen, institutionellen und offen lizenzierten Quellen.

Bezugsquellen

  • Deutsche Bundesbehörden
  • EU Institutionen
  • UK & US Government
  • Russian Government
  • UN, WHO, Weltbank
  • Open-Content (Wikinews)
  • Open-Content Networks
  • Wissenschaftliche Fachportale

Lizenzen

  • § 5 UrhG (Amtliche Werke)
  • CC BY 4.0 / CC BY-SA 4.0
  • Creative Commons BY (Open-Content-Projekte)
  • Creative Commons BY 4.0 (Wissenschaftliche Artikel)
  • Open Parliament Licence v3.0
  • Open Government Licence v3.0
  • Public Domain (US)
  • Staatliche Dokumente etc. ohne Copyright (RU)
  • Creative Commons BY 4.0 (RU)
Establishing Uplink...