Skip to main content

LLM-Regulierung als Frage der Meinungsfreiheit?

Was wäre, wenn die Regulierung von Large Language Models plötzlich nicht mehr nur Technologiepolitik wäre, sondern ein Fall für die Meinungsfreiheit? Dann würde aus einer Debatte über Sicherheit, Haftung und Kontrolle sehr schnell eine Debatte über Grundrechte. Genau hier setzt das Paper von Eugene Volokh, Mark A. Lemley und Peter Henderson an. Die Autoren argumentieren, dass der Output generativer KI rechtlich als geschützte Rede verstanden werden könnte. Nicht unbedingt, weil die KI selbst Rechte hat, sondern weil ihre Entwickler:innen und vor allem ihre Nutzer:innen Rechte haben, Informationen zu empfangen und mit Hilfe der Systeme selbst zu kommunizieren. Für die USA ist das ein starker Gedanke. Für Deutschland ist er interessant, aber deutlich weniger belastbar. Was ist das ökonomische Grundproblem? Im Kern geht es um die Kontrolle von Informationsproduktion. Staaten wollen Risiken von LLMs begrenzen: Desinformation, Manipulation, Diskriminierung oder gefährliche Inhalte....

ChatGPT als Messinstrument: Die Software GABRIEL

In der empirischen Forschung gibt es ein klassisches Problem: Die meisten interessanten Daten sind qualitativ, nicht quantitativ. 

Reden von Politikern, Geschäftsberichte, Social-Media-Posts, Zeitungsartikel oder historische Dokumente enthalten wertvolle Informationen, aber sie lassen sich schwer in Zahlen übersetzen. Genau hier setzt ein neues Forschungsprojekt an, das im Februar 2026 als NBER Working Paper erschienen ist: „GPT as a Measurement Tool“ von Hemanth Asirvatham, Elliott Mokski und Andrei Shleifer. Die Autoren stellen darin eine Software vor, die dieses Problem lösen soll: GABRIEL.

Die Grundidee ist überraschend einfach. Large Language Models wie GPT können Texte verstehen, ähnlich wie ein Mensch. Wenn man sie gezielt einsetzt, können sie daher qualitative Informationen systematisch bewerten und quantifizieren.

Zum Beispiel:

Wie innovationsfreundlich ist eine politische Rede?

Wie toxisch ist ein Social-Media-Kommentar?

Wie technisch komplex ist eine neue Technologie?

Das Ziel: aus Textdaten messbare Variablen erzeugen, die anschließend in ökonometrischen Analysen verwendet werden können.

GABRIEL ist eine Python-Bibliothek, die GPT automatisiert für solche Messaufgaben einsetzt. Technisch handelt es sich um einen Wrapper um die GPT-API, der typische Forschungsschritte automatisiert. Die wichtigsten Funktionen sind:

filter – große Datensätze nach relevanten Einträgen durchsuchen

classify – Texte oder Objekte kategorisieren

extract – strukturierte Informationen aus Text extrahieren

rate – qualitative Eigenschaften bewerten

deduplicate – ähnliche Einträge zusammenführen

Die Autoren vergleichen GABRIEL mit Statistiksoftware wie Stata: Es macht nichts grundsätzlich Neues möglich, aber es macht die Methode skalierbar, reproduzierbar und einfach nutzbar. Die Autoren stellen ihre Software frei zur Verfügung, hier ist ein Tutorial. Damit kann jeder Forscher GPT als skalierbares Messinstrument in empirischen Studien einsetzen.

Um zu zeigen, was möglich ist, bauen die Autoren mit GABRIEL einen neuen Datensatz zur Geschichte technologischer Innovation. Der Workflow beginnt mit etwa 18 Millionen Wikipedia-Artikeln. Daraus extrahiert die Software Schritt für Schritt alle relevanten Technologien:

1. Filterung möglicher Technologien

2. Entfernen von Duplikaten

3. Klassifikation der Technologien

4. Extraktion von Eigenschaften und Daten

5. Bewertung technologischer Merkmale

Am Ende entsteht ein Datensatz mit etwa 25.000 Technologien seit der Industrialisierung.

Das ermöglicht eine Erkenntnis: Die Zeit zwischen Erfindung und breiter Nutzung ist dramatisch gesunken von etwa 50 Jahren im 19. Jahrhundert auf nur noch etwa 5 Jahre heute.

Meine Meinung: Die Software wird die Arbeit in Wirtschaftswissenschaften stark verändern. Die meisten unserer Daten sind eigentlich Textdaten: politische Reden, Unternehmensberichte, Medienartikel, Gesetzestexte, Interviews, historische Dokumente. Bisher mussten diese Daten entweder manuell codiert werden oder sie blieben weitgehend ungenutzt. LLMs könnten dieses Problem lösen. Sie machen qualitative Informationen erstmals systematisch messbar.

Das Paper zeigt eine wichtige Entwicklung, KI ist nicht nur ein Werkzeug zur Textgenerierung. Sie kann auch ein neues Instrument der empirischen Messung werden. Wenn sich dieser Ansatz etabliert, könnte er ähnlich einflussreich wie Text Mining, Natural Language Processing, oder Machine Learning in der Ökonomie werden. Die nächste große Datenquelle der Wirtschaftswissenschaften ist vielleicht nicht eine neue Datenbank,  sondern die intelligente Auswertung von Texten.


Comments

Popular posts from this blog

Links, bunt gemischt, 12.4.18

Links, unsortiert, zu verschiedenen Themen Offizielle Privilegien für Polizeigewerkschafter in New York , es gibt tatsächlich Raus-Aus-Dem-Gefängnis-Karten. Ökonomie der Kunstgalerie , wie kommen die Preise von Gemälden zustande. Oder gibt es gar eine einfache Formel  für die Preisfestsetzung? Ökonometriker haben sich auch darüber Gedanken gemacht. William Greene hat den Preis in Beziehung zur Größe des Gemäldes durch eine einfache Regression und eine  multiple Regression  gesetzt.  Washington Post zur  The truth about medical bankruptcies  in den USA. In Europa kennen wir das Phänomen nicht, weil wir alle krankenversichert sind. Meinung zur Strategie der EU über die Regulierung der KI Meine geschätzte Kollegin Mechthild Schrooten zum Verkauf der NordLB

Gründungswochenende @HSB

  Ich hatte vor kurzem die Gelegenheit am Gründungswochenende@HSB als Coach teilzunehmen. Ich bin immer noch begeistert vom Team bei FreiRAUM@HSB. Einerseits die absolut professionelle Organisation und das Matchen unterschiedlicher Charaktere sowohl bei den Studierenden als auch bei den Coaches.  Meine Aufgabe als Coach war es, bei zwei interessanten Projekten kritische Fragen zu stellen. Das erste Projekt hatte eine Lösung von Problemen im öffentlichen Nahverkehr für die Menschen mit Mobilitätsbehinderung spezialisiert. Damit waren nicht nur die Menschen gemeint, die auf einen Rollstuhl angewiesen waren, sondern auch beispielsweise ältere Personen, für die die Stufe zum Einstieg in den Bus eine Herausforderung darstellte. Es war eine technische Idee mit einem Luftkissen. Ich hatte das Gefühl, dass die (jungen) Studierenden sich sehr viel Gedanken über das Produkt gemacht haben, aber noch nicht über die Marktstruktur im öffentlichen Nahverkehr in Deutschland.  Das zw...

KI, Chatbots, ChatGPT: Wie ist die Zukunft des Lernens?

Ich bin heute Abend Gastredner im Rotary-Club Bremen Bürgerweide und werde über die aktuellen Entwicklung von LLMs, insbesondere ChatGPT, berichten.  Mein persönlicher Fokus ist der Einsatz von ChatGPT in der Bildung: Wie können wir KI im Studium so einsetzen, dass das breite Spektrum der Studierenden davon profitiert? Ich bin sehr auf die Diskussion gespannt!