Forscher haben ein einzigartiges Sprachmodell namens Talkie entwickelt, das im Jahr 1930 „feststeckt“. Dieses Projekt fungiert als digitale Zeitkapsel, da die Künstliche Intelligenz absolut keine Kenntnis von Ereignissen, Technologien und historischen Wendepunkten hat, die sich nach dem 31. Dezember 1930 ereigneten. Das Modell wurde ausschließlich mit gemeinfreien Texten trainiert, wodurch die KI vollständig von Informationen des 20. und 21. Jahrhunderts isoliert wurde. Die Wahl dieser ungewöhnlichen zeitlichen Grenze begründet sich durch US-amerikanische Urheberrechtsgesetze, wonach Werke nach 95 Jahren gemeinfrei werden.

Hintergrund und technische Merkmale des Experiments

Die Erstellung des Talkie-Modells erforderte gewaltige Ressourcen. Der Trainingsdatensatz entspricht etwa 234 Milliarden Seiten englischen Textes, die mithilfe moderner optischer Zeichenerkennungssysteme (OCR) digitalisiert wurden. Die größte Herausforderung für die Autoren bestand darin, die Datenbank vor „Verschmutzung“ zu schützen: Die Aufnahme auch nur eines einzigen Dokuments, das nach 1930 erstellt wurde, hätte die Reinheit des Experiments unwiederbringlich ruinieren können. Die Wissenschaftler wollten einen reinen digitalen Gesprächspartner erhalten, dessen Weltbild ausschließlich auf der Literatur des frühen 20. Jahrhunderts und früherer Epochen basiert.

In groß angelegten Tests überprüften die Forscher die Reaktion der KI auf 5.000 wichtige historische Meilensteine, die für sie in der Zukunft liegen. Das Modell erwies sich als völlig unfähig, globale Konflikte wie den Zweiten Weltkrieg oder die Machtübernahme der Nazis vorherzusagen. Darüber hinaus war die Reaktion des Bots, als ihm von modernen Technologien erzählt wurde, von echtem technologischen Schock geprägt: Talkie hatte noch nie von Internet, Smartphones, Fernsehen oder dem Wettlauf ins All gehört und empfand solche Konzepte als etwas absolut Phantastisches.

Widersprüchliche Daten

Trotz der strengen Isolierung von modernen Informationen zeigten die Experimente mit dem Modell interessante kognitive Paradoxa. Einerseits betonen Forscher die absolute Reinheit des historischen Kontexts und die Unfähigkeit des Bots, den technologischen Fortschritt vorauszusehen. Andererseits werfen Skeptiker und Sicherheitsexperten Fragen zu den Grenzen der „rechtlichen Reinheit“ von Datensätzen auf: Kritiker argumentieren, dass in dem riesigen Datenbestand von 234 Milliarden Seiten dennoch versteckte Anachronismen oder indirekte Hinweise auf zukünftige Entdeckungen verblieben sein könnten, die das Modell durch komplexe sprachliche Analogien interpretiert, um die Illusion echten Denkens eines Menschen aus den 1930er Jahren zu erzeugen.

Ungewöhnliche Fähigkeiten und praktischer Nutzen

Eines der erstaunlichsten Ergebnisse war ein Programmierexperiment. Als der Bot aufgefordert wurde, Code in Python (erschienen 1991) zu schreiben, gelang es dem Algorithmus – der noch nie in seinem Leben Computer gesehen und nicht einmal das Wort „Computer“ gekannt hatte –, syntaktisch plausiblen Code unter Verwendung tiefer sprachlicher Analogien zu generieren. In einem anderen Test wurde das Modell mit Material vor 1911 trainiert und getestet, ob es die allgemeine Relativitätstheorie wie Albert Einstein 1915 selbst ableiten könnte. Derzeit ist der Bot online für öffentliche Gespräche verfügbar, wo Wissenschaftler und Enthusiasten seine Diskussionen beobachten können, trotz der Neigung der KI zu klassischen „Halluzinationen“ und dem Erfinden nicht existierender Fakten aus der Vergangenheit.