Ein Sprachmodell antwortet auf dieselbe Frage heute anders als gestern. Es formuliert neu, setzt andere Schwerpunkte, macht manchmal Fehler, korrigiert sich, improvisiert scheinbar. Wer nur die Oberfläche sieht, könnte denken: Hier geschieht etwas Freies.
Doch dieser Eindruck täuscht. Die eigentliche Frage ist nicht, ob KI frei ist. Die bessere Frage lautet: Warum kann ein System, das aus Rechenoperationen besteht, so schwer vorhersagbar sein?
Damit führt KI direkt in eines der ältesten Probleme der Philosophie: den Determinismus. Wenn alles eine Ursache hat, ist dann auch jede Entscheidung festgelegt? Und wenn ein künstliches neuronales Netz nur eine mathematische Funktion berechnet, warum bekommen wir dann nicht immer dieselbe Antwort?
Begriffskasten: Determinismus
Determinismus ist die Auffassung, dass jeder Zustand der Welt durch vorherige Zustände und Naturgesetze festgelegt ist. Wenn man alle Ursachen vollständig kennen würde, wäre auch die Zukunft vollständig bestimmt. Das heißt aber nicht automatisch, dass die Zukunft für uns praktisch vorhersagbar ist.
Der klassische Determinismus wird oft mit Pierre-Simon Laplace verbunden. Er stellte sich einen Geist vor, der zu einem Zeitpunkt alle Kräfte und Positionen aller Dinge kennt. Für diesen Geist, schreibt Laplace, wäre „nothing would be uncertain“: Nichts wäre ungewiss. Quelle: Laplace, A Philosophical Essay on Probabilities.
Das ist die berühmte Idee des Laplaceschen Dämons: perfekte Kenntnis der Gegenwart würde perfekte Kenntnis der Zukunft ermöglichen.
Begriffskasten: Laplacescher Dämon
Der Laplacesche Dämon ist ein Gedankenexperiment. Es beschreibt eine Intelligenz, die alle Naturgesetze und alle aktuellen Zustände kennt. Für sie wären Vergangenheit und Zukunft vollständig berechenbar. Der Punkt ist nicht, dass so ein Wesen existiert, sondern dass Determinismus und Vorhersagbarkeit auseinanderfallen können.
Spinoza formulierte denselben Verdacht gegen die menschliche Freiheit noch radikaler. Menschen glauben, frei zu sein, weil sie ihre Wünsche und Handlungen bemerken, aber die Ursachen dieser Wünsche nicht kennen. In seiner Ethik heißt es sinngemäß: Wir sind uns unserer Handlungen bewusst, aber nicht der Ursachen, durch die sie bestimmt werden. Quelle: Spinoza, Ethics.
Das ist für KI erstaunlich aktuell. Auch bei einem Sprachmodell sehen wir die Ausgabe. Wir sehen nicht sofort die vielen Ursachen: Trainingsdaten, Modellarchitektur, Gewichte, Prompt, Systemanweisung, Sampling-Verfahren, Hardware, Modellversion, Sicherheitsfilter und angeschlossene Werkzeuge.
Begriffskasten: Kausalität
Kausalität meint Ursache-Wirkungs-Beziehungen. Wenn A B verursacht, ist B nicht bloß nach A passiert, sondern durch A zustande gekommen. In der KI ist Kausalität schwierig, weil Modelle oft starke Muster erkennen, ohne echte Ursachen zu verstehen.
Ein künstliches neuronales Netz ist zunächst keine mystische Maschine. Es ist ein mathematisches System. Es nimmt Zahlen als Eingabe, verarbeitet sie durch Schichten von Gewichtungen und Funktionen, und erzeugt Zahlen als Ausgabe.
Wenn Architektur, Gewichte, Eingabe und Rechenumgebung exakt gleich bleiben, kann ein Netz im engen Sinn deterministisch arbeiten. Dieselbe Eingabe führt dann zur selben Ausgabe.
Begriffskasten: Künstliches neuronales Netz
Ein künstliches neuronales Netz, kurz ANN, ist ein Modell aus vielen verbundenen Recheneinheiten. Es lernt nicht durch explizite Regeln, sondern durch Anpassung von Gewichten. Diese Gewichte bestimmen, wie stark bestimmte Signale weitergegeben werden.
Aber moderne KI besteht nicht nur aus diesem engen Funktionskern. Schon beim Training entstehen viele Quellen von Varianz. Die Anfangswerte der Gewichte werden oft zufällig gesetzt. Daten werden in wechselnder Reihenfolge verarbeitet. Optimierungsverfahren wie stochastischer Gradientenabstieg arbeiten mit Ausschnitten der Daten. Manche Techniken wie Dropout bauen Zufall sogar absichtlich ein, damit das Modell robuster wird.
Begriffskasten: Training
Training ist der Prozess, in dem ein Modell seine Gewichte an Daten anpasst. Es bekommt Beispiele, macht Vorhersagen, misst Fehler und verändert seine internen Parameter. Das Ziel ist nicht Auswendiglernen, sondern ein Muster, das auch bei neuen Eingaben funktioniert.
Hinzu kommt die Hardware. Auf GPUs laufen viele Rechenoperationen parallel. Kleine Unterschiede in der Reihenfolge können bei Fließkommazahlen zu leicht anderen Ergebnissen führen. PyTorch dokumentiert deshalb ausdrücklich, dass vollständige Reproduzierbarkeit nicht über alle Plattformen, Releases und CPU/GPU-Ausführungen hinweg garantiert ist. Quelle: PyTorch Reproducibility.
Begriffskasten: Reproduzierbarkeit
Reproduzierbarkeit bedeutet, dass ein Experiment oder eine Berechnung bei gleichen Bedingungen erneut dasselbe Ergebnis liefert. In der KI ist das schwer, weil Daten, Zufallszahlen, Hardware, Bibliotheken und Modellversionen alle Einfluss haben können.
Das ist der erste wichtige Punkt: Ein neuronales Netz kann theoretisch deterministisch sein, ohne dass das gesamte KI-System praktisch reproduzierbar ist.
Ein Large Language Model erzeugt Text nicht wie eine Datenbank, die einen gespeicherten Satz abruft. Es berechnet für den nächsten Token eine Wahrscheinlichkeitsverteilung. Dann wird entschieden, welcher Token als nächstes erscheint. Danach wiederholt sich der Vorgang.
Begriffskasten: Large Language Model
Ein Large Language Model, kurz LLM, ist ein großes Sprachmodell. Es wurde auf sehr vielen Texten trainiert und erzeugt Sprache, indem es Token für Token fortsetzt. Es „weiß“ nicht wie ein Mensch, sondern berechnet plausible Fortsetzungen aus gelernten Mustern.
Ein Token ist dabei nicht unbedingt ein Wort. Es kann ein Wort, ein Wortteil, ein Satzzeichen oder ein anderes Textstück sein. Aus „Determinismus“ können je nach Tokenizer mehrere Einheiten werden.
Begriffskasten: Token
Ein Token ist die kleinste Verarbeitungseinheit eines Sprachmodells. Modelle lesen und schreiben nicht direkt Wörter, sondern Token. Deshalb kann eine minimale Änderung im Prompt die interne Verarbeitung verändern.
Bei der Ausgabe gibt es verschiedene Decoding-Strategien. Greedy Decoding nimmt immer den wahrscheinlichsten nächsten Token. Sampling wählt aus einer Verteilung aus. Parameter wie Temperature steuern, wie stark das Modell zwischen möglichen Fortsetzungen variiert. Hugging Face beschreibt Greedy Search als Strategie, die jeweils den wahrscheinlichsten nächsten Token auswählt, während Sampling zufällig aus der Verteilung auswählt. Quelle: Hugging Face Generation Strategies.
Begriffskasten: Decoding
Decoding ist das Verfahren, mit dem ein Sprachmodell aus Wahrscheinlichkeiten konkrete Tokens auswählt. Je nach Strategie entstehen nüchterne, wiederholbare, kreative oder überraschende Antworten.
Begriffskasten: Temperature
Temperature ist ein Parameter, der die Zufälligkeit der Ausgabe beeinflusst. Niedrige Werte machen Antworten stabiler und konservativer. Höhere Werte erhöhen Vielfalt, aber auch die Wahrscheinlichkeit unerwarteter oder falscher Ausgaben.
Deshalb kann man ein LLM näher an deterministisches Verhalten bringen. Man setzt etwa temperature = 0, fixiert Parameter, nutzt feste Prompts und vermeidet Sampling. OpenAI erklärt, dass bei Temperature-Werten über 0 unterschiedliche Ausgaben erwartbar sind und für konsistentere Ergebnisse temperature = 0 verwendet werden soll. Quelle: OpenAI Help Center.
Aber das löst nicht alles. Schon ein anderes Modell, eine kleine Prompt-Änderung, eine neue Systemanweisung, ein anderer Kontext oder ein Update im Anbieter-System kann die Ausgabe verändern. Bei Agenten kommen weitere Faktoren hinzu: Suchergebnisse, externe APIs, Dateistände, Datenbanken, Zeitpunkte und Tool-Fehler.
Begriffskasten: KI-Agent
Ein KI-Agent ist ein System, das nicht nur Text erzeugt, sondern Aufgaben plant, Werkzeuge nutzt und Zwischenergebnisse verarbeitet. Dadurch wird es mächtiger, aber auch schwerer reproduzierbar.
Hier liegt die philosophische Pointe. Determinismus bedeutet nicht, dass ein Mensch ein System leicht vorhersagen kann.
Das Wetter folgt physikalischen Gesetzen, ist aber langfristig schwer vorherzusagen. Ein Schachprogramm folgt Regeln, kann aber Züge finden, die Menschen überraschen. Ein LLM kann aus festen Gewichten berechnen, welcher Token wahrscheinlich ist, und trotzdem bleibt der konkrete Verlauf für uns schwer durchschaubar.
Begriffskasten: Vorhersagbarkeit
Vorhersagbarkeit ist eine epistemische Frage: Was können wir wissen oder berechnen? Determinismus ist eine ontologische Frage: Wie ist die Welt oder das System strukturiert? Ein System kann determiniert und trotzdem für uns unvorhersagbar sein.
David Hume sah im Streit um Freiheit und Notwendigkeit auch ein Problem der Begriffe. In seiner Enquiry schreibt er, die Kontroverse habe oft „merely upon words“ beruht. Quelle: Hume, Of Liberty and Necessity.
Bei KI passiert etwas Ähnliches. Wir sagen: „Das Modell entscheidet.“ Aber was meinen wir damit? Eine menschliche Entscheidung ist mit Gründen, Verantwortung und Selbstverständnis verbunden. Eine Modellentscheidung ist meist eine Berechnung, Klassifikation oder Auswahl unter Wahrscheinlichkeiten.
Begriffskasten: Entscheidung
Im technischen Sinn ist eine Entscheidung oft eine Auswahl: Klasse A statt Klasse B, Token X statt Token Y, Aktion 1 statt Aktion 2. Im philosophischen Sinn meint Entscheidung mehr: Gründe abwägen, sich zu einer Handlung bestimmen und Verantwortung übernehmen.
Das Wort „Entscheidung“ verbindet also zwei Ebenen. Technisch geht es um Auswahl. Philosophisch geht es um Handlung, Gründe und Zurechnung.
Viele Unternehmen haben erkannt, dass reine LLM-Systeme für regulierte Bereiche schwer einsetzbar sind. Banken, Versicherungen, Medizin, Recht und öffentliche Verwaltung brauchen Auditierbarkeit. Dort reicht „Das Modell hat es so gesagt“ nicht aus.
Deshalb entsteht ein Markt für deterministische KI-Systeme. Dabei gibt es drei Strategien.
Die erste Strategie lautet: Das LLM darf Vorschläge machen, aber nicht final entscheiden. Kapy beschreibt diesen Ansatz für Unternehmensdaten. Das LLM erstellt einen validierten Forschungsplan. Die eigentliche Ausführung läuft danach als SQL. Der Anspruch: gleicher Plan, gleiche Abfrage, gleiches Ergebnis. Quelle: Kapy.
Die zweite Strategie lautet: Natürliche Sprache wird in Entscheidungsgraphen übersetzt. Memintel positioniert sich als Entscheidungsschicht für agentische KI. Es verspricht versionierte, typisierte und auditierbare Ausführung ohne LLM auf dem kritischen Pfad. Quelle: Memintel.
Die dritte Strategie lautet: Man verbindet neuronale Modelle mit symbolischen Strukturen. Symbolica AI arbeitet an Architekturen, die formale Logik, Typentheorie und symbolisches Schließen stärker in KI-Systeme einbauen wollen. Quelle: Symbolica AI.
Begriffskasten: Neurosymbolische KI
Neurosymbolische KI verbindet neuronale Netze mit symbolischen Verfahren. Neuronale Modelle erkennen Muster. Symbolische Systeme arbeiten mit Regeln, Typen, Logik oder Wissensgraphen. Ziel ist eine KI, die flexibel und zugleich überprüfbarer ist.
Andere Firmen setzen bei Speicher, Governance oder Faktenprüfung an. Damba spricht von deterministischer, auditierbarer Erinnerung. 1729 AI Labs formuliert die These, dass man aus probabilistischen LLMs durch Systemarchitektur verlässliche Systeme bauen kann. Hialara, Glare9 und QGI verwenden ebenfalls stark den Begriff deterministischer KI. Diese Fälle sollte man besonders kritisch lesen, weil Website-Versprechen nicht automatisch technische Evidenz sind.
Der gemeinsame Nenner ist klar: Die Branche versucht nicht unbedingt, das Sprachmodell selbst vollständig deterministisch zu machen. Sie versucht, den riskanten Teil einzuhegen. Das LLM wird zum Generator, Übersetzer oder Vorschlagsmacher. Die Entscheidung selbst wandert in Regeln, Datenbanken, SQL, Workflows, formale Grammatiken oder überprüfbare Speicherstrukturen.
Begriffskasten: Auditierbarkeit
Auditierbarkeit bedeutet, dass eine Entscheidung später nachvollzogen und geprüft werden kann. Man muss sehen können, welche Daten, Regeln, Modellversionen und Zwischenschritte beteiligt waren.
KI zeigt, dass wir drei Begriffe trennen müssen.
Erstens: kausale Bestimmtheit. Ein Modelloutput hat Ursachen. Er entsteht nicht aus dem Nichts.
Zweitens: praktische Vorhersagbarkeit. Auch wenn ein Output verursacht ist, können wir ihn oft nicht einfach vorhersagen.
Drittens: normative Verantwortung. Selbst wenn ein System „entscheidet“, heißt das nicht, dass es verantwortlich ist. Verantwortung liegt bei den Menschen und Institutionen, die Daten auswählen, Modelle trainieren, Systeme einsetzen und Folgen akzeptieren.
Genau hier wird Spinoza wieder aktuell. Wir sehen die Ausgabe und nennen sie Entscheidung. Aber die Ursachen bleiben verborgen. Die philosophische Aufgabe besteht darin, diese Ursachen sichtbar zu machen.
KI widerlegt den Determinismus nicht. Sie macht ihn komplizierter. Sie zeigt, dass ein vollständig berechnetes Ergebnis für Menschen trotzdem überraschend, instabil und schwer kontrollierbar sein kann.
Das ist kein Beweis für Freiheit. Es ist ein Beweis dafür, dass Vorhersagbarkeit viel anspruchsvoller ist als Kausalität.
Pierre-Simon Laplace: A Philosophical Essay on Probabilities
https://en.wikisource.org/wiki/A_Philosophical_Essay_on_Probabilities
Baruch de Spinoza: Ethics
https://en.wikisource.org/wiki/Ethics_(Spinoza)
David Hume: An Enquiry Concerning Human Understanding, „Of Liberty and Necessity“
https://en.wikisource.org/wiki/Page:An_Enquiry_Concerning_Human_Understanding_-_Hume_(1748).djvu/143
Stanford Encyclopedia of Philosophy: Causal Determinism
https://plato.stanford.edu/entries/determinism-causal/
PyTorch Documentation: Reproducibility
https://docs.pytorch.org/docs/stable/notes/randomness
Hugging Face Documentation: Generation strategies
https://huggingface.co/docs/transformers/generation_strategies
OpenAI Help Center: Why am I getting different completions on Playground vs. the API?
https://help.openai.com/en/articles/6643200-why-am-i-getting-different-completions-on-playground-vs-the-api
Memintel
https://www.memintel.io/
Symbolica AI
https://www.symbolica.ai/
1729 AI Labs
https://www.1729labs.ai/