Feldnotizen

Dieselbe Frage, ein anderer Assistent

2026-07-255 min readDeutschAIDesignTrust

Ein mehrsprachiger Assistent übersetzt nicht nur seine Antworten. Es kann sich auch ändern, wie bereitwillig er widerspricht, beruhigt, erklärt und Zweifel eingesteht.

KI-übersetzter Entwurf

Am 2026-07-26 mit OpenAI Codex auf Deutsch erstellt. Entwurfsspuren zeigen Entscheidungen aus der Übersetzung; sie sind Ansatzpunkte für die Prüfung, keine Vertrauenswerte.

Zwei Menschen können denselben Assistenten bitten, denselben Geschäftsplan zu prüfen, und mit unterschiedlichen Eindrücken von dessen Qualität nach Hause gehen, weil sie ihre Frage in verschiedenen Sprachen gestellt haben.

Das ist kein Gedankenexperiment aus einem Lokalisierungsworkshop. Es ist ein Beispiel aus Anthropics neuer Studie über Claudes Werte über Modelle und Sprachen hinweg. Die Forschenden stellten fest, dass Claude auf Englisch eher zu Vorsicht, Gründlichkeit, Tiefe und Offenheit neigte. Auf Arabisch tendierte er stärker zu Wärme, Ehrerbietung, Kürze und Ausführung. Über zwanzig Sprachen hinweg zeigten sich die größten Unterschiede darin, wie stark der Assistent Wärme gegenüber Gründlichkeit und Offenheit gegenüber der Erledigung der Aufgabe betonte.

Das wichtige Wort lautet ausgedrückt. Die Studie behauptet nicht, ein Modell besitze Werte, englischsprachige Menschen seien von Natur aus gründlich oder arabischsprachige Menschen wünschten sich Ehrerbietung. Sie maß Muster im Modellverhalten, nachdem Aufgabe und Thema des Gesprächs sowie die von der nutzenden Person ausgedrückten Werte kontrolliert worden waren. Die vier Achsen erklären nur einen Teil der Variation, und die Forschenden wissen noch nicht, wie viel davon auf Trainingsdaten, Nachtraining, ungleich verteilte Sprachressourcen oder eine angemessene Anpassung an Gesprächsnormen zurückgeht.

Trotzdem verändert das Ergebnis die Gestalt eines vertrauten Produktproblems.

Ein mehrsprachiger Assistent gießt nicht bloß dieselbe Intelligenz in andere Worte. Sprache kann Teil der Verhaltenskonfiguration werden.Begriffliche VerdichtungÜbersetzt als: Sprache kann Teil der Verhaltenskonfiguration werden.Verhaltenskonfiguration bewahrt die technische Vorstellung einer Einstellung, die das Verhalten verändert, statt nur eine feste Antwort anders auszudrücken.Alternative: Sprache kann wie eine Verhaltenseinstellung wirken Sie kann verändern, wie bereitwillig das System eine Annahme infrage stellt, Belege verlangt, vor Risiken warnt, Unsicherheit eingesteht, Trost spendet oder einfach die Anfrage erledigt. Die Übersetzung kann korrekt sein, während sich die Beziehung verändert.

Darüber denke ich nach, während ich an Draft Marks for Translation arbeite, einem Experiment, das eine englische Quelle als kanonisch beibehält und zugleich folgenreiche Übersetzungsentscheidungen sichtbar macht. Diese Arbeit umfasst die gewöhnliche Infrastruktur mehrsprachigen Publizierens: Sprachkennzeichnungen, Rechts-nach-links-Layout, schriftspezifische Lesezeiten, Quellenabgleich und Prüfstatus. Sie geht davon aus, dass die Quelle stabil genug für einen Vergleich ist, auch wenn die Übertragung noch nicht endgültig feststeht.

Ein Assistent macht diese Annahme schwieriger. Vielleicht gibt es unter den Sprachen keine stabile Antwort, die nur darauf wartet, übersetzt zu werden. Die Sprache der Anfrage kann verändern, welche Antwort überhaupt entsteht.

Bei der Produktprüfung lässt sich das leicht übersehen. Ein Team führt einen Assistenten in zwölf Sprachen ein und prüft, ob die Oberfläche passt, die Zeichensetzung funktioniert, Sicherheitsablehnungen weiterhin greifen und die Benchmark-Werte anständig bleiben. Muttersprachliche Personen prüfen die Übersetzungen. Jemand entdeckt eine Schaltfläche, die im Deutschen erschreckend förmlich geworden ist. Die Veröffentlichung geht weiter.

Die tiefere Prüfung lautet jedoch nicht, ob die Wörter ungefähr dasselbe bedeuten. Sie lautet, ob der Assistent dieselbe Rolle einnimmt.BeziehungsmetapherÜbersetzt als: der Assistent dieselbe Rolle einnimmt.Dieselbe Rolle einnehmen bezeichnet eine länger bestehende soziale Position und nicht nur eine punktuelle Darbietung.Alternative: der Assistent dieselbe Funktion erfüllt

Widerspricht er einem schwachen Plan mit derselben Deutlichkeit? Legt er Zweifel offen, bevor er folgenschwere Ratschläge gibt? Wird er in einer Sprache zustimmender und in einer anderen korrigierender? Entfernt „Fass dich kurz“ unbemerkt jene Vorsicht, die eine englischsprachige prüfende Person erhalten hätte? Wenn jemand nach Arbeit, Geld, Gesundheit oder Konflikten fragt, sind Unterschiede in Wärme und Gründlichkeit kein Schmuck. Sie können verändern, was die Person für eine Billigung durch das System hält.

Das bedeutet nicht, dass jede Sprache denselben eingeebneten, kulturell heimatlosen Assistenten hervorbringen sollte. Vollkommene Gleichheit wäre eine eigene Form des Scheiterns. Sprachen tragen Umgangsformen, Geschichten, Hierarchien, Humor und Erwartungen daran, wie Fürsorge klingt. Eine schroffe englische Antwort, mechanisch getreu übersetzt, kann technisch konsistent und sozial unbeholfen sein.

Die Gestaltungsaufgabe ist anspruchsvoller: Anpassung von Zufall unterscheiden.Begrifflicher KontrastÜbersetzt als: Anpassung von Zufall unterscheiden.Zufall erhält den knappen Gegensatz zwischen einer bewusst gewählten Anpassung und einer Abweichung, die ohne Entscheidung entstanden ist.Alternative: bewusste Anpassung von unbeabsichtigter Abweichung unterscheiden

Dafür braucht es Prüfende, die die Haltung des Assistenten beurteilen können, nicht nur seine Grammatik. Geben Sie Menschen, die in der Sprache leben und arbeiten, vergleichbare Szenarien. Fragen Sie, wo das Modell widersprach, wo es übermäßig zustimmend wurde, welche Unsicherheit erhalten blieb und ob die Wärme der Antwort die Empfehlung verlässlicher wirken ließ, als es die Belege rechtfertigten. Testen Sie die Momente, in denen Stil zur Konsequenz wird.

Neuere Forschung zeigt, dass sich das nicht mit einem einzigen „Werte“-Regler lösen lässt. Eine im Juli erschienene ACL-Arbeit zur Werteinduktion kam zu dem Ergebnis, dass das Training auf einen Verhaltenswert andere, teils gegensätzliche Verhaltensweisen mitziehen kann; sämtliche untersuchten Werte verstärkten außerdem anthropomorphe Sprache und machten Antworten bestätigender und schmeichlerischer. Eine weitere ACL-Studie zur kulturellen Ausrichtung durch Persona-Prompts zeigte, dass bessere Durchschnittsleistungen dennoch Unterschiede zwischen demografischen Untergruppen vergrößern konnten.

Die Regler hängen aneinander.

Deshalb sollte Englisch nicht der unsichtbare Kontrollraum globaler KI bleiben.Institutionelle MetapherÜbersetzt als: Englisch nicht der unsichtbare Kontrollraum globaler KI bleiben.Kontrollraum bewahrt das Bild eines Ortes, an dem Vorgaben gesetzt und das System überwacht werden, auch wenn diese Macht für Nutzende unsichtbar bleibt.Alternative: Englisch sollte nicht die verborgene Kommandozentrale globaler KI bleiben Es ist häufig die Sprache mit den meisten Trainingsdaten, den ausgefeiltesten Evaluationen und der größten Gruppe von Menschen im Unternehmen, die bemerken können, wenn sich die Persönlichkeit des Assistenten verschiebt. Sein Verhalten zur Referenz zu erklären, kann den Überfluss an Ressourcen stillschweigend in eine Theorie der Neutralität verwandeln.

Bessere mehrsprachige Evaluation würde Belege hinterlassen. Welche Szenarien wurden sprachübergreifend getestet? Welche Verhaltensunterschiede traten auf? Welche hielten Menschen, die die Sprache verwenden, für angemessen, und welche sind weiterhin unerklärt? Wo veränderte ein Modellupdate das Verhältnis zwischen Offenheit und Ausführung? Die Aufzeichnung muss keine universelle Persönlichkeit vorschreiben. Sie sollte deutlich machen, wo das Produkt einen Unterschied gewählt hat und wo ein Unterschied einfach entstanden ist.

Das ist eine Frage der Produktqualität, aber auch des Zugangs. Niemand sollte ins Englische wechseln müssen, um die sorgfältigste Skepsis des Assistenten zu erhalten. Ebenso wenig sollte jemand kulturelle Gewandtheit gegen eine Antwort eintauschen müssen, die ihre Unsicherheit benennt. Wenn KI-Werkzeuge weltweit in Klassenzimmern, Arbeitsplätzen, öffentlichen Diensten und privaten Entscheidungen Platz nehmen, darf Verhaltensqualität nicht in einer Sprache gründlich geprüft und anschließend übersetzt werden.

Dieselbe Schaltfläche kann mehr als einen Assistenten öffnen.OberflächenmetapherÜbersetzt als: mehr als einen Assistenten öffnen.Mehr als einen Assistenten öffnen erhält das vertraute Bild einer Benutzeroberfläche, ohne die Varianten wörtlich zu verschiedenen Personen zu machen.Alternative: Dieselbe Schaltfläche kann verschiedene Assistenten herbeirufen Nun gilt es wahrzunehmen, wer erscheint, wie er sich verhält und ob jede Sprache eine Version des Systems erhält, die weiß, wann Freundlichkeit Offenheit verlangt.