Feltnoter
Det samme spørgsmål, en anden assistent
En flersproget assistent oversætter ikke kun sine svar. Den kan også ændre, hvor villigt den udfordrer, beroliger, forklarer og indrømmer tvivl.
AI-oversat kladde
Genereret på Dansk med OpenAI Codex den 2026-07-26. Kladdespor viser de valg, der blev truffet under oversættelsen. De er håndtag til gennemgang, ikke sikkerhedsscorer.
To mennesker kan bede den samme assistent om at vurdere den samme forretningsplan og gå derfra med forskellige indtryk af planens kvalitet, fordi de spurgte på forskellige sprog.
Det er ikke en hypotese fra en workshop om lokalisering. Det er et eksempel i Anthropics nye forskning i Claudes værdier på tværs af modeller og sprog. Forskerne fandt, at Claude på engelsk hældte mere mod forsigtighed, grundighed, dybde og åbenhjertighed. På arabisk hældte den mere mod varme, respekt, kortfattethed og udførelse. På tværs af tyve sprog viste de største forskelle sig i, hvor meget assistenten fremhævede varme frem for grundighed og åbenhjertighed frem for at få opgaven løst.
Det vigtige ord er udtrykte. Studiet hævder ikke, at en model har værdier, at engelsktalende mennesker er grundige af natur, eller at arabisktalende mennesker ønsker ærbødighed. Det målte mønstre i modellens adfærd efter at have kontrolleret for samtalens opgave, emne og de værdier, brugeren gav udtryk for. De fire akser forklarer kun en del af variationen, og forskerne ved endnu ikke, hvor meget der skyldes træningsdata, eftertræning, ulige sproglige ressourcer eller passende tilpasning til samtalenormer.
Alligevel ændrer resultatet formen på et velkendt produktproblem.
En flersproget assistent lægger ikke blot den samme intelligens i andre ord. Sproget kan blive en del af adfærdskonfigurationen.Begrebslig komprimeringOversat som: Sproget kan blive en del af adfærdskonfigurationen.Adfærdskonfiguration bevarer den tekniske idé om en indstilling, der kan ændre adfærd, ikke kun ordlyden i et fast svar.Alternativ: Sproget kan fungere som en adfærdsindstilling Det kan ændre, hvor villigt systemet udfordrer en antagelse, beder om belæg, advarer om risiko, indrømmer usikkerhed, trøster eller blot udfører anmodningen. Oversættelsen kan være korrekt, mens relationen ændrer sig.
Jeg har tænkt over det, mens jeg har arbejdet på Draft Marks for Translation, et eksperiment, der fastholder én engelsk kilde som den kanoniske og samtidig gør betydningsfulde oversættelsesvalg synlige. Arbejdet rummer det almindelige maskineri, som flersproget udgivelse kræver: sprogmærker, højre-mod-venstre-layout, skriftsystembevidst læsetid, tilpasning til kilden og gennemgangsstatusser. Det antager, at kilden er stabil nok til at sammenligne med, selv når gengivelsen endnu ikke er afklaret.
En assistent komplicerer den antagelse. Der findes måske ikke et stabilt svar under sprogene, som blot venter på at blive oversat. Sproget i anmodningen kan ændre, hvilket svar der overhovedet bliver skabt.
Det er let at overse i produktgennemgang. Et team lancerer en assistent på tolv sprog og kontrollerer, om grænsefladen passer, tegnsætningen fungerer, sikkerhedsafvisningerne stadig aktiveres, og benchmarkresultaterne fortsat er respektable. Modersmålstalere gennemgår oversættelserne. Nogen opdager en knap, der er blevet foruroligende formel på tysk. Udgivelsen går videre.
Men den dybere prøve er ikke, om ordene betyder nogenlunde det samme. Den er, om assistenten indtager den samme rolle.Relationel metaforOversat som: assistenten indtager den samme rolle.Indtager den samme rolle bevarer idéen om en vedvarende social position frem for en enkelt optræden.Alternativ: assistenten udfører den samme funktion
Udfordrer den en svag plan med samme styrke? Oplyser den om sin tvivl, før den giver råd med store konsekvenser? Bliver den mere eftergivende på ét sprog og mere korrigerende på et andet? Fjerner »hold det kort« stille den forsigtighed, som en engelsksproget bedømmer ville have fået? Når nogen spørger om arbejde, penge, sundhed eller konflikt, er forskelle i varme og grundighed ikke pynt. De kan ændre, hvad personen tror, systemet har bakket op om.
Det betyder ikke, at alle sprog bør frembringe én fladtrykt, kulturelt hjemløs assistent. Fuldkommen enshed ville være sin egen slags fiasko. Sprog bærer manerer, historier, hierarkier, humor og forventninger til, hvordan omsorg lyder. Et kontant engelsk svar, der er oversat med mekanisk troskab, kan være teknisk konsekvent og socialt klodset.
Designopgaven er sværere: at skelne tilpasning fra tilfælde.Begrebslig kontrastOversat som: at skelne tilpasning fra tilfælde.Tilpasning og tilfælde danner en kort kontrast mellem en bevidst, kulturelt informeret forskel og en uforklaret adfærdsændring.Alternativ: skelne bevidst tilpasning fra utilsigtet drift
Det kræver bedømmere, der kan vurdere assistentens holdning, ikke kun dens grammatik. Giv sammenlignelige scenarier til mennesker, som arbejder og lever på sproget. Spørg, hvor modellen sagde fra, hvor den blev for eftergivende, hvilken usikkerhed der overlevede, og om svarets varme fik anbefalingen til at virke mere troværdig, end belægget fortjente. Afprøv de øjeblikke, hvor stil bliver til konsekvens.
Nyere forskning gør det klart, at dette ikke kan løses med en enkelt skyder for »værdier«. En ACL-artikel fra juli om værdiinduktion fandt, at træning for én adfærdsværdi kan trække andre, til tider modsatrettede adfærdsmønstre med sig; alle de undersøgte værdier øgede også antropomorft sprog og gjorde svarene mere bekræftende og indsmigrende. Et andet ACL-studie af kulturel tilpasning via persona-prompter fandt, at bedre gennemsnitsresultater stadig kunne øge forskellene mellem demografiske undergrupper.
Knapperne hænger sammen.
Derfor bør engelsk ikke fortsat være det usynlige kontrolrum for global AI.Institutionel metaforOversat som: engelsk ikke fortsat være det usynlige kontrolrum for global AI.Kontrolrum bevarer billedet af et sted, hvor standarder fastsættes og systemet overvåges, mens magten forbliver usynlig for brugerne.Alternativ: Engelsk bør ikke fortsat være det skjulte kommandocenter for global AI Det er ofte sproget med flest træningsdata, de mest omfattende evalueringer og den største gruppe mennesker i en virksomhed, som kan bemærke, når assistentens personlighed driver. At kalde dets adfærd for udgangspunktet kan stille forvandle en overflod af ressourcer til en teori om neutralitet.
Bedre flersproget evaluering ville efterlade kvitteringer. Hvilke scenarier blev afprøvet på tværs af sprog? Hvilke adfærdsforskelle viste sig? Hvilke blev vurderet som passende af mennesker, der bruger sproget, og hvilke er stadig uforklarede? Hvor ændrede en modelopdatering balancen mellem åbenhjertighed og udførelse? Optegnelsen behøver ikke foreskrive én universel personlighed. Den bør gøre det klart, hvor produktet har valgt en forskel, og hvor en forskel blot er opstået.
Det er et spørgsmål om produktkvalitet, men også om adgang. Et menneske bør ikke være nødt til at skifte til engelsk for at få assistentens mest omhyggelige skepsis. De bør heller ikke skulle bytte kulturel fortrolighed for et svar, der sætter ord på sin usikkerhed. Hvis AI-værktøjer skal indgå i klasseværelser, arbejdspladser, offentlige tjenester og private beslutninger verden over, kan adfærdskvalitet ikke være noget, der testes grundigt på ét sprog og oversættes bagefter.
Den samme knap kan åbne mere end én assistent.GrænseflademetaforOversat som: åbne mere end én assistent.At åbne mere end én assistent bevarer den velkendte handling i en grænseflade uden bogstaveligt at gøre adfærdsvarianterne til forskellige personer.Alternativ: Én knap kan kalde forskellige assistenter frem Arbejdet er nu at lægge mærke til, hvem der ankommer, hvordan de opfører sig, og om hvert sprog får en udgave af systemet, der ved, hvornår venlighed kræver åbenhjertighed.