Jackson Kernion i Anthropic: Claude lærte å skrive for andre språkmodeller
Forvent klarere tekst fra Claude Opus 5.5 enn fra Opus 5, men ifølge Anthropics Jackson Kernion er skrivingen fortsatt et uløst problem fordi kode- og matte-trening drar i motsatt retning.
«Jeg har ikke vært like fornøyd med en modells skriving siden Opus 4.6», skrev Jackson Kernion på X 22. september. Kernion jobber med finjustering av Claude hos Anthropic, ifølge The Decoder, og skriver at Opus 5.5 er den første modellen med målrettede forbedringer mot uklare setninger og «overly-dense info dumps». The Decoder rammer det inn som at Opus 4.6 var Anthropics siste gode skrivemodell. Kernions egne ord er mer forsiktige: Opus 5.5 sammenlignes med Opus 4.6, uten at Kernion sier at den nye modellen er bedre.
Kernion legger forklaringen på belønningene under forsterkningslæringen. Jo mer en modell trenes på matte, kode og på å forklare tekniske temaer for andre språkmodeller, desto mer må treningen aktivt belønne enkle forklaringer for mennesker. I et senere svar skriver Kernion at det han kaller «Claudeish» ble tilpasset språkmodellers psykologi. Modeller har mye mer arbeidsminne enn mennesker og fanger opp detaljer på et finere nivå, så en stil som fungerer for dem, leses som informasjonsdumping av folk.
Claudes offisielle konto på X lover at Opus 5.5 legger det viktigste først og «follows the writing rules you give it». Kernion lover ikke at problemet er løst.
«Det er et vanskelig problem å løse, og vi kommer til å fortsette å gjøre forbedringer.» — Jackson Kernion, Anthropic
For deg som lar Claude skrive dokumentasjon, commit-meldinger eller tekst sluttbrukere skal lese, betyr det at eksplisitte skriveregler i systemprompten fortsatt er det mest pålitelige verktøyet du har.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.