Claude kjørte hele proteindesign-kjeden og traff på 26,8 prosent
Lot Claude styre hele proteindesign-kjeden alene, med 354 bindere av 1 320 design bekreftet i laben.
Anthropic har publisert to eksperimenter der Claude-modeller gjorde arbeid fra tidlig legemiddelutvikling. Det første handlet om minibindere, små proteiner som låser seg til et målprotein og blokkerer funksjonen. Modellene Mythos Preview og Opus 4.8 designet bindere mot 16 målproteiner, 15 av dem ga brukbare målinger, og Claude lyktes på 14. Av 1 320 design som ble testet fysisk, bandt 354, en treffrate på 26,8 prosent. Anthropic oppgir 10 til 15 prosent som dagens typiske nivå, hentet fra dokumenterte kampanjer i databasen proteinbase.com.
Det nye er ikke proteinmodellene. Anthropic bygde ingen egen, og designarbeidet ble gjort av åpne verktøy feltet allerede bruker, blant dem PXDesign, RFdiffusion3, BoltzGen og SolubleMPNN. Det nye ligger i laget over: en generell språkmodell som selv leste seg opp på biologien, valgte angrepspunkt på proteinoverflaten, installerte programmene fra kodelagrene deres og kombinerte dem i 24 arbeidsflyter. Systemprompten var på rundt 16 000 ord, og bare en tredjedel av den var faglig veiledning. Resten handlet om planlegging, delegering til underagenter, verifisering og budsjettdisiplin, med et regnebudsjett på 50 000 dollar per kampanje mot flere mål samtidig.
Den mest talende enkeltsaken er RBX1, et protein som styrer nedbrytning av andre proteiner i cellen. I en åpen designkonkurranse bandt bare 9 av 245 nye kandidater der. Claude fikk 28 av 90. Anthropic fikk vinnerdesignet fra konkurransen bygget opp og målt på samme analyseplate hos oppdragslaboratoriene Adaptyv Bio og Twist Bioscience: det bandt ved 45 nanomolar, mens Claudes beste bandt ved 3,9, rundt ti ganger tettere.
Grensene beskriver Anthropic selv. Det fantes ingen parallell kampanje av menneskelige eksperter som kontroll. Ingen design fikk strukturen bestemt eksperimentelt, og hver kombinasjon av modell, format og mål ble kjørt nøyaktig én gang. To mål feilet helt, og konfidensscorene fra foldeprediksjonen varslet ingen av dem. I det andre eksperimentet tolket Opus 5 rådata fra NMR og LC-MS på 23 og 19 minutter, og dekodet LC-MS-formatet selv da den ikke fant noen leser for det.
Prompter, designdata og begge måledatasett ligger på Hugging Face, så kampanjen kan i prinsippet gjenskapes. En uavhengig gjennomgang står fortsatt igjen, og det er verdt å holde fast ved: dette er Anthropics egne tall om Anthropics egne modeller.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.