Hopp til hovedinnhold
Tilbake
Koding 3 min · Kilde: GitHub

ripwire gir kodeagenten et rangert kart i stedet for grep

KI Takeaway KI-generert · kan inneholde feil

Erstatter agentens grep-og-les-runde med ett rangert, deterministisk kart over kodebasen, målt til rundt 5 prosent av tokenforbruket.

58,3 prosent av spørsmålene får alle de riktige filene inn blant de ti øverste treffene. Det er tallet Red Hat Emerging Technologies oppgir for ripwire på en holdt-tilbake LocBench-runde med 60 instanser, mot 40,0 prosent for den beste av fem konkurrerende gjenfinningsverktøy. Indekseringen tar 0,31 sekunder, og et varmt søk svarer på 0,108 sekunder.

ripwire er en frittstående kommandolinje skrevet i C++23 uten avhengigheter, med en MCP-server som valgfritt andre grensesnitt. Du peker den mot et repo og beskriver endringen du skal gjøre med ord, og den svarer med rangerte symboler, hvem som kaller dem, hvor stor sprengradiusen er og hvilke tester som faktisk når koden. Tjueén tree-sitter-grammatikker ligger vendored i binæren, fra Rust og Go til Swift, CUDA og Metal, og alt kjører lokalt uten nett.

Poenget er ikke besparelsen alene, men at svaret merker sin egen usikkerhet. Hver bunt oppgir en confidence-verdi og et estimert tokenforbruk, hver avkorting oppgir hvor mange rader som ble kuttet og hvorfor, og filer i språk uten grammatikk listes som uindekserte i stedet for å forsvinne stille. På små filer snur verktøyet om og leverer hele filen fordi den rangerte bunten ville kostet nesten fem ganger mer, og markerer svaret som whole-file i stedet for å skjule byttet.

«Hvert tall på denne siden er en måling på et korpus vi tilfeldigvis har. Ditt er ett vi ikke har.» — ripwires README, Red Hat Emerging Technologies

I den direkte sammenligningen mot en konkurrent på 48 spørsmål fordelt på django, webpack og ripwires eget repo endte det 27 seiere, 7 tap og 14 uavgjort, med 77 000 tokens brukt mot motpartens 486 000. Tapene står navngitt i dokumentasjonen: på et rent oppslag av ett symbol svarer konkurrenten på rundt en kilobyte, mens ripwire bruker det tredobbelte fordi den også leverer kroppen.

Mottakelsen på Hacker News 7. september var kjølig, og innvendingen gjaldt ikke målingene. Flere kommentatorer mente README-en er KI-skrevet og stedvis uforståelig, og at et verktøy der forfatteren ikke klarer å gjøre dokumentasjonen koherent, er vanskelig å stole på. Kritikken er lett å kjenne igjen når du leser siden: den er svært lang, og inneholder blant annet to parodier der benchmark-tabellen gjenfortelles i Jane Austens stil og som en detektivroman.

Nøkkeltall
58,3 %
Andelen spørsmål der alle gullfilene havner i topp ti, mot 40,0 % for beste alternativ
0,31 s
Median indekseringstid på LocBench-utvalget
0,108 s
Median svartid på et varmt søk
5 %
Andelen tokens en ripwire-bunt koster mot en grep-og-les-runde

Hva bør du gjøre?

  1. Mål på ditt eget repo før du stoler på tallene. Alle målingene er gjort på ripwires egen kodebase, django og webpack, og prosjektet sier selv at ditt korpus er et de ikke har sett.
  2. Les confidence-verdien i svaret. Står det low, er rangeringen flat, og bunten er et utgangspunkt heller enn et svar. Verdien måler hvor tydelig toppen skiller seg fra resten, ikke om toppen er det du lette etter.
  3. Sjekk uindeksert-linjen først hvis hovedspråket ditt ikke er blant de tjueén. Et kart som ser komplett ut, men som har hoppet over halve repoet, er verre enn ingen kart.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter