OCR It leser låste dokumenter side for side med Tesseract i nettleseren
Fest én skjermregion, og OCR It leser resten av dokumentet lokalt med en innebygd Tesseract-build uten å sende et eneste bilde ut av maskinen.
Der de fleste OCR-tjenester laster sidene dine opp til et API, går OCR It motsatt vei: hele motoren er bygget inn i utvidelsen, og ifølge README-en på GitHub gjør den ingen utgående forespørsler i det hele tatt. Den er MIT-lisensiert, krever Chrome 116 eller Firefox 140, og ber ikke om tilgang til noe nettsted ved installasjon. Enkeltfangster rir på activeTab, tillatelsen nettleseren gir deg i det øyeblikket du trykker på snarveien.
Arbeidsflyten er én tastesnarvei per side. Du drar ut et rektangel én gang, og hvert trykk skjermbildefanger akkurat den flaten, kjører OCR i bakgrunnen og legger teksten til et løpende transkript. En egen snarvei overtar hele jobben: fang, bla, gjenta, helt til dokumentet tar slutt. Kjøringen stopper av seg selv når to sider på rad gir identisk tekst, og har et hardt tak på 300 sider.
Den skarpeste detaljen i dokumentasjonen er en advarsel om innstillingen «Layout». Tesseract-modusen «Single block» høres ut som det forsiktige valget på et boksideoppslag, men på en tospaltet side fletter den spaltene linje for linje til tekst som ikke betyr noe, og rapporterer rundt 95 prosent konfidens mens den gjør det. Målt på et tospaltet utsnitt gir det 52,9 prosent tegnfeil mot 0,0 prosent på «Auto».
Begrensningene er like konkrete. Chromes innebygde PDF-visning er et plugin ingen utvidelse kan injisere i, så automatisk bladring virker ikke der. Bare det synlige vinduet kan fanges. Tre språk følger med, og de rundt 100 andre Tesseract-språkene må bakes inn manuelt siden ingenting hentes over nett under kjøring.
Hva bør du gjøre?
- La Layout stå på Auto. De andre modusene feiler stille og med høy selvtillit på alt annet enn én sammenhengende tekstblokk.
- Kjør fem sider manuelt og les gjennom transkriptet før du starter en automatisk kjøring på hundrevis av sider. Endrer du vindusstørrelse eller zoom underveis, ryker både fangstregionen og bla-punktet.
- Skal du lese en PDF fra disk, må Allow access to file URLs skrus på under detaljene for utvidelsen i chrome://extensions.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.