mousePDF · PDF-textigenkänning (OCR)
pdf ocr · textigenkänning · utan uppladdning

PDF-textigenkänning (OCR) — utan uppladdning

Lägg ett osynligt, sökbart textlager över skannade eller bildbaserade PDF-sidor. Igenkänningen sker helt i din webbläsare, din fil laddas aldrig upp.

✓ Inget laddas upp ✓ Helt kostnadsfritt ✓ Utan konto
Annons
Skärmbild av mousePDF-redigeraren
så går det till

I tre steg

01

Öppna PDF

Dra in den skannade eller bildbaserade PDF-filen eller välj den.

02

Välj språk & omfattning

Ange igenkänningsspråk och bestäm om bara aktuell sida eller hela dokumentet ska bearbetas.

03

Exportera

Spara PDF med sökbart, osynligt textlager — sidbilden förblir visuellt oförändrad.

Typiskt fall: göra skannade dokument sökbara

Skannade avtal, fakturor eller böcker innehåller ofta bara en sidbild, ingen riktig text — man kan varken söka i dem eller kopiera text. mousePDF känner igen texten lokalt i webbläsaren och lägger den osynligt över bilden, så att sökning och kopiering fungerar utan att sidans utseende förändras.

Annons

Textigenkänning i webbläsaren — och vad som är speciellt med det

OCR hör till de uppgifter man annars nästan alltid måste ladda upp något för: igenkänningen behöver en språkmodell, och den ligger vanligtvis på en server. Här körs den i din webbläsare; bara modellen laddas, aldrig din fil.

Det är just viktigt för de dokument man skannar: avtal, lönebesked, läkarintyg, kopior av id-handlingar. En skanning är en bild — och innan den blir sökbar måste något läsa den. Att det något körs på din egen enhet i din webbläsare är den egentliga skillnaden.

28 språk finns tillgängliga för OCR. Modellen för det valda språket laddas först vid den faktiska körningen — sidan förblir därför lätt, och du laddar bara det du behöver.

Var igenkänningen når sina gränser

Icke-latinska skriftsystem saknas medvetet. Ingen kyrilliska, inget kinesiska, japanska eller koreanska, ingen arabiska, hebreiska, devanagari eller thailändska. Modellerna för dessa är betydligt större och träffsäkerheten märkbart lägre — ett resultat man måste rätta tecken för tecken hjälper ingen. Grekiska finns med, eftersom det i det här avseendet inte hamnar i samma klass.

Igenkänningen är aldrig felfri. Den läser tillbaka från pixlar det som en gång var text. En ren skanning med rak inriktning ger mycket goda resultat; ett snett mobilfoto i dåligt ljus, en kladdig handskrift eller ett ovanligt dekorativt typsnitt betydligt sämre. Den som återanvänder texten bör läsa igenom den — det gäller alla OCR-bearbetade versioner, inte bara den här.

Sidans utseende ändras inte. Den igenkända texten läggs som ett osynligt lager över bilden: du ser fortfarande din skanning, men kan söka och markera i den. Igenkänningsfel syns därför inte i bilden — de visar sig först när du kopierar ut text.

OCR är också användbart efter komprimering av en PDF: då blir sidorna till bilder och förlorar sitt textlager — textigenkänningen skapar det på nytt.

faq

Vanliga frågor

Laddas mitt dokument upp för textigenkänningen? +

Nej. Igenkänningen sker helt i webbläsaren via en lokalt laddad OCR-motor — filen lämnar aldrig din enhet.

Vilka språk stöds? +

Ett större urval europeiska språk med latinsk eller grekisk skrift. Skriftsystem som kinesiska, arabiska, kyrilliska eller devanagari stöds för närvarande inte för OCR.

Hur lång tid tar igenkänningen? +

Beroende på antal sidor och enhetens prestanda, några sekunder till några minuter.

Ändrar textigenkänningen sidans utseende? +

Nej. Sidbilden förblir exakt densamma, det igenkända textlagret ligger osynligt ovanpå — bara sökning och kopiering blir möjliga genom det.

Hur bra är igenkänningen på dåligt skannade eller handskrivna dokument? +

Igenkänningen fungerar bäst på snyggt tryckt, lättläst text. Vid handskrivna anteckningar eller kraftigt brusiga skanningar sjunker noggrannheten — då kan enstaka tecken kännas igen fel eller saknas.

Vilka språk känns igen? +

28, alla med latinsk skrift plus grekiska. Icke-latinska skriftsystem som kyrilliska, kinesiska, arabiska, hebreiska eller thailändska är medvetet inte med — träffsäkerheten skulle vara betydligt sämre där.

Hur exakt är igenkänningen? +

Vid en ren, rak skanning mycket bra; vid sneda mobilfoton, dåligt ljus eller handskrift märkbart sämre. Den som återanvänder texten bör läsa igenom den.

Ser mitt dokument annorlunda ut efter textigenkänningen? +

Nej. Den igenkända texten kommer som ett osynligt lager över bilden — sidan ser ut som förut, men är sökbar.

fler verktyg

Detta kan också hjälpa

Komprimera PDF

Förminska bildtunga PDF-filer avsevärt — sidorna blir då till bilder.

Konvertera PDF till PDF/A

Konvertera till det arkivvänliga PDF/A-formatet — för myndigheter och långtidsarkivering.

Konvertera PDF till Word

Exportera PDF-text som en redigerbar Word-fil — utan uppladdning.

Redigera PDF-text

Klicka på befintlig text i PDF-filen och ersätt den med ny.

Annons

Öppna redigeraren →