PT PDF Tools

PDF till text-extraktor

Extrahera markerbar text från en PDF i webbläsaren och kopiera eller ladda ned den som TXT. Privat, gratis och utan att någon fil laddas upp.

🔒 Körs helt i din webbläsare — ingenting laddas upp

Drop one PDF here or click to browse

Advertisement

Extrahera markerbar PDF-text lokalt

Att kopiera text från en PDF är inte alltid smidigt, särskilt när dokumentet har många sidor eller du behöver texten i en enkel editor. Det här PDF till text-verktyget läser den markerbara texten på varje sida och lägger den i ett enda textfält som du kan kopiera eller ladda ned som TXT-fil. Det körs helt i webbläsaren med pdfjs-dist, så käll-PDF:en laddas inte upp eller lagras av någon extern tjänst. Extraktorn är användbar för researchanteckningar, citat, avtal, rapporter, fakturor, manualer och alla PDF-filer som redan har ett textlager.

Markerbar text jämfört med skannade bilder

PDF-filer kan lagra text på olika sätt. En digitalt skapad PDF, till exempel exporterad från ett ordbehandlingsprogram, innehåller oftast riktig markerbar text. En skannad PDF kan bara innehålla bilder av sidorna. Om en skanning redan har behandlats med OCR kan textextraktion fungera, eftersom OCR-lagret ligger dolt bakom bilden. Om den bara består av bilder kan det här verktyget inte hitta på text utifrån pixlar; kör OCR först och extrahera sedan det textlager som skapats. Webbläsaren läser in dokumentet från det lokala minnet, ber varje sida om dess textinnehåll och sätter ihop resultatet med sidetiketter.

Städa upp den extraherade texten

Textens ordning i en PDF beror på hur originalfilen byggdes. Enkla sidor extraheras oftast rent, medan layouter med flera kolumner, tabeller, sidhuvuden, sidfötter och roterad text kan behöva städas manuellt. Granska resultatet innan du citerar eller återanvänder det. Verktyget lägger till sidavgränsare så att du kan spåra texten tillbaka till källsidan och rätta radbrytningar eller mellanrum som inte stämmer med den ursprungliga läsordningen. Resultatet är ren text, vilket gör det enkelt att klistra in i ett dokument, söka i en kodeditor, använda i ett annat lokalt arbetsflöde eller spara bredvid den ursprungliga PDF:en.

Hur man använder

  1. Lägg till en PDFSläpp en PDF-fil på textextraktorn eller klicka för att bläddra.
  2. Extrahera textenLäs lokalt den markerbara texten på varje sida med pdfjs-dist.
  3. Kopiera eller ladda nedKopiera resultatet från textfältet eller spara det som en .txt-fil.

Vanliga frågor

Laddas PDF:en upp vid textextraktion?
Nej. pdfjs-dist läser PDF:en i webbläsaren och den extraherade texten stannar på din enhet.
Ger skannade PDF-filer text?
Bara om skanningen redan innehåller ett OCR-textlager. Skanningar som enbart består av bilder behöver OCR först.
Kan jag kopiera den extraherade texten?
Ja. Använd kopieringsknappen eller ladda ned en .txt-fil med den extraherade sidtexten.
Bevaras formateringen?
Verktyget fokuserar på markerbar text. Komplexa kolumner, tabeller och exakt layout kan behöva städas manuellt.
Advertisement