PDF-ből Word, ingyen
Alakítsd szerkeszthető .docx fájllá a PDF-et — szöveg, címsorok, felsorolások és képek megtartásával. A dokumentum a böngésződben marad, nem töltjük fel sehová.
Húzd ide a PDF-et, vagy válassz fájlt
A dokumentum a böngésződben marad — nem töltjük fel sehová.
Egyszerre több PDF-et is behúzhatsz — legfeljebb tízet —, a kész Word-fájlokat egy ZIP-ben töltheted le.
Miért a böngészőben?
Amit Wordbe akarsz visszakapni, az jellemzően szerződés, önéletrajz, szakdolgozat vagy egy hivatalos levél, amit módosítanod kell. A legtöbb „PDF to Word" oldal ezt feltölti egy szerverre, ott alakítja át, és napokig tárolja — vagyis a dokumentumod egy idegen gépen jár. Ez a lap nem így működik: a PDF-et a böngésződ olvassa be, a Word-fájlt a böngésződ írja meg, és egyetlen bájt sem megy ki a gépedről.
A motor két nyílt forráskódú könyvtár: a pdf.js, amivel a Firefox is megjeleníti a PDF-eket, olvassa ki a szöveget és a képeket a pozíciójukkal együtt; a docx.js pedig a Word saját formátumában írja ki az eredményt. Nincs letöltendő modell, az első futtatás is pár másodperc.
Mi marad meg, és mi nem
A PDF-ben nincsenek bekezdések — csak betűk vannak, koordinátákkal. Hogy mi tartozik össze, azt az elhelyezkedésükből következtetjük ki: a sorok közötti távolságból, a behúzásból, a betűméretből. Ebből lesz a Wordben bekezdés, címsor (három szinten), felsorolás és számozott lista, középre vagy jobbra zárt sor, félkövér és dőlt szövegrész. A képek a rajzolt méretükben kerülnek a szövegbe, a megfelelő helyre, és minden PDF-oldal után oldaltörés jön, hogy az oldalszámozás megmaradjon.
Amit nem tudunk visszaépíteni: a táblázatokat (cellánként, soronként jönnek át szövegként), a többhasábos tördelést (a hasábok egymás után kerülnek), a szövegdobozokat, az űrlapmezőket, a lábjegyzeteket és a fejlécet-láblécet mint külön elemet. Az eredeti betűtípus neve sem utazik át, a Word a saját alapértelmezett betűjét használja. Ez a „közelítő elrendezés": a szöveg és a szerkezete jön át, nem a pixelpontos kép.
Szkennelt PDF-nél előbb OCR
Ha a PDF egy beszkennelt papír vagy egy lefotózott oldal, akkor nincs benne szöveg — csak egy kép a szövegről. Ilyenkor ez az eszköz nem talál mit átalakítani, és ezt meg is mondja, ahelyett, hogy egy üres dokumentumot adna. A megoldás a szövegfelismerő (OCR): az felismeri a betűket a képen, és olyan PDF-et készít, amiben a szöveg már kereshető. Azt aztán ide behúzva már Word-fájl lesz belőle.
Gyakori kérdések
Ugyanúgy fog kinézni Wordben, mint a PDF?
Nem, és egyetlen átalakító sem tudja ezt becsületesen megígérni. Ami átjön: a szöveg, a bekezdések, a címsorok, a listák, a félkövér és dőlt részek, a képek és az oldalhatárok. Ami nem: a táblázatok szerkezete, a hasábok, a szövegdobozok, az eredeti betűtípus. Egy szerkeszthető dokumentumot kapsz, nem a PDF pixelpontos mását — épp ez a lényeg, ha módosítani akarod.
Jelszóval védett PDF-et is át tud alakítani?
Igen, ha tudod a megnyitási jelszót: a lap bekéri, és a böngésződ nyitja ki vele a fájlt. A jelszó sehová nem megy ki, és nem tároljuk. Több fájlnál egyszerre a védett darab kimarad — előbb vedd le róla a jelszót a jelszó-eltávolítóval.
Miért lett üres a dokumentum, vagy miért hiányzik a szöveg?
Mert a PDF-ben nem szöveg volt, hanem kép — beszkennelt vagy lefotózott oldal. Ilyenkor a lap már az átalakítás előtt szól, és a szövegfelismerőre mutat. Ha csak néhány oldal ilyen, az eredmény alatt jelezzük, hány oldalon nem találtunk szöveget.
Mekkora PDF-et bír el?
A korlát a gépeden lévő memória: egy több száz oldalas, képekkel teli dokumentum is átmegy egy laptopon, telefonon a 100 MB fölötti fájlok már lassúak lehetnek. Egyszerre legfeljebb tíz fájlt dolgozunk fel, a képeket legfeljebb 2000 képpont szélességre kicsinyítjük, hogy a Word-fájl ne legyen óriási.
Megnyílik Google Docsban és LibreOffice-ban is?
Igen. Szabványos .docx fájlt írunk, beépített címsorstílusokkal és valódi listaszámozással, ezért a Word, a Google Docs, a LibreOffice és a Pages is ugyanúgy nyitja meg — a navigációs panel és a tartalomjegyzék is működik belőle.