A kép-PDF konverzió alapelvei
A kép-PDF konverzió lényege, hogy minden egyes kép önálló oldalként jelenjen meg a végleges dokumentumban. A feldolgozás teljes egészében a böngészőben történik: a képek soha nem hagyják el a számítógépet, nem töltődnek fel semmilyen szerverre. Ez a megközelítés alapvetően eltér a hagyományos online konverterektől, ahol a fájlokat először feltöltik, majd a szerveren dolgozzák fel, és végül visszatöltik az eredményt. Itt nincs adatküldés, nincs várakozás a feltöltésre, és nincs kockázata annak, hogy illetéktelenek hozzáférjenek a képekhez.
Minden bemeneti kép pontosan egy oldalt hoz létre a PDF-ben. Az oldalak sorrendje megegyezik a fájlok hozzáadásának sorrendjével – ezt a sorrendet később nem lehet megváltoztatni. A PDF nem tartalmaz szöveges réteget, így a létrejövő dokumentum nem kereshető, hacsak utólag nem alkalmazunk optikai karakterfelismerést (OCR). Ez a korlát abból fakad, hogy a PDF-be a képek raszteres grafikaként épülnek be, a bennük lévő szöveget a program nem ismeri fel és nem kódolja át karakterekké.
Bemeneti fájlformátumok és korlátaik
A konverter kizárólag képfájlokat fogad el. Támogatott formátumok:
- JPEG/JPG – a legelterjedtebb veszteséges tömörítésű formátum, jellemzően fényképekhez.
- PNG – veszteségmentes tömörítés, átlátszóság támogatással, ideális ábrákhoz, diagramokhoz.
- WebP – a Google által fejlesztett formátum, amely mind veszteséges, mind veszteségmentes tömörítést kínál, jellemzően kisebb fájlméretet biztosít, mint a JPEG vagy PNG.
- AVIF – az AV1 kodekre épülő, modern formátum; kiváló tömörítési hatékonyságú, de a régebbi eszközök és böngészők nem mindig támogatják.
- GIF – 256 színre korlátozott, veszteségmentes tömörítésű formátum, animációt is hordozhat (de a PDF-ben csak az első képkocka jelenik meg, mivel a PDF nem támogatja a mozgó képeket).
- HEIC/HEIF – a High Efficiency Image File Format, amelyet az Apple eszközök használnak alapértelmezetten; tömörítési hatékonysága jobb a JPEG-énél.
Egyetlen konverzió során legfeljebb 20 kép egyesíthető. Ha 20-nál több fájlt próbálunk hozzáadni, a program a „Válasszon ki legfeljebb 20 képet egyszerre!” üzenettel jelzi a hibát. Ez a korlát gyakorlati okokból létezik: a böngészők memóriája véges, és a nagyon sok kép egyidejű feldolgozása túlterhelheti a rendszert.
Minden egyes fájl mérete legfeljebb 80 MB lehet. A 80 MB-os határ a gyakorlatban azt jelenti, hogy egy tipikus 24 megapixeles JPEG (kb. 10-15 MB) vagy egy nagy felbontású PNG (gyakran 20-40 MB) még belefér, de egy extrém nagy felbontású, mondjuk 100 MB-os PNG már nem. Ha a fájl mérete meghaladja a 80 MB-ot, a program a „Minden fájl legfeljebb 80 MB lehet.” üzenettel visszautasítja a fájlt.
Hibakezelés és gyakori problémák
A konverzió során többféle hiba léphet fel, amelyekre a program pontos üzenetekkel reagál:
- Nincs fájl kiválasztva: „Válasszon ki legalább egy fájlt!” – a „PDF létrehozása” és a „Törlés” gomb inaktív mindaddig, amíg nem adunk hozzá legalább egy képet.
- Támogatatlan formátum: „Válasszon képfájlokat: JPG, PNG, WebP, AVIF, GIF, HEIC vagy HEIF.” – például ha egy.docx,.pdf vagy.txt fájlt próbálunk hozzáadni.
- Üres fájl: „Ez a fájl üres.” – ha egy fájl 0 bájtos, vagy a tartalma nem értelmezhető képként.
- Sérült vagy nem valódi kép: „Ezt a képet nem sikerült dekódolni. Lehet, hogy sérült, vagy valójában nem kép.” – előfordulhat, ha a fájl kiterjesztése nem egyezik a tényleges formátummal, vagy ha a fájl sérült.
- Ismeretlen hiba: „Ezt a fájlt nem sikerült átalakítani.” – általános hibajelzés, ha a fenti kategóriák egyike sem illik a helyzetre.
- Több fájl is hibás: „‹szám› fájlt nem sikerült feldolgozni.” – ez az üzenet akkor jelenik meg, ha több bemeneti kép sem alakítható át, és a program összegzi a hibákat.
Ezek a hibajelzések a felhasználót segítik abban, hogy pontosan azonosítsa a problémás fájlt, és ne kelljen találgatnia, miért nem sikerült a konverzió.
A PDF szerkezete és az OCR lehetősége
A létrejövő PDF minden oldala egy raszteres (pixelekből álló) képet tartalmaz. Ez azt jelenti, hogy bár a képen látható szöveg emberi szemmel olvasható, a PDF-ben nincs szöveges réteg, így a kereső funkció (Ctrl+F) nem találja meg a szavakat, és a kisegítő technológiák (pl. képernyőolvasók) sem tudják felolvasni a tartalmat. Ez a korlátozás természetes, mivel a konverter nem végez OCR-t, csak a képekből hoz létre oldalakat.
Ha a felhasználónak szüksége van kereshető PDF-re, utólagos OCR alkalmazása szükséges. Ehhez használhatók beépített eszközök (pl. Adobe Acrobat OCR funkciója) vagy ingyenes alternatívák (pl. Tesseract OCR, amely akár parancssorból is futtatható). Az OCR pontossága függ a kép minőségétől, a betűtípusoktól, a szöveg méretétől és a háttér kontrasztjától. A legjobb eredmény érdekében ajánlott a bemeneti képeket 300 DPI felbontásban és tiszta, egyszínű háttérrel biztosítani.
Gyakran Ismételt Kérdések (GYIK)
1. Miért nem lehet a PDF-ben keresni a szöveget?
Mert a konverzió során a képek raszteres grafikaként épülnek be a PDF-be, és a program nem hajt végre optikai karakterfelismerést. A kereshetőséghez utólag OCR-t kell futtatni a PDF-en.
2. Hogyan lehet 20-nál több képet PDF-be egyesíteni?
A konverter egyszerre legfeljebb 20 képet fogad el. Ha több fájlunk van, két lehetőségünk van: vagy több, kisebb PDF-et készítünk (pl. 20-as csoportokban), majd utólag PDF-egyesítővel összefűzzük őket, vagy a képeket előzetesen egyesítjük (pl. egy nagy kollázzsá) a fájlszám csökkentése érdekében.
3. A GIF-ek animációja megjelenik a PDF-ben?
Nem. A GIF első kockája kerül csak be a PDF-be, mivel a PDF formátum nem támogatja a mozgó (animált) képeket. A többi kocka elveszik a konverzió során.
4. Meg lehet változtatni az oldalak sorrendjét a PDF létrehozása után?
Igen, de nem ebben az eszközben. A PDF létrehozása után egy PDF-szerkesztő programmal (pl. Adobe Acrobat, illetve ingyenes alternatívák, mint a PDFsam) átrendezhetők az oldalak. Maga a kép-PDF konverter nem kínál oldalátrendezési lehetőséget.
5. Miért nagyobb a PDF mérete, mint az eredeti képek összmérete?
A PDF saját formátumba csomagolja a képeket, és minden oldalhoz hozzáadja a szükséges metaadatokat. Ezenkívül a PDF belső tömörítése néha eltér a képfájlok eredeti tömörítésétől, ami méretnövekedést okozhat. A gyakorlatban azonban általában a PDF kissé kisebb vagy hasonló méretű, mint az eredeti képek összege.
6. Hogyan kezeljem, ha a konverzió során „Ez a fájl üres.” hibaüzenetet kapok?
Ez azt jelenti, hogy a fájl 0 bájtos, vagy a tartalma nem értelmezhető képként. Ellenőrizze, hogy a fájl tényleg tartalmaz-e adatokat, és hogy a fájlkiterjesztés megfelel-e a valódi formátumnak. Próbálja meg megnyitni a fájlt egy képnézegetőben – ha ott sem jelenik meg, akkor valószínűleg sérült.