Ovaj vodič opisuje kako pretvoriti image u pretraživi PDF pomoću Pythona. Sadrži detalje za postavljanje IDE-a, popis koraka i uzorak koda za pretvaranje slike u čitljiv PDF pomoću Pythona. Uzorak koda može se dodatno poboljšati kako bi se stvorila prilagođena izlazna PDF datoteka prema danim prijedlozima.
Koraci za pretvaranje slike u pretraživi PDF pomoću Pythona
- Postavite okruženje da koristi Aspose.OCR for Python via .NET za pretvaranje skeniranih JPG u PDF
- Uvezite OCR biblioteku za prepoznavanje teksta iz JPG-a i spremite tekst u PDF
- Postavite mapu za ulazne slike i izlazne PDF datoteke
- Instancirajte OCR engine za prepoznavanje teksta sa skenirane slike.
- Učitajte skeniranu sliku za obradu koristeći klasu OcrInput.
- Pokrenite proces prepoznavanja za izdvajanje teksta
- Ispisati tekst za korisničke informacije
- Spremi svaki segment teksta u zaseban PDF
Gornji koraci obuhvaćaju proces pretvaranja slike u pretraživi PDF pomoću Pythona. Uvezite potrebnu Aspose biblioteku, primijenite licencu, postavite potrebne mape, instancirajte OCR motor i stvorite OcrInput objekt za pohranu slika potrebnih za obradu. Pokrenite metodu recognize () Za dohvaćanje teksta, iterirajte kroz popis rezultata, prikažite svaki rezultat i spremite svaki u zasebnu PDF datoteku.
Kod za pretvaranje slike u čitljiv PDF pomoću Pythona
Gornji uzorak koda pokazuje kako pretvoriti JPG u čitljiv PDF koristeći Python. Za poboljšanje procesa konverzije, možete isprobati RecognitionSettings za promjenu ponašanja, poput postavljanja jezika prepoznavanja, omogućavanja automatske inverzije boja ili omogućavanja povećanja malog fonta. Također možete postaviti popis dopuštenih ili ignoriranih znakova, koristiti recognize_fast() umjesto recognize() za visokokvalitetne slike i provjeriti result.Iskrivljenost za rukovanje nagnutim skeniranjem.
Ovaj vodič objašnjava postupak primjene OCR-a na sliku i spremanje rezultata u PDF datoteku. Za uklanjanje šuma s slike, pogledajte članak Uklanjanje šuma s slike pomoću Pythona.