Ekstrahirajte tekstove iz slika i PDF-ova pomoću Online OCR-a u samo nekoliko koraka

Zadnje ažuriranje: 14 Travanj 2020

izdvajanje tekstova s ​​online OCR-om
Mogućnost izvlačenja tekstova s ​​Online OCR-om postaje neophodna kada iz nekog razloga u naše ruke dođe slika s tekstovima koji su u njoj uključeni, a mora biti Ručno prepišite sadržaj u tekstualni dokument. Prednost je što se ova situacija može izbjeći upotrebom ove zanimljive web aplikacije.
Najbolje od svega je kompatibilnost koju ovaj alat nudi, jer izdvajanje tekstova sa OCR na mreži Ne primjenjuje se samo na slike (s nekom vrstom teksta uključenim u njih), već također može biti koristiti isti alat za PDF datoteke; U ovom ćemo članku spomenuti oba aspekta na razigran način, gdje ćemo analizirati prednosti i nedostatke koje nam web aplikacija nudi kada se bavimo oba elementa.

Kako ekstrahirati tekstove s online OCR-om u slikama

Kako bismo to postigli, predložit ćemo prilično jednostavan primjer, u kojem ćemo pokušati pronaći sliku koja se nalazi na Internetu, a koja bi trebala sadržavati neku vrstu važne fraze koju bismo možda trebali upotrijebiti.

  • Prvo bismo mogli otvoriti naš internetski preglednik (što bi mogao biti Google Chrome).
  • Posvećeni smo traženju samo slika.
  • Pokušavamo pronaći «najbolje poznate fraze”.
  • Iz dobivenih rezultata preuzmimo jedan ili više (u potonjem slučaju mogli bismo upotrijebiti odgovarajući dodatak za grupno preuzimanje).
  • Idemo na našu web aplikaciju za izdvajanje tekstova OCR na mreži.
  • U sučelju ovog alata biramo gumb «ispitati”.
  • Klikom na gumb «Postavi”.
  • Kasnije konfiguriramo jezik na kojem se sadržaj (tekst) nalazi unutar slike koju smo preuzeli.
  • Također možemo odabrati izlazni format teksta koji će biti ekstrahiran ovom metodom.
  • Kliknemo na gumb Prepoznati i pišemo znakove koje je predložio Captcha.

izdvajanje tekstova s ​​Online OCR 01
Nakon nekoliko sekundi moći ćemo se diviti rezultatu onoga što smo učinili, ovo kada pokušavamo izdvojiti tekstove s OCR na mreži primijenjen na slike. Mogli bismo zaključiti da je prepoznavanje 90% učinkovito, s obzirom na to da određene riječi i slova nisu u potpunosti identificirani.
važne-fraze
Ovo ima objašnjenje, jer slika koju smo odabrali koristi poseban font, koji se prilikom definiranja okruglih znakova mogu međusobno zamijeniti u metodi prepoznavanja.

Ekstrahirajte tekstove pomoću Online OCR-a u PDF datotekama

Postupak je donekle sličan onome što smo prethodno predložili, iako ako ćemo pokušati prepoznati sav sadržaj PDF datoteke, možda ga već imamo pohranjenog na našem računalu. Ovdje postoje 2 faktora za analizu, a jedan od njih je da se razmatra PDF datoteka u kojoj se nalaze slike koje su pretvorene u ovu vrstu formata, gdje ćemo sigurno dobiti kao rezultat učinkovitost vrlo sličnu postupku koji smo prethodno izveli.
Ali ako PDF dokument ima tekst koji se može izbjeći (nekom specijaliziranom aplikacijom kao što je PDF Writer), tada će prepoznavanje biti učinkovitije od onoga što je prikazano na slikama, jer slova (ili svaki znak u PDF datoteci) postoje i ne zahtijevaju restrukturiranje da bi bili prepoznati ovom metodom.
izdvajanje tekstova s ​​Online OCR 03
Sada, iako ova aplikacija za izdvajati tekstove sa OCR na mreži Prikazuje se kao potpuno besplatna usluga, situacija se komplicira ako naša PDF datoteka sadrži veliki broj stranica; Iako možete preuzeti sav sadržaj generiran pomoću ovog alata, na dnu se pojavljuje prozor upozorenja gdje se korisnik usluge obavještava da Za pristup više značajki potrebna je registracija i uz to, koristite prepoznavanje za znatno velike slike, PDF datoteke s velikim brojem stranica, koristite širok izbor jezika među mnogim drugim alternativama.
Više informacija - Pregled: Kako jednostavno preuzeti slike s Image Downloaderom, Stvaranje i uređivanje PDF datoteka u sustavu Windows 8 s Drawboardom
Mreža - onlineocr