KWALIFIKACJA PGF4 - STYCZEŃ 2016

PYTANIE NR 11.
Program OCR zapewnia
A.
B.
C.
D.
Wyjaśnienie poprawnej odpowiedzi:
OCR (optyczne rozpoznawanie znaków) służy do rozpoznania tekstu w obrazie (np. skanie) i zamiany go na postać możliwą do edycji, kopiowania i wyszukiwania.
Pozostałe opcje dotyczą typowej obróbki obrazu (odszumianie, zmiana rozdzielczości, kompresja), a nie rozpoznawania znaków.

Pełne wyjaśnienie:

OCR to technologia optycznego rozpoznawania znaków, czyli analiza obrazu (np. skanu dokumentu lub zdjęcia strony) w celu wykrycia liter i zamiany ich na tekst cyfrowy. Efektem działania OCR jest zwykle dokument, w którym tekst można edytować, kopiować oraz wyszukiwać (np. eksport do TXT, DOCX albo PDF z warstwą tekstową).

Dlatego poprawna jest odpowiedź: "utworzenie edytowalnego dokumentu tekstowego." – bo to opisuje kluczowy rezultat OCR: przejście od obrazu do znaków.

Dlaczego pozostałe odpowiedzi są niepoprawne?

  • "pozbycie się szumów na skanowanym materiale" – odszumianie to filtracja/retusz obrazu. Może poprawić czytelność i pośrednio podnieść skuteczność OCR, ale nie jest istotą działania OCR.
  • "powiększenie rozdzielczości skanowanego materiału" – zwiększanie rozdzielczości to interpolacja lub ponowne skanowanie w wyższym DPI. OCR nie "dodaje pikseli"; analizuje istniejący obraz i rozpoznaje znaki.
  • "zmniejszenie wielkości pliku zawierającego zeskanowany materiał" – to kompresja (np. JPEG, JBIG2, ZIP) lub optymalizacja zapisu. OCR może czasem wpłynąć na strukturę pliku (np. PDF z tekstem), ale jego podstawowym celem nie jest redukcja rozmiaru.

Wskazówka egzaminacyjna: jeśli w odpowiedziach pojawia się "tekst edytowalny", "rozpoznawanie znaków", "wyszukiwanie w skanie" – to typowe skojarzenia z OCR. Natomiast "szumy", "rozdzielczość", "zmniejszenie pliku" zwykle dotyczą narzędzi obróbki obrazu lub kompresji, nie rozpoznawania tekstu.

Dodatkowe pytania

Dodatkowe pytania (FAQ):
OCR to optyczne rozpoznawanie znaków. Służy do zamiany tekstu widocznego na obrazie (np. skanie dokumentu lub zdjęciu kartki) na tekst cyfrowy, który można kopiować, wyszukiwać i edytować w pliku.
Najczęściej są to skany zapisane jako PDF, JPEG, TIFF lub PNG. Program OCR analizuje obraz w pliku i tworzy warstwę tekstową albo eksportuje wynik do formatu tekstowego (np. TXT, DOCX), zależnie od narzędzia.
Skan bez OCR jest tylko obrazem pikseli, więc litery nie są "znakami" dla komputera. OCR rozpoznaje kształty liter i zamienia je na prawdziwe znaki (np. Unicode), dzięki czemu można je zaznaczać, kopiować i poprawiać.
Nie wprost. Usuwanie szumu, wyostrzanie czy korekcja kontrastu to obróbka obrazu. Może pomóc OCR, bo ułatwia rozpoznanie liter, ale samo OCR dotyczy rozpoznawania znaków i tworzenia tekstu, a nie "naprawy" skanu.
Typowe są pomyłki podobnych znaków (np. "O" i "0", "l" i "1"), błędy przy fontach ozdobnych, słabej jakości skanie, krzywo zeskanowanej stronie lub niskim kontraście. Często potrzebna jest korekta ręczna wyniku.
Gdy skan jest poruszony, ma niski kontrast, jest zaszumiony, ma tło w kolorze lub tekst jest bardzo mały. W takich przypadkach pomaga wyrównanie (deskew), zwiększenie kontrastu, odszumianie i odpowiednie DPI, zanim uruchomisz OCR.
Kompresja zmniejsza rozmiar pliku (np. JPEG w obrazie lub kompresja w PDF), ale nie zamienia obrazu na tekst. OCR tworzy tekst z obrazu i umożliwia wyszukiwanie/edycję. Plik po OCR może być większy lub mniejszy – to nie jest główny cel.
Tak, jeśli OCR dodał do PDF warstwę tekstową. Wtedy wyszukiwarka w czytniku PDF znajduje słowa, mimo że wizualnie nadal widzisz skan. Bez OCR wyszukiwanie nie działa, bo dokument jest tylko obrazem.
Zwykle pomaga wyższa rozdzielczość skanowania (odpowiednie DPI dla tekstu), dobre oświetlenie/skan bez cieni, właściwy kontrast oraz równe ułożenie kartki. Kluczowe jest, aby litery były ostre i nieposzarpane.
Przećwicz cały proces: skan dokumentu, wstępna obróbka (wyrównanie, kontrast), wykonanie OCR i eksport do edytowalnego formatu. Naucz się też odróżniać OCR od filtrów (odszumianie) i od kompresji (zmiana rozmiaru pliku).
info

To pytanie poprawnie rozwiązuje 56% zdających egzamin. średnie

Źródła:

  • Wikipedia (pl): "Optyczne rozpoznawanie znaków" – opis celu i działania OCR, https://pl.wikipedia.org/wiki/Optyczne_rozpoznawanie_znak%C3%B3w - dostęp 2026-02-27
  • Adobe Acrobat Help: "Scan documents to PDF, Adobe Acrobat" (sekcje o rozpoznawaniu tekstu/OCR i możliwości wyszukiwania/edycji), https://helpx.adobe.com/acrobat/using/scanning-documents-pdfs.html - dostęp 2026-02-27
  • Tesseract OCR documentation (opis silnika OCR i konwersji obrazu na tekst), https://tesseract-ocr.github.io/tessdoc/ - dostęp 2026-02-27

Materiały:

  • Dokumentacja programu OCR używanego w pracowni (np. Acrobat, ABBYY, Tesseract) – sekcje o rozpoznawaniu tekstu
  • Materiały dydaktyczne o digitalizacji dokumentów i skanowaniu (podstawy DPI, formaty plików, kompresja)
  • Ćwiczenia praktyczne: skan + OCR + eksport do DOCX/TXT + porównanie jakości rozpoznania

Aktualizacja pytania: 31.03.2026



Aktualizacja pytania: 31.03.2026
📡 Brak połączenia internetowego