Jak wyciągnąć tekst ze zdjęcia?
- 1.
Wybierz języki
Zaznacz języki tekstu na obrazie - domyślnie polski i angielski. Dodatkowo dostępne są niemiecki i ukraiński.
- 2.
Dodaj obraz
Przeciągnij zdjęcie lub skan, wybierz plik z dysku albo wklej zrzut ekranu skrótem Ctrl+V.
- 3.
Poczekaj na rozpoznanie
Przy pierwszym użyciu przeglądarka pobiera silnik OCR i dane języków (ok. 7 MB dla polskiego i angielskiego). Rozpoznanie strony A4 trwa zwykle 3-10 sekund.
- 4.
Sprawdź i skopiuj
Popraw ewentualne błędy w polu tekstowym, a potem kliknij „Kopiuj tekst” lub „Pobierz .txt”.
Jak działa OCR w przeglądarce?
OCR (ang. optical character recognition) to rozpoznawanie znaków na obrazie. Narzędzie korzysta z silnika Tesseract (licencja Apache-2.0) skompilowanego do WebAssembly, z siecią neuronową LSTM wytrenowaną osobno dla każdego języka. Dzięki temu poprawnie odczytuje polskie litery: ą, ć, ę, ł, ń, ó, ś, ź, ż.
Obraz nie jest wysyłany na żaden serwer. Z internetu (CDN jsDelivr) pobierany jest tylko silnik OCR (ok. 1,4 MB) i dane wybranych języków - raz, potem trafiają do pamięci przeglądarki.
Ile danych trzeba pobrać?
| Element | Rozmiar (jednorazowo) |
|---|---|
| Silnik OCR (Tesseract 5, WebAssembly) | ok. 1,4 MB |
| Język polski | ok. 2,6 MB |
| Język angielski | ok. 2,9 MB |
| Język niemiecki | ok. 1,3 MB |
| Język ukraiński | ok. 2,1 MB |
Domyślny zestaw (polski + angielski) to łącznie ok. 7 MB. Każdy dodatkowy język wydłuża też rozpoznawanie, więc zaznaczaj tylko te, które naprawdę są na obrazie.
Jak poprawić skuteczność rozpoznawania?
- Zdjęcie na wprost - fotografuj kartkę prostopadle, bez perspektywy i cienia dłoni.
- Rozdzielczość - litery powinny mieć co najmniej 20 px wysokości. Małe zrzuty ekranu narzędzie samo powiększa ×2.
- Kontrast - przy szarym papierze, paragonach i bladym druku włącz opcję „Popraw obraz” (skala szarości i rozciągnięcie kontrastu).
- Właściwy język - bez zaznaczonego polskiego „ł” i „ę” zamienią się w „t” i „e”.
- Pismo odręczne - Tesseract jest wytrenowany na druku; odręczne notatki rozpoznaje słabo.
Wskaźnik pewności rozpoznania to średnia ocena silnika dla wszystkich słów. Powyżej 80% tekst zwykle wymaga tylko drobnych poprawek, poniżej 60% warto zrobić lepsze zdjęcie.
Zdjęcie, skan czy PDF?
To narzędzie przyjmuje pojedynczy obraz: JPG, PNG, WebP lub BMP. Wielostronicowe skany zapisane jako PDF rozpoznasz w narzędziu OCR PDF, które przetwarza strona po stronie. Jeśli PDF ma już warstwę tekstową (da się w nim zaznaczyć tekst), szybciej będzie użyć PDF na tekst. Rozpoznany tekst możesz potem policzyć w liczniku znaków.
Najczęściej zadawane pytania
Czy OCR rozpoznaje polskie znaki?
+
Czy moje zdjęcie jest wysyłane na serwer?
+
Jak skopiować tekst ze zrzutu ekranu?
+
Czy narzędzie rozpoznaje pismo odręczne?
+
Dlaczego w tekście są błędy?
+
Jak wyciągnąć tekst ze skanu PDF?
+
Aktualizacja: