Przejdź do treści
HNarzędzia
pl
Kategorie

Tekst ze zdjęcia online - rozpoznawanie tekstu (OCR) po polsku

Wgraj lub wklej (Ctrl+V) zdjęcie dokumentu, paragonu albo zrzut ekranu - narzędzie rozpozna tekst z polskimi znakami i pokaże go do skopiowania. Rozpoznawanie działa w Twojej przeglądarce.

  • Za darmo
  • Bez rejestracji
  • Prywatne
  • Działa lokalnie

Zaznacz tylko języki, które występują na obrazie - każdy dodatkowy spowalnia rozpoznawanie.

Przeciągnij i upuść pliki tutaj

lub kliknij, aby wybrać z urządzenia

JPG, PNG, WebP, BMP · zdjęcie, skan lub zrzut ekranu · wklej obraz skrótem Ctrl+V

Obraz nie jest nigdzie wysyłany - tekst rozpoznaje Twoja przeglądarka. Z internetu (CDN jsDelivr) pobierany jest tylko silnik OCR i dane wybranych języków.

Jak wyciągnąć tekst ze zdjęcia?

  1. 1.

    Wybierz języki

    Zaznacz języki tekstu na obrazie - domyślnie polski i angielski. Dodatkowo dostępne są niemiecki i ukraiński.

  2. 2.

    Dodaj obraz

    Przeciągnij zdjęcie lub skan, wybierz plik z dysku albo wklej zrzut ekranu skrótem Ctrl+V.

  3. 3.

    Poczekaj na rozpoznanie

    Przy pierwszym użyciu przeglądarka pobiera silnik OCR i dane języków (ok. 7 MB dla polskiego i angielskiego). Rozpoznanie strony A4 trwa zwykle 3-10 sekund.

  4. 4.

    Sprawdź i skopiuj

    Popraw ewentualne błędy w polu tekstowym, a potem kliknij „Kopiuj tekst” lub „Pobierz .txt”.

Jak działa OCR w przeglądarce?

OCR (ang. optical character recognition) to rozpoznawanie znaków na obrazie. Narzędzie korzysta z silnika Tesseract (licencja Apache-2.0) skompilowanego do WebAssembly, z siecią neuronową LSTM wytrenowaną osobno dla każdego języka. Dzięki temu poprawnie odczytuje polskie litery: ą, ć, ę, ł, ń, ó, ś, ź, ż.

Obraz nie jest wysyłany na żaden serwer. Z internetu (CDN jsDelivr) pobierany jest tylko silnik OCR (ok. 1,4 MB) i dane wybranych języków - raz, potem trafiają do pamięci przeglądarki.

Ile danych trzeba pobrać?

ElementRozmiar (jednorazowo)
Silnik OCR (Tesseract 5, WebAssembly)ok. 1,4 MB
Język polskiok. 2,6 MB
Język angielskiok. 2,9 MB
Język niemieckiok. 1,3 MB
Język ukraińskiok. 2,1 MB

Domyślny zestaw (polski + angielski) to łącznie ok. 7 MB. Każdy dodatkowy język wydłuża też rozpoznawanie, więc zaznaczaj tylko te, które naprawdę są na obrazie.

Jak poprawić skuteczność rozpoznawania?

  • Zdjęcie na wprost - fotografuj kartkę prostopadle, bez perspektywy i cienia dłoni.
  • Rozdzielczość - litery powinny mieć co najmniej 20 px wysokości. Małe zrzuty ekranu narzędzie samo powiększa ×2.
  • Kontrast - przy szarym papierze, paragonach i bladym druku włącz opcję „Popraw obraz” (skala szarości i rozciągnięcie kontrastu).
  • Właściwy język - bez zaznaczonego polskiego „ł” i „ę” zamienią się w „t” i „e”.
  • Pismo odręczne - Tesseract jest wytrenowany na druku; odręczne notatki rozpoznaje słabo.

Wskaźnik pewności rozpoznania to średnia ocena silnika dla wszystkich słów. Powyżej 80% tekst zwykle wymaga tylko drobnych poprawek, poniżej 60% warto zrobić lepsze zdjęcie.

Zdjęcie, skan czy PDF?

To narzędzie przyjmuje pojedynczy obraz: JPG, PNG, WebP lub BMP. Wielostronicowe skany zapisane jako PDF rozpoznasz w narzędziu OCR PDF, które przetwarza strona po stronie. Jeśli PDF ma już warstwę tekstową (da się w nim zaznaczyć tekst), szybciej będzie użyć PDF na tekst. Rozpoznany tekst możesz potem policzyć w liczniku znaków.

Najczęściej zadawane pytania

Czy OCR rozpoznaje polskie znaki?

+
Tak. Przy zaznaczonym języku polskim silnik rozpoznaje ą, ć, ę, ł, ń, ó, ś, ź i ż. Upewnij się, że polski jest wybrany na liście języków.

Czy moje zdjęcie jest wysyłane na serwer?

+
Nie. Tekst rozpoznaje Twoja przeglądarka. Z internetu pobierany jest tylko silnik OCR i dane językowe (ok. 7 MB, jednorazowo).

Jak skopiować tekst ze zrzutu ekranu?

+
Zrób zrzut ekranu (np. Win+Shift+S lub Cmd+Shift+4), a potem wklej go na tej stronie skrótem Ctrl+V. Tekst pojawi się po kilku sekundach.

Czy narzędzie rozpoznaje pismo odręczne?

+
Tylko w ograniczonym stopniu. Tesseract jest wytrenowany na tekście drukowanym, więc wyraźne pismo drukowanymi literami czasem się uda, ale typowe notatki odręczne - nie.

Dlaczego w tekście są błędy?

+
Najczęstsze przyczyny to rozmyte zdjęcie, perspektywa, słabe oświetlenie lub zły wybór języka. Włącz opcję „Popraw obraz” i zrób zdjęcie na wprost przy dobrym świetle.

Jak wyciągnąć tekst ze skanu PDF?

+
Użyj narzędzia OCR PDF - wczytuje dokument, rozpoznaje tekst na każdej stronie i pozwala pobrać wynik jako .txt.

Aktualizacja: