Tekst ze zdjęcia – zamiana zdjęcia na tekst

Przeciągnij zdjęcie, skan lub zrzut ekranu, wybierz język i kliknij „Rozpoznaj tekst” – potem skopiuj tekst albo zapisz go jako plik .txt. Rozpoznawanie działa w całości w Twojej przeglądarce, obraz nie jest nigdzie wysyłany.

Przeciągnij i upuść pliki tutaj lub

JPG, PNG, WebP, HEIC, GIF, BMP lub TIFF – jeden obraz, do 50 MB

Wskazówka: obrazy możesz też wkleić skrótem Ctrl + V.

Pliki są przetwarzane tylko w Twojej przeglądarce i nie są nigdzie wysyłane – nie opuszczają Twojego urządzenia.

Najlepsze wyniki: tekst drukowany, zdjęcie zrobione na wprost, ostre, ciemny tekst na jasnym tle, ok. 300 dpi. Pismo odręczne jest rozpoznawane słabo.

Rozpoznany tekst

Wybierz obraz, sprawdź język i kliknij „Rozpoznaj tekst”.

Wynik

Jak to obliczamy

Optyczne rozpoznawanie znaków (OCR) zamienia piksele obrazu z powrotem na litery: zdjęcie listu, zeskanowana faktura czy zrzut ekranu dokumentu stają się tekstem, który można skopiować, przeszukać i edytować. To narzędzie do wyciągania tekstu ze zdjęcia korzysta z Tesseract – najbardziej znanego silnika OCR o otwartym kodzie, skompilowanego do WebAssembly i działającego bezpośrednio w przeglądarce.

Jak to działa

  1. Przeciągnij obraz, wybierz plik albo wklej go skrótem Ctrl + V (np. zrzut ekranu ze schowka).
  2. Sprawdź język tekstu na obrazie. Domyślnie wybrany jest polski; dostępne są też angielski, niemiecki, francuski, hiszpański, portugalski, włoski, niderlandzki i turecki.
  3. Kliknij „Rozpoznaj tekst”. Pasek postępu pokazuje, czy dane jeszcze się wczytują, czy tekst jest już rozpoznawany.
  4. W razie potrzeby popraw tekst w polu, a potem go skopiuj lub zapisz jako plik .txt.

Wskazówki dla dokładnych wyników

Ograniczenia

Tesseract jest przeznaczony do tekstu drukowanego. Pismo odręczne rozpoznaje słabo, podobnie jak bardzo ozdobne czcionki, szyldy sfotografowane pod dużym kątem czy tekst na niespokojnym tle. Tabele i układy wielokolumnowe trafiają do wyniku jako ciągły tekst, a kolejność kolumn może się przesunąć. Wyświetlana pewność to średnia, którą Tesseract podaje dla wszystkich słów; poniżej ok. 70 % warto zrobić lepsze zdjęcie. Ważne liczby (kwoty, numery kont, numery faktur, NIP) zawsze sprawdzaj ręcznie: pomyłki typu 0/O, 1/l czy 5/S zdarzają się nawet przy dobrych oryginałach.

Przy pierwszym użyciu pobierane są dane

Aby rozpoznawanie działało bez serwera, przy pierwszym kliknięciu „Rozpoznaj tekst” przeglądarka pobiera silnik rozpoznawania (ok. 3,7 MB, w transferze ok. 1,5 MB po kompresji) oraz dane wybranego języka: polski 2,5 MB, angielski 2,8 MB, niemiecki 1,3 MB, turecki 2,0 MB. Wszystkie pliki pochodzą z tej strony – nie jest używana żadna zewnętrzna sieć CDN. Przeglądarka przechowuje dane językowe lokalnie (IndexedDB), więc kolejne uruchomienie jest znacznie szybsze. Rozpoznanie strony trwa kilka sekund, zależnie od urządzenia i wielkości obrazu.

Prywatność

Twój obraz nie opuszcza urządzenia. Rozpoznawanie odbywa się w całości w przeglądarce (w web workerze), a rozpoznany tekst również nigdzie nie jest wysyłany. Po zamknięciu karty nic nie zostaje – tylko pobrane dane językowe pozostają w pamięci przeglądarki, dopóki ich nie usuniesz.

Wskazówka: wcześniejsze wycięcie nieostrych krawędzi narzędziem przycinanie zdjęć poprawia rozpoznawanie.

Najczęściej zadawane pytania

Czy moje zdjęcie jest gdzieś wysyłane?

Nie. Rozpoznawanie tekstu działa w całości w przeglądarce. Pobierane są tylko silnik rozpoznawania i dane językowe – z tej strony, nie od podmiotów trzecich. Obraz i tekst zostają na Twoim urządzeniu.

Jak skopiować tekst ze zdjęcia na komputerze?

Otwórz tę stronę, przeciągnij zdjęcie lub wklej je skrótem Ctrl + V, wybierz język i kliknij „Rozpoznaj tekst”. Potem kliknij „Kopiuj tekst” i wklej go np. do Worda lub e-maila.

Jakie języki są obsługiwane?

Polski, angielski, niemiecki, francuski, hiszpański, portugalski, włoski, niderlandzki i turecki. Język tej strony jest wybrany domyślnie. Wybierz język tekstu na obrazie – w przeciwnym razie brakuje polskich znaków, takich jak ą, ł czy ż, a rozpoznawanie słów jest mniej dokładne.

Czy narzędzie odczyta pismo odręczne?

Raczej nie. Tesseract jest wytrenowany na tekście drukowanym. Bardzo staranne drukowane litery czasem się udają, zwykłe pismo odręczne praktycznie nigdy.

Dlaczego w tekście są błędy?

Zwykle winny jest obraz: za mały, nieostry, przekrzywiony, o słabym kontraście lub z niespokojnym tłem. Sfotografuj stronę prosto z góry przy dobrym świetle, przytnij do tekstu i sprawdź wybrany język. Dobrym punktem odniesienia jest ok. 300 dpi.

Czy mogę skopiować tekst ze zrzutu ekranu?

Tak. Zrób zrzut ekranu (Windows: Win + Shift + S, Mac: Cmd + Shift + 4), wklej go tutaj skrótem Ctrl + V i kliknij „Rozpoznaj tekst”. Zrzuty ekranu są zwykle idealne: ostre, proste i kontrastowe.

Czy to działa z plikami PDF?

Nie bezpośrednio – narzędzie odczytuje obrazy. Przy zeskanowanym PDF zrób zrzut ekranu strony lub wyeksportuj ją jako obraz i wklej tutaj. Jeśli PDF zawiera już tekst, po prostu zaznacz go i skopiuj w przeglądarce PDF.

Dlaczego pierwsze uruchomienie trwa dłużej?

Za pierwszym razem przeglądarka pobiera silnik rozpoznawania (ok. 1,5 MB po kompresji) i dane językowe (polski 2,5 MB). Dane językowe są potem zapisane w przeglądarce, więc kolejne obrazy idą szybciej.

Źródła i podstawa prawna

Stan na:

Podobne narzędzia