Tekst ze zdjęcia – zamiana zdjęcia na tekst
Przeciągnij zdjęcie, skan lub zrzut ekranu, wybierz język i kliknij „Rozpoznaj tekst” – potem skopiuj tekst albo zapisz go jako plik .txt. Rozpoznawanie działa w całości w Twojej przeglądarce, obraz nie jest nigdzie wysyłany.
Jak to obliczamy
Optyczne rozpoznawanie znaków (OCR) zamienia piksele obrazu z powrotem na litery: zdjęcie listu, zeskanowana faktura czy zrzut ekranu dokumentu stają się tekstem, który można skopiować, przeszukać i edytować. To narzędzie do wyciągania tekstu ze zdjęcia korzysta z Tesseract – najbardziej znanego silnika OCR o otwartym kodzie, skompilowanego do WebAssembly i działającego bezpośrednio w przeglądarce.
Jak to działa
- Przeciągnij obraz, wybierz plik albo wklej go skrótem Ctrl + V (np. zrzut ekranu ze schowka).
- Sprawdź język tekstu na obrazie. Domyślnie wybrany jest polski; dostępne są też angielski, niemiecki, francuski, hiszpański, portugalski, włoski, niderlandzki i turecki.
- Kliknij „Rozpoznaj tekst”. Pasek postępu pokazuje, czy dane jeszcze się wczytują, czy tekst jest już rozpoznawany.
- W razie potrzeby popraw tekst w polu, a potem go skopiuj lub zapisz jako plik .txt.
Wskazówki dla dokładnych wyników
- Kontrast: najlepiej sprawdza się ciemny tekst na jasnym, jednolitym tle. Cienie, gradienty, wzory czy znaki wodne za tekstem obniżają dokładność.
- Zdjęcie na wprost: fotografuj stronę prosto z góry, nie pod kątem. Mocno pochylone lub zakrzywione wiersze (np. przy grzbiecie książki) są rozpoznawane znacznie gorzej.
- Rozdzielczość: przy skanowaniu przyjmuje się zwykle ok. 300 dpi. Na zdjęciu tekst musi więc być odpowiednio duży – wielkie litery powinny mieć co najmniej ok. 20 pikseli wysokości. Narzędzie samo powiększa bardzo małe obrazy (maksymalnie 2×) i zmniejsza bardzo duże do 5000 pikseli na dłuższym boku.
- Kadrowanie: zostaw tylko obszar z tekstem – bez marginesów, palców czy krawędzi stołu. Przy zrzutach ekranu lepiej uchwycić samo okno niż cały ekran.
- Właściwy język: język decyduje o słowniku i zestawie znaków. Przy „angielskim” brakuje liter takich jak ą, ę, ł, ś czy ż – dlatego do polskich tekstów wybieraj „Polski”.
Ograniczenia
Tesseract jest przeznaczony do tekstu drukowanego. Pismo odręczne rozpoznaje słabo, podobnie jak bardzo ozdobne czcionki, szyldy sfotografowane pod dużym kątem czy tekst na niespokojnym tle. Tabele i układy wielokolumnowe trafiają do wyniku jako ciągły tekst, a kolejność kolumn może się przesunąć. Wyświetlana pewność to średnia, którą Tesseract podaje dla wszystkich słów; poniżej ok. 70 % warto zrobić lepsze zdjęcie. Ważne liczby (kwoty, numery kont, numery faktur, NIP) zawsze sprawdzaj ręcznie: pomyłki typu 0/O, 1/l czy 5/S zdarzają się nawet przy dobrych oryginałach.
Przy pierwszym użyciu pobierane są dane
Aby rozpoznawanie działało bez serwera, przy pierwszym kliknięciu „Rozpoznaj tekst” przeglądarka pobiera silnik rozpoznawania (ok. 3,7 MB, w transferze ok. 1,5 MB po kompresji) oraz dane wybranego języka: polski 2,5 MB, angielski 2,8 MB, niemiecki 1,3 MB, turecki 2,0 MB. Wszystkie pliki pochodzą z tej strony – nie jest używana żadna zewnętrzna sieć CDN. Przeglądarka przechowuje dane językowe lokalnie (IndexedDB), więc kolejne uruchomienie jest znacznie szybsze. Rozpoznanie strony trwa kilka sekund, zależnie od urządzenia i wielkości obrazu.
Prywatność
Twój obraz nie opuszcza urządzenia. Rozpoznawanie odbywa się w całości w przeglądarce (w web workerze), a rozpoznany tekst również nigdzie nie jest wysyłany. Po zamknięciu karty nic nie zostaje – tylko pobrane dane językowe pozostają w pamięci przeglądarki, dopóki ich nie usuniesz.
Wskazówka: wcześniejsze wycięcie nieostrych krawędzi narzędziem przycinanie zdjęć poprawia rozpoznawanie.
Najczęściej zadawane pytania
Czy moje zdjęcie jest gdzieś wysyłane?
Nie. Rozpoznawanie tekstu działa w całości w przeglądarce. Pobierane są tylko silnik rozpoznawania i dane językowe – z tej strony, nie od podmiotów trzecich. Obraz i tekst zostają na Twoim urządzeniu.
Jak skopiować tekst ze zdjęcia na komputerze?
Otwórz tę stronę, przeciągnij zdjęcie lub wklej je skrótem Ctrl + V, wybierz język i kliknij „Rozpoznaj tekst”. Potem kliknij „Kopiuj tekst” i wklej go np. do Worda lub e-maila.
Jakie języki są obsługiwane?
Polski, angielski, niemiecki, francuski, hiszpański, portugalski, włoski, niderlandzki i turecki. Język tej strony jest wybrany domyślnie. Wybierz język tekstu na obrazie – w przeciwnym razie brakuje polskich znaków, takich jak ą, ł czy ż, a rozpoznawanie słów jest mniej dokładne.
Czy narzędzie odczyta pismo odręczne?
Raczej nie. Tesseract jest wytrenowany na tekście drukowanym. Bardzo staranne drukowane litery czasem się udają, zwykłe pismo odręczne praktycznie nigdy.
Dlaczego w tekście są błędy?
Zwykle winny jest obraz: za mały, nieostry, przekrzywiony, o słabym kontraście lub z niespokojnym tłem. Sfotografuj stronę prosto z góry przy dobrym świetle, przytnij do tekstu i sprawdź wybrany język. Dobrym punktem odniesienia jest ok. 300 dpi.
Czy mogę skopiować tekst ze zrzutu ekranu?
Tak. Zrób zrzut ekranu (Windows: Win + Shift + S, Mac: Cmd + Shift + 4), wklej go tutaj skrótem Ctrl + V i kliknij „Rozpoznaj tekst”. Zrzuty ekranu są zwykle idealne: ostre, proste i kontrastowe.
Czy to działa z plikami PDF?
Nie bezpośrednio – narzędzie odczytuje obrazy. Przy zeskanowanym PDF zrób zrzut ekranu strony lub wyeksportuj ją jako obraz i wklej tutaj. Jeśli PDF zawiera już tekst, po prostu zaznacz go i skopiuj w przeglądarce PDF.
Dlaczego pierwsze uruchomienie trwa dłużej?
Za pierwszym razem przeglądarka pobiera silnik rozpoznawania (ok. 1,5 MB po kompresji) i dane językowe (polski 2,5 MB). Dane językowe są potem zapisane w przeglądarce, więc kolejne obrazy idą szybciej.
Źródła i podstawa prawna
- Tesseract.js – biblioteka OCR dla przeglądarki (GitHub, Apache-2.0)
- Dokumentacja Tesseract OCR – poprawa jakości rozpoznawania (po angielsku)
- Licencje: Tesseract.js, silnik Tesseract i dane językowe (Apache-2.0)
Stan na:
Podobne narzędzia
- Usuwanie spacji i enterów z tekstuUsuwanie spacji online: podwójne spacje, entery, puste wiersze i niewidoczne znaki, duplikaty wierszy, sortowanie list. Za darmo, w przeglądarce.
- Licznik znaków i licznik słówLicznik znaków online: policz znaki ze spacjami i bez, słowa, zdania, akapity i czas czytania – na żywo, z limitami X, Instagrama, TikToka i SMS.
- Zmiana wielkości literZmiana wielkości liter online: zamień duże litery na małe i odwrotnie, Title Case, zdania, camelCase, snake_case. Za darmo, od razu, w przeglądarce.
- Kompresja zdjęć – zmniejsz rozmiar plikuKompresja zdjęć bez wysyłania na serwer: zmniejsz rozmiar JPG, PNG, WebP i HEIC, do 20 naraz, z docelowym rozmiarem w KB i pobieraniem ZIP. Za darmo.
- Czcionki do skopiowaniaZamień tekst na pogrubiony, kursywę, pismo odręczne, gotyk i ponad 20 innych czcionek do skopiowania na Instagram, TikTok lub Discord – z uwagą o dostępności.
- Czytanie tekstu na głos: tekst na mowęCzytanie tekstu na głos online za darmo: wybierz głos, ustaw tempo i wysokość, śledź czytane słowa, wstrzymaj i zatrzymaj. Bez rejestracji, głosy lokalne.