OT OCR Tools

Wsadowy OCR

Wyodrębniaj tekst z wielu obrazów naraz dzięki prywatnemu OCR w przeglądarce. Przetwarzaj skany i zrzuty ekranu lokalnie i pobierz połączony tekst.

🔒 Działa całkowicie w Twojej przeglądarce — nic nie jest przesyłane

Drop multiple images here or click to browse

Images are OCRed one at a time in this browser tab.

Choose images to begin.

0%

Advertisement

OCR wielu obrazów w jednej karcie przeglądarki

Wsadowy OCR oszczędza czas, gdy masz kilka zrzutów ekranu, zeskanowanych stron, paragonów lub zdjęć, z których potrzebujesz edytowalnego tekstu. Zamiast wysyłać pliki na serwer lub ręcznie przetwarzać obrazy jeden po drugim, wybierasz grupę plików, a to narzędzie przetwarza je po kolei w Twojej przeglądarce. Każdy wynik pojawia się na stronie zaraz po zakończeniu danego obrazu, a połączony plik do pobrania zawiera nagłówki z nazwami plików, dzięki czemu wyodrębniony tekst łatwo przypisać do oryginału.

Przebieg pracy jest prywatny z założenia. Tesseract.js uruchamia optyczne rozpoznawanie znaków lokalnie przy użyciu WebAssembly, więc obrazy pozostają na Twoim urządzeniu. Nie ma kolejki na serwerze, konta ani etapu wysyłania. Przetwarzanie sekwencyjne ułatwia też zrozumienie stanu: pasek postępu pokazuje bieżący plik i procent rozpoznania, a ukończone pliki pozostają widoczne poniżej. To praktyczny sposób na obsługę niewielkich codziennych partii bez instalowania programu OCR na komputerze.

Przygotowanie plików dla lepszego wyniku

Aby uzyskać najlepsze rezultaty, grupuj obrazy w tym samym języku i o podobnej jakości. Wyraźne zrzuty ekranu i proste skany zwykle dają lepszy tekst niż rozmazane zdjęcia. Jeśli obrazy to zdjęcia z telefonu, przytnij tło, unikaj cieni i trzymaj kartkę równolegle do aparatu. OCR może mieć problemy z pismem odręcznym, tabelami, czcionkami ozdobnymi i bardzo małym tekstem, dlatego sprawdź każdy wynik, zanim zaufasz mu w przypadku ważnych dokumentów.

Pierwszy plik może potrwać dłużej, ponieważ przeglądarka pobiera silnik OCR i wybrany model językowy. Potem ten sam przebieg i przyszłe wizyty są zwykle szybsze, bo model jest zapisany w pamięci podręcznej. Duże obrazy zużywają więcej pamięci i wymagają więcej czasu, więc zmniejsz zdjęcia o bardzo wysokiej rozdzielczości, jeśli szybkość jest ważniejsza niż szczegółowość. Nie zamykaj karty podczas przetwarzania wsadu i nie zamykaj przeglądarki, dopóki połączony plik tekstowy nie zostanie pobrany.

Korzystanie z połączonego tekstu OCR

Po zakończeniu przetwarzania pobierz połączony plik .txt do notatek, archiwów, indeksów wyszukiwania lub ręcznej weryfikacji. Każda sekcja zaczyna się od oryginalnej nazwy pliku, po której następuje rozpoznany tekst z tego obrazu. Taki format łatwo wkleić do dokumentów, później podzielić lub porównać z obrazami źródłowymi. Jeśli któryś plik daje słaby wynik, zrób ponownie zdjęcie lub skan tylko tego obrazu i uruchom go jeszcze raz w narzędziu do pojedynczych obrazów. W przypadku zeskanowanych plików PDF użyj narzędzia OCR dla PDF, aby kolejność stron i separatory stron były obsługiwane automatycznie.

Jak używać

  1. Dodaj obrazyUpuść wiele zrzutów ekranu, skanów lub zdjęć albo kliknij, aby wybrać pliki.
  2. Wybierz językWybierz język OCR używany dla wszystkich plików we wsadzie.
  3. Uruchom sekwencyjny OCRPrzeglądarka rozpoznaje jeden obraz naraz i pokazuje postęp dla każdego pliku.
  4. Pobierz połączony tekstSprawdź każdy wynik, a następnie zapisz jeden plik .txt z nagłówkami nazw plików.

Najczęściej zadawane pytania

Czy obrazy we wsadowym OCR są przesyłane?
Nie. Każdy obraz jest przetwarzany lokalnie w Twojej przeglądarce za pomocą Tesseract.js. Pliki i wyodrębniony tekst nie są przesyłane.
Dlaczego pierwszy plik trwa dłużej?
Pierwszy przebieg OCR pobiera silnik i wybrany model językowy. Przeglądarki zwykle zapisują te pliki w pamięci podręcznej, więc kolejne pliki i przyszłe uruchomienia są szybsze.
Czy mogę wykonać OCR wielu obrazów naraz?
Tak, ale narzędzie przetwarza je po kolei, aby postęp był czytelny, a obciążenie przeglądarki mniejsze. Bardzo duże partie mogą zająć trochę czasu.
Jak zorganizowany jest połączony tekst?
Pobierany połączony plik .txt zawiera nagłówek z nazwą pliku przed wynikiem każdego obrazu, dzięki czemu możesz przypisać tekst do pliku źródłowego.
Advertisement