Превращаем сканы в PDF, где текст выделяется, копируется и ищется. Страницы, где текст уже есть, остаются без изменений. Всё в браузере — файл никуда не отправляется.
или перетащите сюда
PDF или фото — до 100 МБ
Форматы:PDFJPGPNG
Распознавание работает прямо в браузере — файл никуда не отправляется. При первом запуске подгружается модуль распознавания (~15 МБ), дальше он берётся из кэша.
Распознать текст в PDF (OCR) онлайн
Сделайте скан или фотографию документа текстом: в готовом PDF текст выделяется, копируется и находится поиском. Распознавание идёт прямо в браузере — файл никуда не отправляется. Бесплатно, без регистрации и водяных знаков.
Как распознать текст
Выберите PDF или фотографию документа — до 100 МБ.
Укажите язык: русский с английским, только русский или только английский.
Нажмите «Распознать». При первом запуске браузер подгрузит модуль распознавания, около 15 МБ.
Скачайте готовый PDF. Выглядит он так же, но текст в нём выделяется и ищется.
Что такое текстовый слой
Скан и фотография — это картинка: поиск по такому документу ничего не находит, а текст из него не скопировать. Распознавание кладёт под изображение страницы невидимый текстовый слой. Внешне документ не меняется — те же страницы, тот же вид, — но теперь текст можно выделить мышью, скопировать и найти поиском.
Это не то же самое, что перевод в Word. Мы не пересобираем документ заново и не подбираем шрифты: вёрстка остаётся ровно такой, какой была на скане. Если текст нужен в Word, выделите его в готовом PDF и вставьте — переносить вручную придётся, зато оформление документа не поедет.
Что получится на выходе
Тот же документ: страницы выглядят как раньше, ничего не перерисовывается.
Текст выделяется мышью, копируется и находится поиском по документу.
Файл сохраняется с пометкой «-ocr» в названии, ваш оригинал остаётся нетронутым.
Фотография превращается в одностраничный PDF с текстовым слоем.
Страницы с текстом остаются как были
Перед работой инструмент проверяет каждую страницу отдельно. Там, где текстовый слой уже есть, страница копируется без изменений: качество не падает, а время не тратится. В конце видно, сколько страниц распознано и сколько скопировано. Если текст есть во всём документе, файл вернётся неизменённым и об этом будет сказано прямо.
От чего зависит точность
<b>Разрешение:</b> для уверенного распознавания скан лучше делать от 300 dpi.
<b>Ровность листа:</b> страница, снятая под углом, читается хуже прямой.
<b>Контраст и чистота:</b> тени, серый фон и пятна мешают распознаванию.
<b>Шрифт:</b> обычный печатный текст читается уверенно, декоративный и мелкий — хуже.
Смазанные и снятые под углом фотографии — снимок лучше сначала выровнять в «Сканере документов».
Мелкий шрифт на затңртой копии: часть символов будет с ошибками.
Таблицы: текст распознаётся, но структура таблицы не восстанавливается.
Распознавание идёт в браузере
Файл не загружается на сервер: и подготовка страниц, и само распознавание происходят на вашем устройстве. Для паспорта, договора или медицинской справки это главное — документ остаётся только у вас, увидеть его мы не можем в принципе. Плата за это одна: при первом запуске браузер скачивает модуль распознавания, около 15 МБ. Дальше он берётся из кэша, и следующие запуски начинаются сразу.
После распознавания
Готовый файл остаётся рабочим документом раздела: его можно сразу подписать, сжать или объединить с другим, не выбирая заново.
Файл не уходит на сервер. При первом запуске подгружается модуль распознавания (~15 МБ), дальше он берётся из кэша.
Частые вопросы
Файл уходит на сервер?
Нет. Распознавание работает прямо в браузере, документ не покидает ваше устройство. Из сети скачивается только сам модуль распознавания, и только при первом запуске.
Почему первый запуск дольше?
Браузер один раз скачивает модуль распознавания, около 15 МБ, и кладёт его в кэш. На мобильном интернете первый раз стоит подождать: это не зависание.
Можно ли получить Word, txt или Excel?
Нет, на выходе PDF с текстовым слоем. Текст в нём выделяется и копируется, поэтому перенести его в Word или в письмо можно вручную.
Какие языки поддерживаются?
Русский и английский, вместе или по отдельности. Для документов, где встречается и то и другое, оставьте «Русский + English».
Распознаётся ли рукописный текст?
Нет, только печатный.
С каким разрешением сканировать?
От 300 dpi. Ниже — символы теряют форму и ошибок становится больше, заметно выше — файл тяжелеет без выигрыша в точности.
Можно ли распознать фото с телефона?
Да, снимок превратится в одностраничный PDF с текстовым слоем. Формат HEIC браузер не читает — сохраните или отправьте фото как JPG.
Инструмент сказал, что распознавать нечего.
Значит, текстовый слой в документе уже есть: он создан не сканером, а редактором. Такой файл возвращается без изменений — портить его пережатием незачем.
Все инструменты бесплатны и работают без регистрации. Документ загружается один раз и остаётся в работе: можно сжать, подписать и объединить его, не выбирая файл заново. Все инструменты Окупаем.