Распознаёт текст на фотографии или скане документа и отдаёт его редактируемым. Русский и английский, включая смешанные документы.
Инструмент подходит, когда у вас есть снимок или скан печатного документа, а нужен текст, который можно править. Типичные запросы: перенести договор из бумажной копии в файл, вытащить текст из отсканированной страницы книги, собрать содержимое инструкции или письма, чтобы дополнить его или переслать. На выходе вы получаете файл .txt с сохранённым порядком строк и абзацев.
Чтобы результат был чище, сфотографируйте документ при ровном свете, без бликов и теней, и старайтесь поместить страницу целиком в кадр. Загрузите снимок или PDF. Распознаётся русский и английский, в том числе документы, где эти языки смешаны в одном тексте.
Обработка идёт на нашем сервере: снимок остаётся в памяти во время работы и удаляется сразу после выдачи текста, наружу файл не уходит. Это важно, если вы работаете с личными или служебными документами и не хотите оставлять их следы в сторонних сервисах.
Распознавание не бывает стопроцентным, поэтому полученный .txt стоит вычитать. На хорошем скане печатного текста точность составляет около 98 процентов, но даже это означает, что часть символов может быть прочитана неверно. Сравните текст с исходным снимком построчно, особенно в местах, важных для смысла.
Отдельно проверьте цифры, номера, даты, суммы и имена собственные — именно здесь ошибка распознавания опаснее всего и легко проходит мимо взгляда. Обратите внимание на похожие символы: ноль и буква О, единица и буква, тире и дефис. Порядок строк и абзацев обычно сохраняется, но таблицы и колонки могут перестроиться, поэтому структуру тоже стоит сверить.
Если документ имеет юридическое значение — договор, доверенность, официальное письмо — распознанный текст остаётся черновиком, а не заверенной копией. Для точной сверки и подготовки итоговой версии полагайтесь на исходный документ и, при необходимости, на специалиста, который отвечает за содержание.
На снимке, сделанном телефоном под углом, качество распознавания заметно ниже, чем на ровном скане. Причина в перспективе: строки идут наклонно, часть страницы уходит в тень, края теряют резкость. Перед загрузкой выпрямите перспективу, чтобы страница выглядела прямоугольной, а строки шли ровно.
Помогает и правильный свет: снимайте при равномерном освещении, без бликов от лампы и без теней от руки или телефона. Постарайтесь, чтобы страница целиком попала в кадр и была в фокусе — обрезанные строки распознать нельзя.
Если снимок изначально нечёткий или сделан в спешке, иногда проще переснять документ, чем вычитывать много ошибок. Один аккуратный кадр обычно даёт более чистый текст, чем несколько торопливых.
Лучше всего инструмент справляется с печатным текстом при ровном свете, когда страница целиком в кадре и шрифт достаточно крупный. Это обычные документы, письма, страницы книг и распечаток. В таких случаях вычитка сводится к беглой проверке.
Хуже распознаются рукописный текст, печати и штампы поверх строк, факсы, а также копии копий, где буквы уже расплылись. Рукописный текст инструмент не распознаёт вовсе — он рассчитан только на печатный. Столбцы с мелким шрифтом на смятой бумаге тоже плохой материал: вычитывать придётся значительную часть, и выигрыша во времени может не остаться.
Если ваш документ ближе к сложным случаям, оцените заранее, устроит ли вас черновой результат с последующей правкой. Иногда разумнее набрать короткий текст вручную или обратиться к тому, кто работает с таким типом бумаг постоянно.
Эта страница решает узкую задачу: превратить изображение документа — фотографию или скан — в редактируемый текст. Она нужна тогда, когда исходник существует только на бумаге или в виде картинки, и текст из него нельзя просто выделить и скопировать.
Если у вас уже есть цифровой файл с текстовым слоем, например обычный PDF или документ, из которого текст выделяется мышью, распознавание вам не требуется — текст можно скопировать напрямую. Инструмент имеет смысл именно для сканов и снимков, где текст является частью изображения.
Итог работы — файл .txt без оформления: он удобен для дальнейшей правки, переноса в другой документ или отправки. Форматирование, разметку и стили вы добавляете уже сами в привычном редакторе после того, как вычитали распознанный текст.