Сканер текста: как распознать текст с фото нейросетью
Коротко. Сканер текста нужен, когда текст есть только на картинке: страница учебника, договор на бумаге, скриншот, слайд с лекции, рукописный конспект. Короткую надпись телефон распознает сам, а вот длинный документ, таблицу или почерк лучше отдать нейросети: она не только скопирует текст с фото, но и сохранит структуру, переведёт или сразу сделает выжимку. Ниже — какой способ выбрать, как снимать, готовые промпты и как не пропустить ошибку распознавания.
Чем распознать текст с фото: 4 способа
Задача одна — превратить картинку в текст, который можно выделить и скопировать. Но инструменты справляются с ней по-разному.
| Способ | Сильная сторона | Где слабее | Когда брать |
|---|---|---|---|
| Встроенный сканер телефона | Мгновенно, бесплатно, без интернета | Таблицы, почерк, многостраничные документы | Скопировать номер, адрес, абзац |
| Приложения-сканеры (Google Lens, Яндекс) | Распознавание и перевод с камеры | Плохо держат структуру длинного текста | Вывеска, меню, этикетка |
| Классический OCR (ABBYY FineReader и аналоги) | Точно копирует печатный текст, сохраняет вёрстку | Рукопись, плохие снимки; платный | Архив сканов, книги, PDF |
| Нейросеть с распознаванием изображений | Понимает смысл: таблицы, почерк, формулы, сразу обрабатывает текст | Может «исправить» оригинал, если не запретить | Конспекты, документы, таблицы, сложные снимки |
Главное отличие нейросети в том, что после распознавания можно сразу продолжить работу: «сделай из этого таблицу», «переведи на русский», «найди в договоре сроки и штрафы». Классический сканер текста просто отдаёт буквы, а дальше вы разбираетесь сами.
Как скопировать текст с фото нейросетью: пошагово
- Снимите ровно. Телефон параллельно листу, весь текст в кадре, без пальцев на краях. Перекос в пару градусов модель переживёт, а загнутую страницу книги — хуже.
- Свет без бликов. Дневной свет сбоку, без вспышки: глянцевая бумага и экран монитора дают блик, под которым пропадают целые строки.
- Одна страница — один снимок. Мелкий шрифт на фото разворота модель читает хуже, чем две отдельные страницы.
- Прикрепите фото в чат. Подойдёт модель, которая понимает изображения: GPT, Claude, Gemini, Qwen. Многостраничный скан удобнее загрузить одним PDF.
- Скажите, что делать с текстом. Дословно, с абзацами, таблицей или списком — от этого зависит результат.
Если документ уже лежит в PDF или Word, сканер вообще не нужен: о том, как задавать вопросы по файлу целиком, — на странице нейросеть для документов и файлов.
Готовые промпты для распознавания
Дословно, как в оригинале.
Перепиши весь текст с фото дословно. Ничего не исправляй, не
сокращай и не додумывай. Сохрани абзацы и нумерацию. Если слово
не читается, пиши [неразборчиво].
Таблица с фото.
На фото таблица. Перенеси её в таблицу с теми же столбцами и
строками. Числа копируй точно, пустые ячейки оставь пустыми.
Отдельно перечисли ячейки, в которых не уверен.
Распознать и сразу обработать.
Распознай текст договора на фото. Затем выпиши: стороны, сумму,
сроки, штрафы и условия расторжения — со ссылкой на пункт.
Распознайте текст со своего фото
GPT, Claude и Gemini читают фото и сканы — в одном окне, без VPN и подписки.
Открыть Умку →Рукописный текст и сложные случаи
- Почерк. Аккуратный конспект современные модели читают почти без ошибок, «врачебный» почерк — с пропусками. Помогает подсказка: «это конспект по органической химии» — модель охотнее узнает термины.
- Формулы. Попросите записать их в LaTeX или обычным текстом. Если по фото нужно ещё и решить задачу, смотрите статью решение задач по фото.
- Иностранный текст. Распознавание и перевод делаются одним запросом. Подробно на примере иероглифов — в материале перевод с китайского по фото.
- Газеты и колонки. Текст в две-три колонки обычный сканер склеивает построчно, и получается каша. Нейросети достаточно сказать: «читай по колонкам слева направо».
- Старые документы. Выцветшие письма, архивные справки, дореформенная орфография с «ѣ» и «ъ» на конце слов. Попросите сначала переписать как есть, а затем — отдельным блоком — в современной орфографии.
- Скриншоты переписки. Попросите разметить, кто что написал: «Имя: сообщение», с датами, если они видны.
- Надпись на картинке нужно заменить, а не скопировать? Это другая задача — её решает замена текста на фото.
Как проверить результат
У нейросети есть особенность, которой нет у классического OCR: она читает не буквы, а смысл. Поэтому может молча исправить опечатку в оригинале, дописать обрезанное слово или «округлить» плохо видную цифру. Для конспекта это не страшно, для договора и бухгалтерии — опасно.
- Запрещайте додумывать прямо в запросе — промпт выше это делает.
- Сверяйте числа, даты, имена и реквизиты по фото вручную. Это пять минут, которые экономят часы.
- Сравните две модели. Если GPT и Claude прочитали строку одинаково, ей можно доверять больше. Расхождения сразу показывают проблемные места.
- Просите список сомнений. «Перечисли слова, в которых не уверен» — модель честно назовёт плохо видные места.
Паспорта, банковские карты и медицинские документы лучше не загружать целиком: закройте номера и личные данные, которые не нужны для задачи.
Сколько стоит распознавание в Умке
Умка работает из России без VPN и подписки, оплата в рублях. По текущим меркам умный ответ стоит около 33 токенов, быстрый — 1 токен; запрос с фото или многостраничным PDF может стоить больше — цена видна до отправки. При регистрации дают 60 токенов, карта не нужна. Пакеты пополнения:
- 290 ₽ — 725 токенов: около 21 умного ответа;
- 690 ₽ — 1 811 токенов: около 54;
- 1 490 ₽ — 4 172 токена: около 126;
- 3 900 ₽ — 11 700 токенов: около 354.
Токены не сгорают, платите только за то, что распознали.
Вывод
Для пары строк хватит сканера текста в телефоне. Если нужно распознать текст с фото целиком — с абзацами, таблицами, почерком — и сразу что-то с ним сделать, удобнее нейросеть. Снимайте ровно и без бликов, просите переписать дословно и отмечать неразборчивое, а числа и имена сверяйте с оригиналом.
Частые вопросы
Как скопировать текст с фото на телефоне?
Для короткой надписи хватит встроенного сканера: на iPhone — «Текст на фото», на Android — Google Lens в камере или галерее. Для длинного документа, таблицы или рукописи удобнее нейросеть: прикрепите фото в чат и попросите переписать текст дословно, сохранив абзацы.
Может ли нейросеть распознать рукописный текст?
Да, аккуратный почерк современные модели читают хорошо, а неразборчивый — с ошибками. Попросите отмечать сомнительные слова как [неразборчиво] и сверьте их с оригиналом вручную, особенно имена, числа и даты.
Почему распознанный текст отличается от оригинала?
Языковая модель не просто считывает буквы, а понимает смысл и может «исправить» опечатку или дописать обрезанное слово. Поэтому в запросе прямо пишите: «дословно, ничего не исправляй и не додумывай», а цифры проверяйте по фото.
Можно ли распознать текст из PDF-скана целиком?
Да. Загрузите PDF в чат с моделью, которая работает с документами, и попросите извлечь текст постранично. Для многостраничного скана удобнее просить результат частями — по 5–10 страниц, чтобы проще было проверить.