← Блог Инструкция

Сканер текста: как распознать текст с фото нейросетью

· · 6 минут чтения
Смартфон сканирует бумажный документ, строки текста переносятся на экран ноутбука

Коротко. Сканер текста нужен, когда текст есть только на картинке: страница учебника, договор на бумаге, скриншот, слайд с лекции, рукописный конспект. Короткую надпись телефон распознает сам, а вот длинный документ, таблицу или почерк лучше отдать нейросети: она не только скопирует текст с фото, но и сохранит структуру, переведёт или сразу сделает выжимку. Ниже — какой способ выбрать, как снимать, готовые промпты и как не пропустить ошибку распознавания.

Чем распознать текст с фото: 4 способа

Задача одна — превратить картинку в текст, который можно выделить и скопировать. Но инструменты справляются с ней по-разному.

СпособСильная сторонаГде слабееКогда брать
Встроенный сканер телефонаМгновенно, бесплатно, без интернетаТаблицы, почерк, многостраничные документыСкопировать номер, адрес, абзац
Приложения-сканеры (Google Lens, Яндекс)Распознавание и перевод с камерыПлохо держат структуру длинного текстаВывеска, меню, этикетка
Классический OCR (ABBYY FineReader и аналоги)Точно копирует печатный текст, сохраняет вёрсткуРукопись, плохие снимки; платныйАрхив сканов, книги, PDF
Нейросеть с распознаванием изображенийПонимает смысл: таблицы, почерк, формулы, сразу обрабатывает текстМожет «исправить» оригинал, если не запретитьКонспекты, документы, таблицы, сложные снимки

Главное отличие нейросети в том, что после распознавания можно сразу продолжить работу: «сделай из этого таблицу», «переведи на русский», «найди в договоре сроки и штрафы». Классический сканер текста просто отдаёт буквы, а дальше вы разбираетесь сами.

Как скопировать текст с фото нейросетью: пошагово

  1. Снимите ровно. Телефон параллельно листу, весь текст в кадре, без пальцев на краях. Перекос в пару градусов модель переживёт, а загнутую страницу книги — хуже.
  2. Свет без бликов. Дневной свет сбоку, без вспышки: глянцевая бумага и экран монитора дают блик, под которым пропадают целые строки.
  3. Одна страница — один снимок. Мелкий шрифт на фото разворота модель читает хуже, чем две отдельные страницы.
  4. Прикрепите фото в чат. Подойдёт модель, которая понимает изображения: GPT, Claude, Gemini, Qwen. Многостраничный скан удобнее загрузить одним PDF.
  5. Скажите, что делать с текстом. Дословно, с абзацами, таблицей или списком — от этого зависит результат.

Если документ уже лежит в PDF или Word, сканер вообще не нужен: о том, как задавать вопросы по файлу целиком, — на странице нейросеть для документов и файлов.

Готовые промпты для распознавания

Дословно, как в оригинале.

Перепиши весь текст с фото дословно. Ничего не исправляй, не
сокращай и не додумывай. Сохрани абзацы и нумерацию. Если слово
не читается, пиши [неразборчиво].

Таблица с фото.

На фото таблица. Перенеси её в таблицу с теми же столбцами и
строками. Числа копируй точно, пустые ячейки оставь пустыми.
Отдельно перечисли ячейки, в которых не уверен.

Распознать и сразу обработать.

Распознай текст договора на фото. Затем выпиши: стороны, сумму,
сроки, штрафы и условия расторжения — со ссылкой на пункт.

Распознайте текст со своего фото

GPT, Claude и Gemini читают фото и сканы — в одном окне, без VPN и подписки.

Открыть Умку →

Рукописный текст и сложные случаи

  • Почерк. Аккуратный конспект современные модели читают почти без ошибок, «врачебный» почерк — с пропусками. Помогает подсказка: «это конспект по органической химии» — модель охотнее узнает термины.
  • Формулы. Попросите записать их в LaTeX или обычным текстом. Если по фото нужно ещё и решить задачу, смотрите статью решение задач по фото.
  • Иностранный текст. Распознавание и перевод делаются одним запросом. Подробно на примере иероглифов — в материале перевод с китайского по фото.
  • Газеты и колонки. Текст в две-три колонки обычный сканер склеивает построчно, и получается каша. Нейросети достаточно сказать: «читай по колонкам слева направо».
  • Старые документы. Выцветшие письма, архивные справки, дореформенная орфография с «ѣ» и «ъ» на конце слов. Попросите сначала переписать как есть, а затем — отдельным блоком — в современной орфографии.
  • Скриншоты переписки. Попросите разметить, кто что написал: «Имя: сообщение», с датами, если они видны.
  • Надпись на картинке нужно заменить, а не скопировать? Это другая задача — её решает замена текста на фото.

Как проверить результат

У нейросети есть особенность, которой нет у классического OCR: она читает не буквы, а смысл. Поэтому может молча исправить опечатку в оригинале, дописать обрезанное слово или «округлить» плохо видную цифру. Для конспекта это не страшно, для договора и бухгалтерии — опасно.

  1. Запрещайте додумывать прямо в запросе — промпт выше это делает.
  2. Сверяйте числа, даты, имена и реквизиты по фото вручную. Это пять минут, которые экономят часы.
  3. Сравните две модели. Если GPT и Claude прочитали строку одинаково, ей можно доверять больше. Расхождения сразу показывают проблемные места.
  4. Просите список сомнений. «Перечисли слова, в которых не уверен» — модель честно назовёт плохо видные места.

Паспорта, банковские карты и медицинские документы лучше не загружать целиком: закройте номера и личные данные, которые не нужны для задачи.

Сколько стоит распознавание в Умке

Умка работает из России без VPN и подписки, оплата в рублях. По текущим меркам умный ответ стоит около 33 токенов, быстрый — 1 токен; запрос с фото или многостраничным PDF может стоить больше — цена видна до отправки. При регистрации дают 60 токенов, карта не нужна. Пакеты пополнения:

  • 290 ₽ — 725 токенов: около 21 умного ответа;
  • 690 ₽ — 1 811 токенов: около 54;
  • 1 490 ₽ — 4 172 токена: около 126;
  • 3 900 ₽ — 11 700 токенов: около 354.

Токены не сгорают, платите только за то, что распознали.

Вывод

Для пары строк хватит сканера текста в телефоне. Если нужно распознать текст с фото целиком — с абзацами, таблицами, почерком — и сразу что-то с ним сделать, удобнее нейросеть. Снимайте ровно и без бликов, просите переписать дословно и отмечать неразборчивое, а числа и имена сверяйте с оригиналом.

Превратите фото в текст

60 токенов в подарок при регистрации, карта не нужна.

Открыть Умку →

Частые вопросы

Как скопировать текст с фото на телефоне?

Для короткой надписи хватит встроенного сканера: на iPhone — «Текст на фото», на Android — Google Lens в камере или галерее. Для длинного документа, таблицы или рукописи удобнее нейросеть: прикрепите фото в чат и попросите переписать текст дословно, сохранив абзацы.

Может ли нейросеть распознать рукописный текст?

Да, аккуратный почерк современные модели читают хорошо, а неразборчивый — с ошибками. Попросите отмечать сомнительные слова как [неразборчиво] и сверьте их с оригиналом вручную, особенно имена, числа и даты.

Почему распознанный текст отличается от оригинала?

Языковая модель не просто считывает буквы, а понимает смысл и может «исправить» опечатку или дописать обрезанное слово. Поэтому в запросе прямо пишите: «дословно, ничего не исправляй и не додумывай», а цифры проверяйте по фото.

Можно ли распознать текст из PDF-скана целиком?

Да. Загрузите PDF в чат с моделью, которая работает с документами, и попросите извлечь текст постранично. Для многостраничного скана удобнее просить результат частями — по 5–10 страниц, чтобы проще было проверить.