OCR изображений
Как получить текст из фотографии или скриншота
Извлеките редактируемый текст из фотографии, скриншота или скана. OCR возвращает обычный текст либо Markdown с заголовками и таблицами; результат можно скопировать или скачать. Распознавание выполняют внешние сервисы ИИ, поэтому перед использованием текста проверьте цифры, имена и другие важные данные по изображению.
Стоимость: Доступны бесплатные варианты. Для функций Pro или использования сверх бесплатного лимита могут потребоваться кредиты; подробнее — в руководстве ниже.
Как распознать текст на изображении
Загрузите один файл
Нажмите Загрузите изображение для извлечения текста или перетащите JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP либо TIFF до 200 МБ. Через Files можно выбрать прежнюю загрузку или результат другого инструмента.
Выберите формат до запуска
В панели OCR начальный вариант TXT возвращает обычный текст. Markdown сохраняет структуру документа в виде разметки. Выберите нужный вариант перед распознаванием.
Задайте подсказку языка
В меню Подсказка языка изначально выбран Auto-detect — автоматическое определение. Оставьте его для первой попытки. При выборе конкретного языка меняется и сервис распознавания.
Извлеките текст
Нажмите Extract text. Изображение останется в предпросмотре, а под ним появится панель Извлеченный текст с количеством символов. На серверную задачу отводится до 30 минут; автоматического повторного запуска нет.
Проверьте и сохраните
Сверьте суммы, даты, фамилии и коды с исходником. Копировать помещает текст в буфер обмена, а Скачать сохраняет файл UTF-8 с именем
ocr-result.txtилиocr-result.md.
TXT, Markdown и язык
В панели OCR два выбора: формат текста и подсказка языка. Они не изменяют исходное изображение.
- TXT
- Выбран по умолчанию. Возвращает текст без оформления Markdown. В распознанной таблице каждая строка становится отдельной строкой текста, а ячейки разделяются табуляцией — это удобно для вставки в таблицу. Символы, которые являются частью оригинала, например
#хештег,__init__и<div>на скриншоте кода, сохраняются как написаны. - Markdown
- Сохраняет заголовки, списки, выделение и таблицы через разметку: например, заголовок начинается с #. Подходит для переноса документа в заметки или вики. В редакторе с поддержкой Markdown файл .md отображается с оформлением; обычный текстовый редактор показывает сами знаки разметки.
- Подсказка языка: Auto-detect
- Изображение читает GLM-OCR от Z.ai. Эта модель сама определяет язык и систему письма и не принимает отдельную языковую подсказку.
- Подсказка языка: конкретный язык
- Меню содержит English, German, Spanish, French, Italian, Portuguese, Russian, Japanese, Chinese, Arabic и Hindi. Например, для русского текста выберите Russian. Файл поступает модели Google Gemini, которой выбранный язык помогает различать похожие знаки, границы слов и направление чтения. Другие языки на том же изображении сохраняются; запрос не предусматривает перевод, пересказ или исправление текста.
Какой сервис получает изображение
Распознавание идёт через наши серверы. При Auto-detect изображение передаётся GLM-OCR от Z.ai, а при выбранном языке — Google Gemini. Если API Gemini ограничивает запрос из-за квоты, тот же запрос отправляется модели Gemini через OpenRouter. Изображение передаётся целиком; учитывайте это при загрузке паспорта, банковской выписки и других документов с личными данными.
Переход между Auto-detect и конкретным языком даёт результат другого движка распознавания. Он может прочитать спорную строку иначе, поэтому это полезно для сравнения после ошибки в первой попытке. Каждый новый запуск отдельно учитывается в лимите использования.
Как подготовить читаемый исходник
Качество распознавания зависит от того, насколько хорошо различимы символы на изображении.
Оставьте нужный фрагмент
Меню интерфейса, ценники, водяные знаки и вывески на заднем плане тоже могут попасть в текст. Через Обрезку изображения оставьте только область, которую нужно прочитать.
Выпрямите страницу
Горизонтальные строки обычно легче различить, чем наклонённые или повёрнутые боком. Перед распознаванием поправьте положение страницы через Поворот изображения.
Используйте скриншот экрана
Скриншот сохраняет чёткие буквы без бликов. Фотография монитора может добавить полосы муара, отражения и искажение перспективы, из-за которых символы распознаются неверно.
Для нескольких страниц выберите PDF OCR
Здесь один запуск читает одно изображение. Если сканы уже объединены в PDF, PDF OCR обрабатывает все страницы или выбранный диапазон в одной задаче.
Форматы и ограничения
- Входные форматы
- JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP и TIFF. GIF не принимается.
- Результат
- Обычный текст .txt или Markdown .md в UTF-8; также копирование в буфер обмена
- Размер файла
- До 200 МБ на изображение
- Один запуск
- Одно изображение
- Обработка
- Через наши серверы; распознавание GLM-OCR от Z.ai либо Google Gemini с OpenRouter при ограничении квоты Gemini. До 30 минут, без автоматической повторной попытки.
- Использование
- Один запуск — одна единица. Бесплатные лимиты зависят от аккаунта и считаются за последние 24 часа и час. После их исчерпания гостям нужен вход; каждое дополнительное изображение стоит 1 кредит.
- Водяной знак
- Не добавляется
- Хранение файлов
- Сохранённые на сайте загрузки и файлы результатов автоматически удаляются через 48 часов у гостей и через 30 дней у бесплатных аккаунтов. Платные тарифы позволяют хранить их дольше.
Частые вопросы
Переводит ли OCR текст?
Нет. Инструмент возвращает текст на исходном языке. Подсказка языка помогает различать неоднозначные символы; например, Russian задаёт русский как ориентир распознавания. Другие языки на изображении также сохраняются без перевода.
Почему некоторые буквы и цифры распознаны неправильно?
Мелкий, размытый или бледный текст, тени и наклон страницы затрудняют чтение. Особенно внимательно сверяйте похожие знаки: 0 и O, 1 и l, rn и m. Выберите более чёткий исходник, оставьте нужный текст или сравните результаты Auto-detect и конкретного языка — их читают разные модели.
Когда выбрать TXT, а когда Markdown?
TXT удобен для вставки в письмо, форму или электронную таблицу: распознанные ячейки разделяются табуляцией. Markdown подходит, когда важно сохранить заголовки, списки и таблицы как структуру документа, например при переносе в заметки.
Передаётся ли изображение третьей стороне?
Да. При Auto-detect файл получает GLM-OCR от Z.ai, при выбранном языке — Google Gemini, а при ограничении квоты Gemini — OpenRouter. Указанные сроки 48 часов и 30 дней относятся к сохранённым файлам на наших серверах и не описывают хранение у внешних поставщиков.
Что делать, если текст не извлечён?
Если на изображении нет читаемого текста, задача заканчивается сообщением об ошибке. Проверьте, что буквы достаточно крупные и чёткие, уберите лишние области и повторите распознавание. Каждый повторный запуск учитывается отдельно.