Выбирайте формат по следующему действию, а не только по расширению файла
OCR — это не конечная цель, а первый этап. Практическая ценность появляется тогда, когда результат можно использовать дальше. Если после распознавания нужно редактировать абзацы, заголовки, списки или текст договора, обычно стоит начать с конвертации изображения в Word. Если на фотографии находятся строки, столбцы, цены, количества, артикулы или другие табличные данные, удобнее выбрать изображение в Excel, потому что числа можно сверить, сортировать и использовать в формулах. Для архивных сканов, где важно оставить исходный внешний вид страницы, поисковый PDF сохраняет изображение страницы и добавляет распознанный текстовый слой.
Форматы для разработчиков решают другую задачу. JSON, XML, YAML, CSV, TSV и SQL превращают визуально представленные данные в структуру, которую можно импортировать или обрабатывать программно. Здесь особенно важно понимать разницу между валидным синтаксисом и правильными данными. JSON может успешно открыться в парсере, но содержать неверно распознанный номер заказа; SQL‑файл может быть синтаксически корректным, но включать ошибочную сумму; GeoJSON может пройти проверку структуры, но точка окажется не там из‑за перепутанных координат. Поэтому идентификаторы, даты, десятичные значения, координаты, коды и поля нужно сверять с исходным изображением до импорта.
Что AI может восстановить с изображения — и что восстановить невозможно
LoveOCR анализирует то, что реально видно на изображении: символы, строки, блоки текста, подписи, таблицы, заголовки, списки и пространственные связи. После этого выбранный инструмент пытается представить обнаруженную структуру в целевом формате. Фотография таблицы может стать ячейками Excel, схема — кодом Mermaid или Graphviz, снимок формы — основой для интерактивного PDF, а изображение формулы — LaTeX.
Однако изображение не хранит исходные внутренние данные приложения. Фотография Word‑документа не содержит настоящих стилей DOCX, комментариев и истории правок. Скриншот таблицы не содержит формул Excel, типов данных или скрытых строк. Изображение веб‑страницы не содержит оригинального DOM, CSS‑классов или JavaScript. Поэтому автоматический результат — это реконструкция по видимым признакам, а не восстановление потерянного исходного файла. Сложные макеты, мелкие символы, блики, тени, рукописные исправления, объединённые ячейки и неоднозначные диаграммы могут потребовать ручной доработки.
Как подготовить изображение, чтобы уменьшить количество ошибок
- Используйте самый качественный источник. Оригинальный скан или скриншот обычно содержит больше полезной информации, чем фотография, несколько раз сжатая мессенджером.
- Снимайте страницу ровно. Сильная перспектива усложняет распознавание границ таблиц, колонок и базовых линий текста.
- Избегайте бликов и глубоких теней. Даже небольшой отражённый участок может скрыть цифру, точку, знак минус или часть буквы.
- Не обрезайте смысловой контекст. Для таблицы оставьте заголовки столбцов; для формы — подписи полей; для схемы — узлы и соединяющие стрелки.
- Разделяйте слишком сложные страницы. Если один кадр содержит несколько независимых таблиц, диаграмм или страниц, отдельная обработка часто даёт более понятный результат.
Проверяйте результат по типу файла
Одинаковая проверка не подходит для всех 50 инструментов. В Word и ODT важны порядок абзацев, заголовки, списки и редактируемость таблиц. В Excel, CSV и TSV критичны строки, столбцы, десятичные разделители, отрицательные значения и то, не склеились ли соседние ячейки. В JSON, XML и YAML сначала проверьте синтаксис, а затем отдельно сравните значения полей с изображением. В SQL убедитесь, что имена таблиц и столбцов ожидаемы, типы данных подходят вашей базе, а сам файл не выполняется автоматически в рабочей системе без просмотра.
Код и диаграммы требуют ещё более строгой проверки. Python, HTML/CSS, Mermaid и Graphviz следует воспринимать как черновик. Перед запуском Python‑кода прочитайте его, проверьте импорты, операции с файлами, сетью и системными командами и протестируйте в безопасной среде. Для Mermaid/Graphviz важно не только то, что диаграмма рендерится, но и что направления стрелок, подписи и связи между узлами соответствуют источнику. Для LaTeX проверьте формулы и компиляцию, особенно индексы, степени, знаки и скобки.
Примеры: какой инструмент выбрать
- Фото договора или письма → Word/ODT. Подходит, когда текст нужно редактировать, комментировать или согласовывать.
- Фото счёта или таблицы → Excel/CSV/TSV. Подходит для последующего анализа, сортировки и импорта, но суммы и номера необходимо сверить.
- Скан архива → поисковый PDF. Вы сохраняете внешний вид оригинала и получаете возможность искать и выделять распознанный текст.
- Снимок структурированных данных → JSON/XML/YAML. Удобно для разработки и интеграций после проверки схемы и значений.
- Схема или блок‑диаграмма → Mermaid/Graphviz. Полученный код можно редактировать, но семантику связей нужно проверить вручную.
- Книжные страницы → EPUB/AZW3. Для публикации важны порядок чтения, главы, абзацы и корректность текста; MOBI лучше рассматривать как устаревший формат для совместимости со старыми сценариями.
- Субтитры → SRT/VTT. Текст — только часть задачи: необходимо отдельно проверить таймкоды, порядок реплик и синхронизацию с видео.
- Визитка или афиша → vCard/ICS. Телефон, email, дата, время и часовой пояс относятся к полям с высокой ценой ошибки, поэтому их нужно сверять вручную.
Почему «файл открылся» ещё не означает, что конвертация правильная
Большинство целевых форматов могут быть технически валидными даже при смысловой ошибке. CSV откроется, если цифра 8 была распознана как 3. JSON останется валидным, если фамилия написана неверно. В поисковом PDF текстовый слой может содержать ошибку, хотя страница визуально выглядит идеально. Именно поэтому для важных документов полезно открыть исходное изображение рядом с результатом и проверить несколько участков: начало, середину и конец документа, а также все критичные поля.
Если результат используется для финансовой, юридической, медицинской, технической, доступностной или публичной информации, добавьте человеческую проверку. Автоматизация экономит время на вводе данных, но не переносит ответственность за точность результата с пользователя на инструмент.
Приватность при конвертации
LoveOCR принимает изображение для выполнения выбранной операции и временно хранит загруженные и созданные файлы, чтобы обработать запрос и дать пользователю возможность скачать результат. Эти конвертационные файлы автоматически удаляются из хранилища LoveOCR в течение 3 часов. Передача между браузером и сайтом выполняется по HTTPS/TLS. Для некоторых задач может использоваться внешняя AI‑инфраструктура, когда она нужна для анализа изображения и создания выбранного результата. Подробные условия обработки, аналитики и контактных данных описаны в Политике конфиденциальности.
50 отдельных инструментов вместо одного универсального «экспорта»
Разные форматы имеют разные правила. CSV не умеет хранить визуальное форматирование Excel; SVG лучше подходит для графики и контуров, чем для полноценного представления фотографии; UBL — это структурированный формат бизнес‑документов, где поля должны соответствовать принимающей системе; QIF предназначен для финансового обмена и требует особенно внимательной проверки дат и сумм; GeoJSON хранит географические объекты и обычно использует порядок координат долгота, затем широта. Поэтому LoveOCR разделяет конвертацию на отдельные инструменты, чтобы подготовка, генерация и проверка соответствовали реальной задаче.
Полный каталог находится на странице «Все инструменты». Если вы не уверены, какой формат нужен, сначала определите, что будет происходить после скачивания: редактирование, расчёты, импорт в программу, публикация, архивирование, визуализация или дальнейшая автоматическая обработка.
Руководства LoveOCR
Для каждого из 50 инструментов LoveOCR подготовлены отдельные практические руководства по рабочим процессам, типичным ошибкам и проверке результата. На данный момент блог опубликован на английском языке. Начать можно с центра руководств LoveOCR, а ниже на странице представлены несколько материалов для самых частых сценариев.