Превращайте фотографии, изображения и отсканированные страницы в редактируемые документы Word. Распознавание текста выполняется онлайн, без установки программ и без необходимости регистрации.
или перетащите, вставьте или выберите из облака
Изображение, вставленное в Word, остается изображением. Распознавание текста считывает символы на JPG и записывает их в документ, чтобы вы могли выделять, исправлять и переформатировать каждую строку.
Выберите Microsoft Word (*.docx) для текущих версий Word или Word 2003 и старше (*.doc), если файл нужно открыть на старом компьютере. Выбор находится рядом с загрузчиком.
Распознавание текста работает на 124 языках, и вы можете выбрать несколько сразу, если страница их смешивает. Указание языка сильнее всего влияет на точность.
Предлагаются два метода OCR, и вы выбираете тот, который подходит файлу. Макет сохраняет геометрию страницы: колонки, таблицы и положение каждого блока остаются там же, где были в изображении. Распознавание текста игнорирует геометрию и как можно лучше интерпретирует символы.
Макет лучше всего подходит для формы, счета или таблицы, сфотографированной на столе, где форма страницы несет смысл. Распознавание текста выигрывает на плотной странице с текстом, кривом фото или бледном скане, где попытка сохранить макет снижает точность.
При выбранном Макете появляется еще один переключатель, Улучшить OCR, который перед чтением делает страницу монохромной. Это повышает точность на бледном или неравномерно освещенном фото и забирает цвет, поэтому по умолчанию он выключен.
Метод конвертации, Метод OCR, Язык OCR и Улучшить OCR находятся в панели настроек рядом с загрузчиком.
Чаще всего спрашивают про JPG, и это далеко не единственный работающий формат. Изображения PNG, GIF и TIF конвертируются так же, JPEG это тот же формат с более длинным расширением, а PDF сканированный или цифровой тоже конвертируется здесь.
Содержимое изображения важнее расширения файла. Ровная, хорошо освещенная страница, снятая прямо, распознается почти идеально. Крутой угол, тень на бумаге, размытый кадр или рукописный текст снижают точность, и ни один конвертер этого не избегает.
Скан ведет себя так же, как фото. Как бы ни пришла страница, это картинка с текстом, пока распознавание текста не прочитает его, и помогают те же настройки.
DOC - это формат файлов документов, созданный в Microsoft Word и использующий расширение .DOC. Помимо текста, такие файлы могут содержать гиперссылки, изображения, графику, таблицы, сложное форматирование и другие элементы.
С выходом Microsoft Office 2007 было представлено расширение .DOCX. Оно использует международный стандарт Microsoft Office Open XML, что делает формат более доступным и удобным в использовании.
Новые версии Microsoft Word могут открывать старый формат DOC, но файлы DOCX не открываются в более старых версиях. Если их все же удается открыть, возможно некорректное отображение форматирования или отсутствие части содержимого документа.
Расширения файлов: .docx и .doc. MIME type: application/vnd.openxmlformats-officedocument.wordprocessingml.document
Конвертация изображения в Word бесплатна и не требует аккаунта. Можно добавить несколько файлов, и они конвертируются за один раз, каждый возвращается отдельным документом с теми же настройками.
Каждая загрузка и скачивание происходят по зашифрованному соединению, поэтому ваши страницы нельзя прочитать по пути. Обработка полностью автоматическая: никто не просматривает ваши файлы, и они не используются для обучения моделей ИИ.
Вы сохраняете авторские права и право собственности и на загруженное изображение, и на полученный документ Word, а серверы, выполняющие обработку, находятся в Европе.
Распознавание текста никогда не бывает лучше, чем картинка, которую оно читает. Вот чего ожидать и какие настройки использовать.
| Что вы загружаете | Рекомендуемые настройки | Результат |
|---|---|---|
| Ровное, хорошо освещенное фото печатной страницы | Конвертировать с OCR, Метод OCR: Макет | Редактируемый текст, при этом колонки и таблицы остаются на своих местах |
| Фото с телефона, снятое под углом, или плотная страница с текстом | Конвертировать с OCR, Метод OCR: Распознавание текста | Редактируемый текст без сохранения исходного расположения на странице |
| Бледная, серая или неравномерно освещенная страница | Конвертировать с OCR, Макет, с включенным Улучшить OCR | Лучшая точность, и страница возвращается без цвета |
| Рукописный текст | Любые настройки | Мало или ничего. Распознавание текста читает печатные символы, а не рукописные |
| Изображение, которое нужно только вставить в документ | Конвертировать, настройка по умолчанию | Картинка внутри файла Word, без текстового слоя за ней |
Указание языка страницы сильнее всего повышает точность среди всех настроек. Предлагается 124 языка, и можно выбрать несколько сразу.
Загрузите изображение или скан. Это может быть PNG, JPG, другой формат изображения или PDF-документ.
Выберите формат Microsoft Word (DOC или DOCX) в раскрывающемся меню.
Установите Метод конвертации в значение Конвертировать с OCR, чтобы текст на картинке стал редактируемым.
Выберите язык файла, чтобы улучшить результаты OCR.
Нажмите «Start».
Загрузите изображение, выберите Microsoft Word (*.docx) или Word 2003 и старше (*.doc), установите Метод конвертации в Конвертировать с OCR, укажите язык страницы и нажмите Старт. Символы на картинке будут считаны и записаны в редактируемый файл Word.
Да. Конвертация изображения в Word бесплатна, не требует аккаунта и не расходует кредиты. Платные планы есть для очень больших файлов, длинных пакетов и обработки с приоритетом, но обычная конвертация в них не нуждается.
Только если Метод конвертации установлен в Конвертировать с OCR. Если оставить Конвертировать, изображение будет вставлено в файл Word как картинка, и ничего в нем нельзя будет выделить. При включенном OCR символы считываются и записываются как настоящий текст, который можно редактировать, искать и форматировать.
Изображения JPG, PNG, GIF и TIF конвертируются одинаково, фото, сделанное на телефон, тоже подойдет, а отсканированная страница или PDF также принимаются. Важнее содержимое файла, чем расширение: ровная, хорошо освещенная страница распознается лучше всего, а тень, крутой угол или размытый кадр снижают точность.
Выбирайте Microsoft Word (*.docx), если только файл не нужно открывать в Word 2003 или более старой программе. DOCX является текущим стандартом и надежнее сохраняет форматирование. Формат DOC существует для старого ПО, которое не может читать DOCX.
Доступно 124 языка распознавания: от арабского и хинди до русского, турецкого и вьетнамского. Можно выбрать несколько языков сразу, если страница содержит их смесь. Выбор языка перед конвертацией повышает точность сильнее, чем любая другая настройка.
Нет. Если поместить JPG в документ Word, он останется картинкой: содержащийся в нем текст нельзя выделить, искать или редактировать. Распознавание символов на изображении должно происходить до того, как файл попадет в Word, и именно это делает этот конвертер.
Да. Соединение зашифровано в обоих направлениях, поэтому никто не может прочитать файл во время передачи. Распознавание текста полностью автоматизировано, люди не просматривают ваши страницы, а файлы не используются для обучения моделей ИИ. Права на изображение и на документ остаются у вас.
Оцифруйте важные тексты из отсканированных документов и изображений с помощью OCR (оптического распознавания символов). Легко извлекайте текст из изображений онлайн.
Читать статью