Оптичне розпізнавання символів (optical character recognition, OCR) – це технологія, що забезпечує перетворення відсканованих зображень тексту в придатний для машинного читання текст із можливістю пошуку, копіювання, редагування та виділення.
Значення OCR полягає у його здатності до розпізнавання тексту у відсканованих документах, перетворення статичного PDF-вмісту в текст, який можна знову використовувати в документах.
Найшвидший спосіб дізнатися, чи є текст у PDF-документі відсканованим, – це спробувати вибрати або виділити його. Якщо ви не можете вибрати або виділити текст, то, швидше за все, ви маєте справу з відсканованим PDF-файлом. Ви можете зробити текст у відсканованому PDF-файлі доступним для пошуку, скориставшись функцією оптичного розпізнавання символів в онлайн-інструменті Acrobat. Після того як ви передасте PDF-файл в інструмент, механізм OCR обробить ваш документ, щоб розпізнати текст, максимально точно відтворюючи стиль шрифту відсканованого або статичного тексту для збереження єдиного вигляду всього PDF-документа. Після завершення оптичного розпізнавання символів увійдіть у систему, щоб завантажити й відкрити новий PDF-файл. Ви зможете шукати слова чи фрази у своєму PDF-документі або поділитися ним з іншими електронною поштою.
Онлайн-інструмент OCR Acrobat забезпечує можливість безкоштовного розпізнавання тексту в документах PDF. Для забезпечення можливості редагування, пошуку й виділення тексту в інших документах, зокрема таких форматах файлів зображень, як-от PNG, JPG і TIFF, можна скористатися безкоштовною семиденною пробною версією Adobe Acrobat Pro.
За допомогою Acrobat Pro розпізнаний текст у документах можна також редагувати в операційних системах Microsoft Windows, Mac і Linux. За рахунок використання технології OCR для створення придатного до редагування тексту можна заощаджувати час і гроші через повторне використання існуючого вмісту, замість розробки нового з нуля.
Крім того, безкоштовна пробна версія Acrobat Pro забезпечить доступ до розширених функцій PDF для подальшого розвитку потрібних технологічних процесів. Редагуйте текст і зображення в документах PDF, збирайте електронні підписи, створюйте придатні для заповнення форми й конвертуйте документи у формат PDF і з нього, зокрема текстові файли (TXT) і Microsoft Excel, PowerPoint та документи Word.
Інструмент Acrobat для оптичного розпізнавання символів у PDF може використовуватися для PDF-документів англійською, німецькою, іспанською, французькою, португальською та іншими мовами. Перегляньте повний список
підтримуваних мов для наших онлайн-інструментів OCR.
Інструменти оптичного розпізнавання символів підтримують відскановані паперові документи, PDF-файли, що містять лише зображення, фотографії з текстом і навіть рукописні нотатки.
Розширені інструменти оптичного розпізнавання символів Acrobat зберігають оригінальний макет, шрифти й форматування, завдяки чому результат має такий самий вигляд, як оригінальний документ.
Оформивши безкоштовний 7-денний пробний період Acrobat Pro, ви зможете редагувати розпізнаний текст, повторно використовувати вміст, а також зберігати форматування й макет у своєму PDF-файлі після застосування функції розпізнавання тексту.
Програмне забезпечення для розпізнавання тексту може зробити вміст придатним для читання вголос або конвертування в шрифт Брайля, забезпечуючи доступність відсканованих документів за допомогою адаптивних технологій.
Низька якість зображення, незвичайні шрифти або рукописний текст можуть знижувати точність. Підвищення роздільної здатності сканування або використання чіткіших шрифтів покращує результати.
Так, інструменти оптичного розпізнавання символів обробляють цілі документи, зокрема багатосторінкові PDF-файли, і роблять усі сторінки доступними для пошуку.