Оновлено:
Розпізнавання рукописного тексту відрізняється від звичайного OCR. Друкований текст одноманітний. Рукописний міняється від людини до людини, від сторінки до сторінки і навіть від рядка до рядка — тому рукописні нотатки складніше оцифрувати чисто.
Якщо здебільшого працюєте з друкованими сторінками — краще почати з ширшого OCR-застосунку і сценарію PDF із пошуком. Ця сторінка — про рукописні нотатки, форми і змішані документи, де мета — перетворити рукопис на редагований текст.
Коли ви скануєте рукописний документ, ScanLens спершу покращує зображення — налаштовує контраст, прибирає фоновий шум і компенсує нерівномірне освітлення. Мета — ізолювати штрихи чорнила від поверхні паперу, створюючи чистіший ввід для розпізнавання.
Система визначає окремі рядки тексту, потім сегментує кожен рядок на слова і символи. Це складніше, ніж звучить — у рукопису часто непослідовні пробіли, а літери в курсиві з’єднуються. Просунуті алгоритми визначають природні розриви, зберігаючи з’єднані літери разом.
Розпізнавання рукописного працює найкраще, коли застосунок оцінює символи в контексті, а не кожну літеру ізольовано. Якщо літера неоднозначна, система використовує сусідні слова, пробіли і структуру рядка, щоб зробити розумнішу здогадку, і залишає результат готовим до перевірки.
Фінальний прохід мовної моделі виправляє помилки, використовуючи знання словника і граматики. Цей крок ловить помилки на кшталт «прв» → «при» чи «б» → «би» за контекстом. Тому розпізнавання часто дає зв’язні речення навіть з неакуратного вводу.
Головна прикмета доброго результату — не застосунок, а те, як написано текст. Чесність у цьому місці задає правильні очікування ще до того, як ви візьметеся за стос сторінок.
Акуратні друковані літери — легкий випадок. Коли літери стоять окремо з рівними проміжками — так пишуть список покупок, заповнюють бланк, виводять заголовок друкованими — розпізнавання близьке до якості друкованого тексту. Кожен знак відокремлюваний, і рушій читає його майже так само надійно, як машинописну сторінку. Якщо ви можете вплинути на те, як щось записують (бланк, який заповнюєте, конспект, який ведете свідомо), акуратні друковані літери — найпевніший шлях до чистого результату.
Розбірливий скоропис годиться, але дається важче. Злите письмо прибирає проміжки, за якими рушій розділяє літери, і йому доводиться здогадуватися, де закінчується один знак і починається наступний. Рівний, послідовний скоропис — єдиний нахил, охайні петлі, пристойний контраст чорнила — перетворюється на добротну чернетку, яку треба побіжно вичитати, надто власні назви й числа: їх мовна модель угадати не може. Що чистіший і регулярніший почерк, то ближче скоропис підходить до рівня друкованих літер.
Недбалий або квапливий почерк псується швидко. Тут проходить чесна межа. Поспішні нотатки зі злиплими літерами, слова, що йдуть у закарлючку, густі закреслення, письмо, втиснуте між лінійками, — усе це виходить за межі того, що здатен розібрати будь-який розпізнавач, бо інформація на сторінці справді неоднозначна. Результат усе одно лишається корисною відправною точкою — часто правити його швидше, ніж набирати заново, — але виправляти доведеться порядково. Стелю тут ставить розбірливість, а не програма: якщо людина мружитиметься, рушій теж. Розпізнаний текст у ScanLens лишається редагованим, тож ви правите хибні слова, а не передруковуєте сторінку.
Варто розвести дві речі, які часто плутають. Vision від Apple розпізнає друкований текст у широкому наборі писемностей — 14 мов, що охоплюють латиницю, кирилицю, арабське письмо та CJK, — але рукописне розпізнавання вужче: воно навчене на тих писемностях, де почерк найстійкіший і де більше даних.
На практиці результат залежить від почерку не менше, ніж від писемності: роздільні літери, рівний розмір і темне чорнило на чистому папері розпізнаються незрівнянно краще за квапливі кривулі. Замість вірити в загальний рейтинг, відскануйте сторінку власного почерку — це відповість на питання швидше за будь-яке загальне твердження.
З іншими писемностями історія інша. Зв’язні системи на кшталт арабської та рукописні CJK (китайська, японська, корейська) від руки даються значно важче, ніж у друці: деталі штриха, які розрізняють знаки, — саме те, що втрачає поспіх. Для них акуратно надруковані знаки, зняті з високою роздільністю, розпізнаються набагато краще за письмо від руки, а підтримку друкованого тексту всіма 14 мовами розбирає сторінка OCR-застосунку.
Хороше освітлення критичне. Денне світло чи яскраве рівномірне штучне — найкраще. Уникайте тіней на сторінці — розташуйте джерело світла збоку, а не прямо зверху. Чистий контрастний фон допомагає визначенню країв.
Тримайте iPhone паралельно паперу, не під кутом. Перспективні викривлення ускладнюють розпізнавання літер. Тримайте камеру стабільно — розмиття сильно знижує точність. Для щільного тексту — скануйте секціями, а не намагайтеся захопити всю сторінку.
Якщо оцифровуєте нотатки з різною читабельністю — фокусуйтеся на найчіткіших секціях спершу. Розпізнаний текст лишається редагованим, тож складні місця завжди можна підправити вручну: перечитайте його поряд зі сторінкою і виправте імена та числа.
Перед розпізнаванням оберіть мову, що відповідає сторінці — це звужує словник рушія й підвищує точність, особливо для кирилиці. Для багатомовних документів скануйте секціями за мовою для кращих результатів.
Перетворення рукописної сторінки на редагований текст — чотири етапи, і все це відбувається на телефоні.
Фотографуйте, тримаючи телефон рівно й паралельно аркушу, щоб письмо не перекосило, і заповнюйте кадр заради максимальної роздільності. Якщо фотографія чи PDF із рукописом уже є, імпортуйте їх — розпізнавання працює однаково.
Увімкніть розпізнавання тексту й дайте рушію на пристрої прочитати сторінку — секунда-дві на сторінку. Задайте мову, що відповідає почерку, до початку: так у розпізнавача буде менший і точніший словник.
Розпізнаний текст з’являється редагованим. Звірте його з оригіналом і виправте те, що рушій прочитав не так, — зазвичай це власні назви, прізвища й числа, яких жодна мовна модель не виведе з контексту. Акуратним друкованим літерам правок майже не потрібно; квапливому скоропису — найбільше.
Скопіюйте вичищений текст у «Нотатки», пошту чи текстовий редактор. Щоб зберегти й саму сторінку, і змогу знайти її згодом, вивантажте натомість PDF із пошуком, де розпізнаний текст лежить невидимим шаром під сканом. Для повноцінного документа Word передайте текст у Pages чи Word і експортуйте .docx звідти.
Конвертуйте рукописні нотатки із зустрічей чи лекцій у текст із пошуком і редагований. Знаходьте інформацію швидко замість гортання зошитів. Діліться нотатками з колегами, яких не було. Створюйте задачі і to-do зі своїх начерків.
Оцифровуйте рукописні форми, заяви й опитувальники. Витягуйте дані для таблиць і баз. Ідеально для медичних анкет, карток зворотного зв’язку, реєстрації на заходи і будь-якого паперового збору даних, що має стати цифровим.
Зберігайте особисті листи і записи щоденника в цифровому форматі. Створюйте архіви сімейного листування з пошуком. Транскрибуйте старі документи для генеалогічних досліджень. Бекапте незамінні рукописні спогади у хмару.
Учені, дослідники і польові працівники часто фіксують спостереження від руки. Конвертуйте польові нотатки у структуровані дані. Інтегруйте рукописні спостереження з цифровими сценаріями досліджень. Зберігайте читабельні записи навіть зі спішних нотаток на місці.
Якість розпізнавання залежить від кількох факторів. Діапазонні очікування чесніші, ніж прикидатися, що одне число застосовне до кожного зошита, форми чи сторінки щоденника:
| Стиль рукопису | Типовий результат | Нотатки |
|---|---|---|
| Чіткий друк (друковані літери) | Зазвичай сильний | Найкращі результати з чіткими пробілами і хорошим контрастом |
| Чіткий курсив | Зазвичай корисний | З’єднані літери можуть потребувати перевірки |
| Змішані стилі | Змішана якість | Контекст допомагає, але перевірка залишається нормою |
| Спішний/швидкий | Потрібна перевірка | Очікуйте ручних правок у спішних секціях |
| Дуже неакуратний | Обмежений | Читабельність залишається жорсткою межею для будь-якого сканера |
Практичне правило просте: чіткий рукопис часто перетворюється на корисний чернетковий варіант швидко, а спішний чи непослідовний — виграє від перевірки до того, як на нього покластися.
Так. Курсив можна розпізнати, коли почерк достатньо читабельний, але з’єднані літери, тісні пробіли і нерівномірні чорнила все ж знижують надійність. Ставтеся до виводу як до редагованої чернетки і перевіряйте важливі рядки до збереження або відправлення.
Результати залежать від чіткості рукопису, освітлення, контрасту і стабільності скана. Акуратний лист із гарними пробілами набагато простіше конвертувати, ніж спішні чи сильно стилізовані нотатки. Чіткі фото і хороше освітлення покращують результати, і все одно варто перевірити важливі імена, дати і числа.
У публічній картці App Store заявлено OCR 14 мовами. Розпізнавання рукопису вужче за розпізнавання друкованого тексту й залежить від писемності, почерку та якості зображення. Перевірте типові сторінки та звіряйте важливий результат з оригінальним сканом.
Так, усе розпізнавання рукопису відбувається на iPhone через Neural Engine. Інтернет не потрібен для сканування і витягання тексту. Інтернет потрібен лише для хмарної синхронізації чи відправлення готових документів.
Для кращих результатів: забезпечте хороше освітлення (денне світло ідеальне), тримайте камеру стабільно і паралельно паперу, переконайтеся, що весь текст чітко видно без тіней, скануйте щільний текст секціями. Контрастний фон допомагає визначенню країв, а ручний вибір правильної мови покращує результати для нелатинського тексту.
Так. Охайний друкований почерк, де літери стоять окремо й з рівними проміжками, розпізнається майже так само добре, як друкарський текст, бо кожен знак легко відділити. Розбірливий пропис годиться, але дається важче: з’єднання прибирають саме ті просвіти, за якими система розрізняє літери, тож виходить чорновий текст, у якому варто перевірити імена й числа. Недбалий чи квапливий почерк псується найшвидше й потребує порядкової правки. Якщо ви можете вплинути на те, як щось записують, чіткі друковані літери дадуть найчистіший переклад у текст.
Рукописне розпізнавання охоплює менше, ніж розпізнавання друкованого тексту. Найкраще підтримана й найнадійніша рукописна латиниця (англійська та західноєвропейські мови з тією самою абеткою), за нею — рукописна кирилиця, українська та російська, за більш-менш охайного почерку. Зв’язні писемності на кшталт арабської, а також рукописні китайська, японська та корейська даються помітно важче; там акуратно виведені знаки, зняті з високою роздільністю, розпізнаються значно краще, ніж вільне письмо.
Так. Експортуйте рукопис як PDF із текстовим шаром: зображення сторінки лишиться рівно таким, яким ви його зняли, а розпізнаний текст ляже невидимим шаром позаду, тож згодом за ним можна шукати й копіювати. Це найкращий варіант для щоденників, листів і карток із рецептами, де сам почерк має цінність. Якщо ж потрібен звичайний редагований текст, скопіюйте розпізнане в «Нотатки» чи текстовий редактор або передайте в Pages або Word, щоб зберегти документом.