Нейросеть научилась имитировать рукописный текст
Благодаря бесплатному веб-приложению под названием calligrapher.ai любой может имитировать рукописный ввод с помощью нейронной сети, работающей в браузере с помощью jаvascript. После ввода требуемого к изображению текста сайт отображает его как почерк в девяти различных стилях, каждый из которых настраивается с помощью таких свойств, как скорость, разборчивость и ширина штриха. Это также позволяет загрузить полученный образец искусственного почерка в векторном файле SVG.
Демонстрация особенно интересна тем, что в ней не используется предопределенный шрифт. Шрифты, которые выглядят как почерк, существуют уже более 80 лет, но каждая буква получается дубликатом, независимо от того, сколько раз вы ее напечатаете.
За последнее десятилетие ученые-компьютерщики ослабили эти ограничения, открыв новые способы имитации динамического разнообразия человеческого почерка с помощью нейронных сетей.
Веб-сайт Calligrapher.ai, созданный исследователем машинного обучения Шоном Васкесом, основан на исследовании, опубликованном в 2013 году Алексом Грейвсом из DeepMind. Первоначально Васкес создал сайт Calligrapher несколько лет назад, но недавно он привлек к себе больше внимания благодаря публикации на Hacker News.
Calligrapher.ai отображает каждую букву так, как если бы она была написана рукой человека, руководствуясь статистическими весами. Эти веса исходят от рекуррентной нейронной сети (RNN), которая была обучена в онлайн-базе данных по почерку IAM. База содержит образцы почерка 221 человека, оцифрованные с доски с учетом времени необходимого для написания. В результате модель синтеза почерка Calligrapher.ai в значительной степени настроена на англоязычное письмо, и люди в Hacker News упоминали о проблемах с воспроизведением диакритических знаков, которые обычно встречаются в других языках.
Поскольку алгоритм создания почерка носит статистический характер, его свойства, такие как «разборчивость», можно динамически регулировать. Васкес описал, как работает ползунок удобочитаемости, в комментарии к посту Hacker News.
— Шоном Васкес.
Сейчас, когда нейронные сети работают с текстом, речью , изображениями, видео, а теперь и с рукописным вводом, кажется, что ни один уголок человеческого творческого продукта не остался вне досягаемости генеративного ИИ.
В 2018 году Васкес показал базовый код, лежащий в основе демонстрации веб-приложения, на GitHub, чтобы его можно было адаптировать к другим приложениям. В правильном контексте это может быть полезно для графических дизайнеров, которым нужно больше изящества, чем статический рукописный шрифт.
Демонстрация особенно интересна тем, что в ней не используется предопределенный шрифт. Шрифты, которые выглядят как почерк, существуют уже более 80 лет, но каждая буква получается дубликатом, независимо от того, сколько раз вы ее напечатаете.
За последнее десятилетие ученые-компьютерщики ослабили эти ограничения, открыв новые способы имитации динамического разнообразия человеческого почерка с помощью нейронных сетей.
Веб-сайт Calligrapher.ai, созданный исследователем машинного обучения Шоном Васкесом, основан на исследовании, опубликованном в 2013 году Алексом Грейвсом из DeepMind. Первоначально Васкес создал сайт Calligrapher несколько лет назад, но недавно он привлек к себе больше внимания благодаря публикации на Hacker News.
Calligrapher.ai отображает каждую букву так, как если бы она была написана рукой человека, руководствуясь статистическими весами. Эти веса исходят от рекуррентной нейронной сети (RNN), которая была обучена в онлайн-базе данных по почерку IAM. База содержит образцы почерка 221 человека, оцифрованные с доски с учетом времени необходимого для написания. В результате модель синтеза почерка Calligrapher.ai в значительной степени настроена на англоязычное письмо, и люди в Hacker News упоминали о проблемах с воспроизведением диакритических знаков, которые обычно встречаются в других языках.
Поскольку алгоритм создания почерка носит статистический характер, его свойства, такие как «разборчивость», можно динамически регулировать. Васкес описал, как работает ползунок удобочитаемости, в комментарии к посту Hacker News.
Форма линии выбирается на основе распределения вероятностей, и повышение удобочитаемости эффективно концентрирует плотность вероятностей вокруг более распространенных результатов. Так что вы правы, утверждая, что это просто изменение параметров вариации. Общий метод назван «регулировкой температуры выборочного распределения»
— Шоном Васкес.
Сейчас, когда нейронные сети работают с текстом, речью , изображениями, видео, а теперь и с рукописным вводом, кажется, что ни один уголок человеческого творческого продукта не остался вне досягаемости генеративного ИИ.
В 2018 году Васкес показал базовый код, лежащий в основе демонстрации веб-приложения, на GitHub, чтобы его можно было адаптировать к другим приложениям. В правильном контексте это может быть полезно для графических дизайнеров, которым нужно больше изящества, чем статический рукописный шрифт.
Наши новостные каналы
Подписывайтесь и будьте в курсе свежих новостей и важнейших событиях дня.
Рекомендуем для вас
Луна появилась... всего за пять часов: новое исследование угрожает всем старым теориям
Все изменилось, когда в научных расчетах появился параметр, который полностью игнорировали ученые до этого...
Откуда взялись артефакты из будущего в 4350-летней гробнице «хранителя тайн» фараона?
Ученые рассказали, кто наведывался в усыпальницу царского советника спустя века после похорон...
Кальмары захватывают океан: и ученые до последнего момента не знали, почему так происходит
Так что же стоит за стремительным наступлением этих щупальцевых...
Морской микроорганизм размножается как монстр из фильма «Чужой»: ученые долго не могли поверить в такое
Поразительное, но за «жуткое» существо сразу уцепились производители пищевой промышленности. Это будет переворот...
Что разбудило российский вулкан на Камчатке, спавший 475 лет?
Ученые рассчитали два сценария, но в итоге выяснилось: сработал совсем не тот фактор, что считалось в начале...
Пробуждение спящего гиганта: почему в Сибири могут начаться безудержные выбросы метана
Поразительно, но Енисей оказался границей, по сторонам которой развиваются два совершенно климатических сценария. Но итог у них один...
Самое секретное оружие: почему Сталин все-таки не применил его
Вместо этого советский лидер показал высший класс дипломатической игры, заставив Черчилля взять за горло Гитлера в буквальном смысле...
Четыре цвета Белого моря: ученые рассказали, как действует уникальный феномен Русского Севера
Все дело в четырех природных процессах, которые порой так переплетаются друг с другом, что кажется, тут действует аномалия...
Таинственные краски: зачем древние египтяне рисовали очень странными веществами?
Похоже, что для художников из долины Нила это были не просто изображения, а нечто гораздо большее...
Характер человек зависит от генов: ученые открыли сотни участков ДНК, программирующих наше поведение
Получается, что наша судьба предопределена? В какой-то степени да, но дьявол, как всегда, скрывается в деталях...
Грибники — это скрытые игроманы? Почему мнения специалистов разделились?
И надо ли опасаться за свое психическое здоровье любителям тихой охоты...