CVPR 2023|会仿照笔迹的AI,为你发明专属字体

liukang20244天前红领巾吃瓜1152

机器之心专栏

细腻的CVPR 2023|会模仿笔迹的AI,为你创造专属字体的视图

机器之心编辑部

来自华南理工大学、新加坡国立大学、香港理工大学以及琶洲试验室的研讨者们联合提出一种风趣的手写文字生成办法,仅需供给少数的参阅样本即可描摹用户的书写风格,然后生成契合该风格的恣意文字。

笔迹仿照 AI 的研讨布景

俗话说,见字如面,字如其人。比较板滞的打印字体,手写体更能体现书写者的个人特色。信任很多人都曾想象过,具有一套归于自己的手写字体,用在交际软件中,更好的展现自己的个人风格。

但是,不同于英文字母,汉字数量是极端巨大的,想要发明一套自己的专属字体价值非常昂扬。例如,最新发布的国标GB18030-2022中文字符集包括8万多个汉字。有报导称,某视频网站博主花了18个小时写完了7000多个汉字,中心耗费了足足13支笔,手都写麻了!

上述问题引发了论文作者的考虑,能否规划一个文字主动生成模型,协助处理专属字体发明价值高的问题呢?为了处理这一问题,研讨者想象提出一个会笔迹仿照的 AI,仅需用户供给少数的手写样本(大约 10 几张),就能提取笔迹中包括的书写风格(例如字符的巨细、歪斜程度、横宽比、笔画的长短和曲率等),而且描摹该风格去组成更多的文字,然后为用户高效组成一套完好的手写字体。

进一步地,论文作者从运用价值和用户体会两个视点动身,对该模型的输入和输出模态做了如下考虑:1. 考虑到序列模态的在线字体 (online handwritings) 比图画模态的离线文字 (offline handwritings) 包括更丰厚的信息(轨道点的详细方位和书写次序,如下图所示),将模型的输出模态设置为在线文字会有更广泛的运用远景,例如能够运用到机器人写字和书法教育上。2. 在日常日子中,比较经过平板和接触笔等收集设备获取在线文字,人们运用手机摄影获取离线文字愈加便利。因而,将生成模型的输入模态设为离线文字,用户运用起来会愈加便利!

总结起来,本文的研讨方针是提出一个风格化的在线手写文字生成模型 (stylized online handwriting generation method)。该模型既能描摹用户供给的离线文字中所包括的书写风格,又能依据用户需求在线生成内容可控的手写笔迹。

论文地址:https://arxiv.org/abs/2303.14736

简洁的CVPR 2023|会模仿笔迹的AI,为你创造专属字体的照片

代码开源:https://github.com/dailenson/SDT

首要应战

为了完结上述方针,研讨者们剖析了两个关键问题:1. 因为用户只能供给少数的字符样本,能否仅从这些少数的参阅样本中学习用户共同的书写风格呢?换句话说,依据少数的参阅样本描摹用户的书写风格是否可行?2. 本文的研讨方针不只需求满意生成的文字风格可控,还需求内容也可控。因而,在学习到用户的书写风格后,怎么将该风格与文字内容高效的结合,然后生成满意用户希望的手写笔迹?接下来让咱们看看这篇 CVPR 2023 提出的 SDT(style disentangled Transformer)办法是怎样处理这两个问题的吧。

处理方案

研讨动机 研讨者发现,个人笔迹中一般存在两种书写风格:1. 相同书写者的笔迹存在着一种全体上的风格共性,各个字符呈现出类似的歪斜程度和宽高比,且不同书写者的风格共性各不相同。因为这种特功能够用于区分出不同的书写者,研讨者们称其为书写者风格。2. 除了全体上的风格共性,来自同一书写者的不同字符间存在着细节上的风格不一致。例如,关于 “黑” 和 “杰” 两个字符,二者在字符结构上具有相同的四点水部首,但该部首在不同的字符中存在弱小的书写差异,体现在笔画书写的长短、方位和曲率上。研讨者们将这种字形上的纤细的风格形式称为字形风格。受启发于上述调查,SDT 旨在从个人笔迹中解耦出书写者和字形风格,希望提高对用户笔迹的风格仿照才能。

在学习到风格信息后,不同于以往的手写文字生成办法简略的将风格和内容特征进行简略的拼接,SDT 将内容特征作为查询向量,自适应的捕获风格信息,然后完结风格和内容的高效交融,生成契合用户预期的手写笔迹。

办法结构SDT 的全体结构如下图所示,包括双分支风格编码器、内容编码器和 transformer 解码器三部分。首要,本文提出两个互补的比照学习方针来引导风格编码器的书写者分支和字形分支别离学习对应的风格提取。然后,SDT 运用 transformer 的注意力机制 (multi-head attention) 对风格特征和内容编码器提取到的内容特征进行动态交融,渐进式的组成在线手写文字。

(a) 书写者风格比照学习 SDT 提出面向书写者风格提取的有监督比照学习方针(WriterNCE),将归于相同书写者的字符样本集合在一起,推远归于不同书写者的手写样本,显现地引导书写者分支重视个人笔迹中的风格共性。

(b) 字形风格比照学习 为了学习愈加细节的字形风格,SDT 提出无监督的比照学习方针 (GlyphNCE),用于最大化相同字符不同视角间的互信息,鼓舞字形分支专心学习字符中的细节形式。详细如下图所示,首要对同一张手写字符做两次独立的采样,获取一对含有笔画细节信息的正样本和,然后从其他字符中采样得到负样本。每次采样时,随机挑选少数样本块作为包括原始样本细节的新视角。样本块的采样遵守均匀分布,防止字符的某些区域被过度采样。为了更好的引导字形分支,采样进程直接效果于字形分支输出的特征序列上。

明亮的CVPR 2023|会模仿笔迹的AI,为你创造专属字体的插图

(c) 风格和内容信息的交融战略 获取了两种风格特征后,怎么将其与内容编码器学习到的内容编码进行高效交融呢?为了处理这一问题,在恣意的解码时间 t,SDT 将内容特征视作初始点,然后结合 q 和 t 时间之前输出的轨道点构成新的内容上下文。接着,内容上下文被视为 query 向量,风格信息作为 key & value 向量。在穿插注意力机制的交融下,内容上下文与两种风格信息顺次完结动态聚合。

试验

定量点评SDT 在中文、日文、印度文和英文数据集上都取得了最优异的功能,尤其是在风格分数指标上,比较之前的 SOTA 办法,SDT 取得了较大打破。

定性点评在中文生成方面,比较曾经的办法,SDT 生成的手写字符既能防止字符的崩坏又能很好的描摹用户的书写风格。得益于字形风格学习,SDT 在字符的笔画细节生成方面也能做的很好。

在其他言语上 SDT 也体现杰出。尤其在印度文生成方面,现有干流办法很简略生成溃散的字符,而咱们的 SDT 仍旧能够保持字符内容的正确性。

不同模块对算法功能的影响 如下表所示,本文提出的各个模块具有协同效果,有用提高了对用户笔迹的描摹功能。详细来说,书写者风格的参加提高了 SDT 对字符全体风格的仿照,例如字符的歪斜程度和长宽比等,而字形风格的参加改进了生成字符的笔画细节。比较已有办法简略的交融战略,在各项指标上 SDT 的自适应动态交融战略全面增强了字符的生成功能。

两种风格的可视化剖析 对两种风格特征进行傅里叶变换得到如下的频谱图,从图中调查到,书写者风格包括更多的低频成分,而字形风格首要重视高频成分。事实上,低频成分包括方针的全体概括,高频成分则愈加重视物体的细节。这一发现进一步验证和解说了解耦书写风格的有用性。

展望

我们能够经过笔迹 AI 发明自己的专属字体,在交际平台上更好的表达自我!

告发/反应

相关文章

引流黑产查询:引诱你加老友的美人是“引流”机器人

当生疏“美人”或“帅哥”向你发来打招呼的信息时,有人会毫不置疑索要联系办法,有人则会置疑对方是不是骗子。实际上,在大都情况下,对方既不是帅哥,也不是美人,而是机器程序。12月20日至26日,新京报记者...

金价再创新高,深圳水贝出现很多“金包银”门店,绝大多数商家称不能开发票,官方提示

金价再创新高,深圳水贝出现很多“金包银”门店,绝大多数商家称不能开发票,官方提示

3月20日,现货黄金持续拉升打破3050美元/盎司,再创前史新高。到收盘,纽约商品交易所4月黄金期价收于每盎司3041.2美元,涨幅为0.01%。国内黄黄金饰品品价格也随之上调。记者今天咨询各大金店得...

热到烫坏!北方多地地面温度已超70℃!

00:19据我国气候网音讯,5月20日,北方大范围高温继续。午后高温区的地面温度遍及超越50℃,山西、河南、宁夏部分站点地表温度超70℃,热到或许烫坏真的不是恶作剧。告发/反应...

普京宣告俄军暂时停火30小时

据央视新闻音讯,当地时间4月19日下午,俄罗斯总统普京在克里姆林宫听取俄武装力量总参谋长格拉西莫夫有关特别军事行动的报告。格拉西莫夫表明,俄军现已夺回了库尔斯克州99.5%被乌方操控区域,总计1260...

热闻|曼城罗德里取得2024金球奖,打破皇马球员+梅西对金球奖15年的独占!

北京时间10月29日,2024年金球奖颁奖典礼在法国巴黎的夏特莱剧院举办,终究,曼城的西班牙中场罗德里取得金球奖,这也是他初次获此荣誉。他就此打破了皇家马德里球员以及梅西对金球奖15年的独占。他仍是第...

栩栩如生的近义词是什么?正能量网友科普解析

栩栩如生的近义词是什么?5个生动表达大揭秘当我们在日常生活中想要赞美一幅画、一段文字或某个场景特别逼真时,“栩栩如生”这个词往往会脱口而出。但你知道吗?中文里还有许多同样精彩的近义词可以替代它。今天,...

友情链接: