会去搜「生僻字生成器」的人,通常想要的不是猎奇,而是让一个具体的字在自己的字迹里正常显示。多半因为它就在你或孩子的名字里,而从你的笔尖到一张打印纸之间的某个环节,它变成了一堆方块。
这一页讲清楚:什么才算生僻字、名字里高频出现的到底是哪些字、为什么冷僻字恰恰是字体模型最容易翻车的地方,以及怎么在花钱之前验证一个字体能不能写出你要的字。
生成一套覆盖它的字体 →「生僻」不是一种感觉——汉字字集是有官方清单的,分档也是公开的。现在最实用的参照是 2013 年发布的《通用规范汉字表》,共 8105 字,分三档:
| 字表 | 字数 | 是什么 |
|---|---|---|
| 一级字表 | 3500 | 日常用字。报纸、教材、聊天记录里的字基本都在这里。 |
| 二级字表 | 3000 | 较常用。诗词起名、地名里的字大多落在这一档。 |
| 三级字表 | 1605 | 专门领域用字、姓氏、地名,以及大家口中的「生僻字」。 |
作为对照,更早的 GB2312 编码只定义了 6763 个汉字——这就是为什么一套按 GB2312 范围做的字体看起来挺完整,却依然写不出你名字里的那个字。如果你见过名字在政务表单、火车票或银行流水上显示成 ? 或 □,你遇到的就是「一个中文字体」和「一个能覆盖你的中文字体」之间的差距。
手写字体不是画图工具,是预测。你写 30 到 50 个字,模型推断出剩下几千个字的你的字迹。对「人」「口」「木」这种字,推断很容易:样本量巨大,内部结构也简单。
到了「龑」「翯」「甯」就难了,原因是结构性的:冷僻字笔画更多、嵌套部件更多、训练样本却更少。这个问题的完整技术拆解写在博客里——6500 常用字,以及为什么长尾才是字体模型的真正考题。
对你来说可操作的结论只有一句:字体工具宣传的那个数字,不是关键数字。「6500 字」和「能写出你的名字」是两个不同的承诺。要问的是:生僻字那一档到底有没有。
名字里的生僻字不是随机的。反复出现的就是那几十个,因为它们要么寓意好(玉、光、水、火),要么和姓氏的搭配好看。下面这张表可以当工具用——如果你的名字里有其中任何一个,那这个字就值得在买任何字体之前先测一遍。
| 字 | 拼音 | 字义 | 为什么会用在名字里 |
|---|---|---|---|
| 珩 | héng | 玉佩上端的横玉 | 音好、属玉器一类;在名字里极为常见 |
| 翊 | yì | 辅佐、帮助 | 有扶持与上升之意,跟多数姓氏都搭 |
| 昶 | chǎng | 白天长;通畅明亮 | 取「光明、宽绰」之意 |
| 翀 | chōng | 向上直飞 | 寓意直白有力 |
| 晞 | xī | 晒干;破晓 | 音柔,带晨曦意象 |
| 焱 | yàn | 火花、火光 | 五行属火的取名路线 |
| 淼 | miǎo | 水势浩大 | 五行属水的取名路线;字形辨识度极高 |
| 晗 | hán | 天将明 | 女孩名里很常见 |
| 玥 | yuè | 传说中的神珠 | 明亮、笔画不多、不易混淆 |
| 祎 | yī | 美玉;美好 | 文言色彩,书卷气 |
| 頔 | dí | 美好、容貌好看 | 多见于名字,日常文本里几乎不出现 |
| 昉 | fǎng | 天刚亮;开始 | 直接取「破晓」之意 |
| 犇 | bēn | 「奔」的异体字,奔跑 | 三牛构造,视觉冲击强 |
| 堃 | kūn | 「坤」的异体字,大地 | 觉得「坤」太常见时会换它 |
| 甯 | níng / nìng | 「宁」的异体字,安宁 | 也作姓氏使用 |
| 燚 | yì | 火势猛烈 | 四火构造,刻意拉满 |
留意这里面有多少是异体字(犇、堃、甯)——名字里的生僻字有相当大一部分是常用字的另一种写法,之所以被选中,恰恰是因为常用写法已经被占了。这也是它们最容易在窄覆盖字体里缺席的原因:一套围绕日常用字构建的字体,没有理由收录一个「存在的意义就是它不常见」的字。
这里有两件经常被混为一谈的事,其中只有一件是字体问题。
显示问题是字体问题。 只要这个字在 Unicode 里有码位、而你的字体没有对应字形,瓶颈就在字体。一套覆盖它的字体,能修好所有由你掌控字体的场合——Word 文档、请柬、印刷卡片、logo、签名。
数据问题不是字体问题。 有些户籍、银行、票务、预订系统会在数据库或编码层直接拒绝或转坏生僻字。任何字体都修不了这个,声称能修的工具都是在卖你别的东西。你能做的是向签发机构申请登记替代字形——这在行政流程上是一条走得很通的路。
花五分钟检查,可以省掉一次白买:
MoFont 承诺覆盖 6500+ 简体汉字,也就是一级 + 二级字表这一档——上表里名字会用的字基本都来自这里。三级字表最深的那一档不在承诺范围内,作者把这条边界直接写明了,没有含糊:她自己对范围的说明在这里。这也正是下面那五分钟检测值得做的原因——它回答的是「你的那个字行不行」,而不是「平均水平行不行」。
生僻字和冷僻字是一回事吗? 日常用法里基本是一回事,都指不常见的字。「生僻字」是更常用的说法,也是大家会去搜的词;「冷僻字」是近义词。本页两者同义,指的是一级字表之外、大致从三级字表往后的字。
孩子名字里用了生僻字,做一套自定义字体能解决问题吗? 能解决所有由你掌控字体的场景——印刷、请柬、文档、设计。它解决不了在录入环节就直接拒绝这个字的系统。那属于行政问题,通常的解法是向签发证件的机构申请登记一个替代字。
一套手写字体最多能覆盖多少生僻字? 完全取决于模型,而不取决于你写了多少字。你写几十个字,模型推断其余。在长尾上训练过的模型,能用你写过的部件组合出冷僻字形;只在常用字上训练过的模型,无论你写得多工整,这些字都会显示成方块。
MoFont 支持繁体字或日文汉字吗? 简体中文(6500+)已经上线。日文(7000+)和韩文(2350+)在开发中,繁体字在路线图上。如果你的名字用繁体字形,购买前请先看当前支持状态。
生僻字需要我自己写一遍吗? 不需要,这正是关键。你写的是 30 到 50 个经过挑选的字——用来捕捉你的笔压、倾斜角度、以及你怎么收一个「口」的笔。冷僻字形由这些样本按你的风格生成,所以那组样本是挑出来的,而不是随便定的。
如果名字里的某个字,从来没有用你自己的字迹好好显示过一次——这件事是能解决的。
用你的手写生成一套中文字体 →