📖 汉字 → 假名转换工具
使用内置词典(约 50KB)即时将含汉字文本转换为振假名(HTML ruby)、平假名、片假名或罗马字。覆盖常用熟语、主要姓名与常用汉字,并提供词素表。
默认浏览器处理。勾选"高精度模式"时启用 MeCab 服务器处理。
⚠️ 关于准确度
使用约 100KB 的内置词典,即时动作。罕见专有名词或难读汉字会显示为 ?。重要场合请人工确认。
🔒 关于隐私
- ・所有转换处理均在浏览器内完成
- ・输入文本和姓名不会发送到任何服务器
- ・无存储日志、无上传记录、无数据库
📖 常见的坑
为含汉字的日语文本标注平假名、片假名或罗马字读音。默认全部由浏览器内的轻量词典完成,只有当你明确选择「高精度模式」时,才会使用服务器端的 MeCab(形态素分析器)。但无论哪种模式,读音都是「推定」——形态素分析返回的是「在该上下文中最可能出现的读法」,而不是正确答案。尤其是人名与地名,原理上就无法猜中。因为同一种写法确实存在多种读法,而哪一种正确,是由本人和当地决定的,不由语言规则决定。
| 情形 | 会发生什么 | 怎么处理 |
|---|---|---|
| 人名与地名的读音无法推定 | 同一写法对应多种读音,是常态而非例外。中田 既有 nakata 也有 nakada;新谷 可以是 shintani、araya、niiya;至于 東海林,多数人读作 shoji,这从字面完全看不出来。地名同理:十三 读作 juso,放出 读作 hanaten。形态素分析返回的是统计上最常见的读法,因此姓名读法属于少数派的人必定会被读错。更糟的是,这种错误并不显眼——填进去的是一个看似合理的读音,所以在本人看到之前谁都不会察觉。「大致正确」在这个用途上,恰恰是最危险的性质。 |
人名与地名不要推定,请作为数据来保有。如果注册表单需要注音,让本人自己填写才是唯一正确的做法。若要自动填充,请务必放进可编辑字段,并在确认页面上突出显示读音——一旦设为只读,就再也没有纠错的手段了。批量转换既有数据时,不要直接采用转换结果,而应视为「候选」,并提供让本人日后修正的入口。地名则可以靠公开数据解决——日本的邮编数据集中包含假名写法,因此地址的注音可以靠查表而非推定来准确填入(也可参考 地址分割)。 |
| 有些词的读音随上下文改变 | 普通名词同样存在读音分歧。一日 有 tsuitachi(每月一号)与 ichinichi(一天);今日 有 kyo(今天)与 konnichi(当今);大人気 有 daininki(大受欢迎)与 otonage(成年人的稳重),意思完全不同。量词的变化更有规律:一本、三本、六本 中同一个字分别读作 ippon、sanbon、roppon,随前面的数字变出三种形态。浏览器内的轻量词典完全做不了这类判断(因为它是逐词查表)。使用 MeCab 的高精度模式会参考前后文,改善明显,但它返回的依然只是统计上的众数。另外请注意,高精度模式仅对平假名 / 片假名 / 罗马字三种输出有效;注音(ruby)显示与一览表需要词元信息,因此使用轻量词典。 |
要转换成段的文章,请使用高精度模式。与轻量词典差距最大的是含动词与助词的句子;若只是词语罗列,两者几乎没有差别。而且转换之后一定要回读一遍——重点看数字紧随其后的位置、专有名词,以及读法众多的汉字。在教材、字幕这类读音准确性至关重要的用途中,请把转换结果当作草稿,并把人工校对纳入流程。反过来,若用于检索的读音索引或排序键,少量错误是可以容忍的——「拿来做什么」决定了所需的精度,所以请先定下这一点,再选择手段。 |
| 不同的提交对象,假名规则各不相同 | 转换出来的读音,能原样粘贴过去的地方并不多。日本的表单有一条惯例:标为片假名的栏位要填片假名,标为平假名的栏位要填平假名,写反了会被退回。金融机构更严格,通常要求只能用半角片假名、可用符号有限、浊音符号按单独一个字符计数、长音与小字有自成一套的规则。还有位数上限。此外,罗马字也有多种方案——护照使用平文式(Hepburn),おおの 写作 ONO;而训令式则是 OONO,同一个名字拼法就不一样。并不存在「正确的罗马字」,只存在提交对象所要求的那一种方案。 |
请先阅读提交对象给出的填写示例。规则就写在那一页上,没有需要猜测的余地。片假名的半角与全角可以事后用 全角半角转换 统一,所以稳妥的做法是先在本页输出片假名,宽度调整放到下一道工序。如果你是做表单的一方,请在输入框上指定 inputmode 与 pattern,明确写出你接受的字符种类——在输入时给出引导,远比事后拒绝要厚道。银行转账的户名必须与账户登记名逐字一致——唯独这里不要交给转换工具,请照着存折或卡面上的写法原样抄录。 |
只有高精度模式会向服务器传输内容。默认的浏览器内处理不会让输入离开你的设备,但使用 MeCab 的模式会把文本交给服务器(输入正文不会写入日志)。含个人信息的文本(如客户名单)请用默认模式处理,或者干脆不要放进这类工具——「不传输」与「接收方可信」是两回事,能选前者时就选前者,这是原则。另外,在 HTML 中嵌入注音时请使用 <ruby> 与 <rt>——在词后用括号写读音,会让屏幕阅读器把同一个词念两遍。用 <ruby> 只会念一遍,而且配上 <rp>,括号就只在不支持 ruby 的环境中出现。注音是一项无障碍功能,不是装饰——请先确定它服务的对象(儿童、学习者,还是仅限难读词),再决定要不要给全部内容加注。
📖 使用方法
-
1
粘贴文本输入或粘贴含汉字的日语文本。
-
2
选择输出模式在 furigana / 平假名 / 片假名 / 罗马字(黑本式 / 训令式)/ 词素表中选择。
-
3
转换后复制或下载点击转换后可复制或下载。读音不明的汉字显示为 ?。
❓ 常见问题
使用什么词典?
罕见姓名和地名的读音准确吗?
黑本式与训令式罗马字的区别?
🐛 此工具出现问题了吗?
免费、无需注册。仅提供复现步骤也有帮助。报告将直接发送给运营者并用于改进。
感谢您的反馈!
已送达运营者,将用于改进工具。