跳到内容

👤 日本姓名分割工具

每行粘贴一个姓名。工具按空格 → 300+ 姓氏词典 → 2 字默认顺序自动分割姓和名,带置信度,可就地修正后导出 CSV / TSV。读音由约 50KB 内置词典即时填充。

完全免费 无需注册 浏览器内完成 可选启用 5 种语言 深色模式

默认浏览器处理。勾选"高精度模式"时启用 MeCab 服务器处理(无日志)。

⚠️ 关于准确度

本工具并非 100% 准确。复合姓、罕见姓、外国名可能误判,导出前请人工确认。

读音使用内置词典(约 50KB),即时动作,罕见专有名词或难读汉字可能留空。

🔒 关于隐私

📖 常见的坑

把日文姓名拆分为姓与名,并推定读音。默认全部在浏览器内基于内置词典完成;只有选择「高精度模式」时才会交由服务器上的 MeCab 处理(不保留日志)。这项处理在原理上不可能做到 100%——无论「在哪里断开」还是「怎么读」,都无法仅凭书写形式确定。同样的四个字,不同的人断法不同;同样的写法,不同的人读法也不同。

情形 会发生什么 怎么处理
有些名字拆不开,或者拆错了 内置的姓氏词典以最长匹配比对三百多个姓,但罕见姓、复姓、源自地名的姓都会落在它之外。更根本的问题是,「姓 + 名」这个框架本身并不普适冰岛根本没有家族共用的姓,用的是父名制;印度尼西亚有人只有单一名字。即便只看日本国内,也有拥有中间名的人、通名与本名并记的人、婚后改姓而并记旧姓的人拆错的后果不只是数据错误,而是把一个人的名字弄错了,那是一种失礼。 凡是标为「低」置信度的行,请务必由人核对。本工具之所以返回置信度,正是因为逐行肉眼核对不现实,需要缩小该看哪些行。按空格拆开的是「高」,词典最长匹配的是「中」,其余为「低」,因此只核对「低」的行,单位投入的收益最大而作为设计问题,更重要的是反问「是否真的需要拆分」表单里分设姓与名两个字段的设计,会把日本以外的用户和只有单一名字的人挡在门外如果只是想以名字称呼对方,就不需要拆分——用一个字段接收完整姓名并原样显示,反而更准确拆分带来的错误,往往大于不拆分带来的不便。
读音是空的,或者读错了 同一种写法可能有多种读音,而哪一种才对,只有本人知道。姓氏 東海林 既读作 Shoji 也读作 Tokairin,两种家族都真实存在新谷 可读 Shintani、Niiya、Araya;中田 可读 Nakata 或 Nakada——它们不是方言或地域差异,而是逐家不同,因此词典再全也无法机械确定。名字则更加自由:给一组汉字配哪种读音,全凭取名者的裁量。遇到生僻的专有名词或旧字形,词典里根本没有条目,读音便返回空白 唯一正确的做法,是让本人来填写读音。在申请表或注册表单中,请在姓名字段旁设置一个读音字段——不依赖推定,无论从准确性还是从礼貌来说都是最优解。本工具真正有价值的场合,是补全那些当初没有读音字段、就这么积累下来的既有数据;即便如此,也不要把推定的读音当作确定值保存——请以能看出「这是推定值」的形式保存(单独一列、加标记),并在有机会接触本人时确认并覆盖把推定的读音直接用于名册排序或收件人语音播报,错误就会暴露在众人面前。
没弄清前提就用了高精度模式 高精度模式会在服务器上运行 MeCab 形态素分析,也就意味着你输入的姓名会经由网络传输。本站不保留日志,并在处理完成后立即丢弃输入;但「会被传输」这一事实本身,在某些场合就是一道约束客户名单、员工名册、患者信息等,通常都受组织规章约束,禁止发送至外部服务姓名单凭自身就可能识别到个人,因此仅仅因为「精度更高」就切换过去,有可能已经违反了规章 请先试试默认的浏览器内模式,看是否已经够用。已用空格分隔的姓名,本来就既不需要词典也不需要分析,会直接返回「高」置信度。实务中大多数名册数据本就是空格分隔的,因此高精度模式只有在「存在成批不含空格的姓名」时才需要。若确实需要,请先确认组织的规章再使用——判断标准是「这份文件能否用邮件发到公司外部」。如果不能,在本地安装 MeCab、在自己的环境里处理,才是正确的选择brew install mecab mecab-ipadicapt install mecab mecab-ipadic-utf8)——同词典、同引擎,结果与这里相当

姓名属于个人信息。本页的默认模式完全在浏览器内运行、不传输任何数据;但从你把结果下载为 CSV 或 TSV 的那一刻起,保管它就成了你的责任客户名单长期留在下载文件夹里、或以仍带着项目名的文件名被分享出去——这类事故比处理环节本身更容易发生。请在开始之前就定好处理方式:文件名不含项目名或公司名、工作结束即删除。最后,给能影响设计的人一点提醒:「把姓名拆成两个字段来保存」这一设计,其假设比多数系统真正需要的更强若只是用于称呼,就不需要拆分若是为了排序,你需要的是读音而非拆分数一数究竟有多少地方真正只需要姓(正式称呼某人、按姓分组),你就能看出,为此赌上全部记录的准确性是否值得——请把「不拆分」作为第一个被考虑的选项。

📖 使用方法

  1. 1
    粘贴姓名
    每行一个,有无空格均可。
  2. 2
    执行
    点击分割。按空格 → 词典 → 2 字默认顺序。
  3. 3
    下载 CSV / TSV
    低置信度行可就地编辑后导出。

❓ 常见问题

置信度如何判断?
空格分隔为"高",词典匹配为"中",其余(2 字默认)为"低"。读音从姓、名、熟语、单字词典最长匹配获取。
能正确处理复合姓吗?
词典含主要复合姓并按最长匹配。罕见姓可能误判。
外国名怎么办?
不支持。请手动加空格或修正结果。
🐛 此工具出现问题了吗?

免费、无需注册。仅提供复现步骤也有帮助。报告将直接发送给运营者并用于改进。

※ 为复现问题,浏览器信息 (UA / 屏幕 / 语言 / URL) 将自动发送