👤 氏名 → 姓・名分割ツール
1 行 1 氏名を貼り付け、空白区切り → 300+ 姓辞書 → 2 文字姓デフォルトの順で姓と名を自動推定。信頼度 (高/中/低) 付きで表示し、誤判定はその場で修正してから CSV / TSV 出力できます。読みは内蔵辞書 (約 50KB) で即時付与します。
既定はブラウザ完結。「高精度モード」をチェックした時のみ MeCab サーバー処理 (ログ無し)。
⚠️ 精度に関する注意
100% 正確な分割ではありません。複合姓・珍しい姓・外国人名・カタカナ名は誤判定される場合があります。最終出力前に必ず手動で確認してください。
読みは軽量内蔵辞書 (約 50KB) を使用。即時動作しますが、珍しい固有名詞や難読漢字は読みが空欄になることがあります。
🔒 プライバシーについて
- ・すべての処理はあなたのブラウザ内で完結します
- ・氏名データは一切サーバーに送信されません
- ・保存ログ・アップロード履歴・データベース等は存在しません
📖 つまずきやすいポイント
氏名を姓と名に分割し、読みを推定します。既定はブラウザ内の内蔵辞書で完結し、「高精度モード」を選んだときだけ MeCab によるサーバー処理を行います (ログは残しません)。この処理は原理的に 100% にはなりません — 「どこで切るか」も「どう読むか」も、表記だけからは決まらないためです。同じ 4 文字でも切る位置は人によって違い、同じ表記でも読みは本人によって違います。
| ケース | 何が起きるか | どうする |
|---|---|---|
| 分割できない・間違って分割される名前がある | 内蔵の姓辞書は 300 件以上を最長一致で照合しますが、珍しい姓・複合姓・地名由来の姓は外れます。より根本的な問題として、「姓と名」という枠組み自体が普遍的ではありません — アイスランドには家族で共有する姓が無く (父称を使います)、インドネシアには単一の名だけを持つ人がいます。日本国内に限っても、ミドルネームのある人、通名と本名を併記する人、婚姻で姓が変わり旧姓を併記する人がいます。誤って分割した結果は、単なるデータの誤りではなく、その人の名前を間違えるという失礼になります。 | 信頼度が「低」の行は、必ず人が確認してください — このツールが信頼度を返しているのは、全件を目で見るのは現実的でないので、見るべき行を絞り込むためです。空白区切りで分割できたものは「高」、辞書に最長一致したものは「中」、それ以外は「低」なので、「低」だけを確認すれば、労力に対する効果が最も大きくなります。そして、設計の話としてより重要なのは「そもそも分割が必要か」を問い直すことです — フォームで姓と名を別々に入力させる設計は、日本国外の利用者や単一名の人を弾きます。「〇〇様」と呼びかけたいだけなら分割は不要で、氏名を 1 つのフィールドで受け取り、そのまま表示するほうが正確です — 分割によって生じる誤りのほうが、分割しないことによる不便より大きいことが多いです。 |
| 読みが空欄になる・間違っている | 同じ表記に複数の読みがあり、どれが正しいかは本人しか知りません。「東海林」は「しょうじ」とも「とうかいりん」とも読み、どちらも実在する姓です。「新谷」は「しんたに」「にいや」「あらや」、「中田」は「なかた」「なかだ」 — これらは方言や地域差ではなく、家ごとに違うので、辞書をどれだけ充実させても機械的には決まりません。名のほうはさらに自由で、同じ漢字にどの読みを当てるかは名付けた側の裁量です。難読の固有名詞や旧字体では、そもそも辞書に無いため読みが空欄になります。 |
読みは本人に入力してもらうのが唯一の正解です。申込フォームや会員登録では、氏名の欄と並べて「ふりがな」の欄を用意してください — 推定に頼らないことが、正確さの点でも礼儀の点でも最善です。このツールが役に立つのは、読みの欄が無いまま蓄積してしまった既存データを補完するときで、その場合も推定した読みを「確定値」として保存しないでください — 「推定」であることが分かる形 (別カラム、フラグ付き) で持ち、本人と接触する機会があれば確認して上書きするのが正しい扱いです。推定した読みを名簿の並び替えや宛名の読み上げにそのまま使うと、間違いが表に出ます。 |
| 高精度モードの前提を確認しないまま使う | 高精度モードは MeCab による形態素解析をサーバーで実行するため、入力した氏名がネットワークを通じて送信されます。このサイトはログを残さず、処理直後に破棄しますが、「送信される」という事実そのものが制約になる場面があります — 顧客名簿・従業員名簿・患者情報のように、組織の規程で外部サービスへの送信が禁じられているデータは珍しくありません。氏名は単体で個人を特定しうる情報なので、「精度が上がるから」という理由だけで切り替えると、規程違反になっている可能性があります。 | まず既定のブラウザ内モードで足りるかを試してください — 空白で区切られた氏名なら、そもそも辞書も解析も不要で、信頼度「高」が返ります。実務上、名簿データの多くは既に空白区切りなので、高精度モードが必要なのは「空白の無い氏名がまとまって存在する」場合に限られます。それでも必要な場合は、組織の規程を確認してから使ってください — 判断の基準は「そのファイルをメールで社外に送ってよいか」です。送ってよくないなら、ローカルに MeCab を入れて自分の環境で処理するのが正しい選択です (brew install mecab mecab-ipadic / apt install mecab mecab-ipadic-utf8) — 同じ辞書・同じエンジンなので、結果はここと同等になります。 |
氏名は個人情報です。このページの既定モードはブラウザ内で完結し、データは送信されませんが、結果を CSV や TSV としてダウンロードした時点から先は、その管理はあなたの責任になります — 顧客名簿がダウンロードフォルダに残り続ける、案件名を含むファイル名のまま共有される、といった事故は、処理そのものより起きやすいです。ファイル名に案件名や社名を入れない、作業が終わったら削除する、といった扱いを決めてから始めてください。最後に、設計に関わる立場の人に向けて 1 点 — 「姓名を分割して保存する」という設計は、多くの場合に必要とされているより強い前提を置いています。宛名に使うだけなら分割は不要ですし、並び替えに使いたいなら分割ではなく読みが必要です。本当に姓だけが必要な場面 (「山田様」と呼びかける、姓でグルーピングする) がどれだけあるかを数えてみると、そのために全レコードの正確性を賭ける価値があるかが見えてきます — 分割しないという選択肢を、最初に検討してください。
📖 使い方
-
1
氏名を貼り付け1 行 1 氏名でテキストエリアに貼り付け。空白あり / なし両方に対応します。
-
2
分割実行「分割実行」をクリック。空白 → 300+ 姓辞書 → 2 文字姓デフォルトの順で推定します。
-
3
CSV / TSV ダウンロード信頼度「低」の行は修正してから CSV / TSV としてダウンロードできます。
❓ よくある質問
信頼度はどう決まりますか?
複合姓 (例: 佐々木) は正しく分割されますか?
外国人名やカタカナ名は?
🔗 関連ツール
🐛 このツールで問題が発生しましたか?
完全無料・登録不要。再現手順だけでも結構です。届いたご報告は運営者に直接届き、修正の参考にします。
ご報告ありがとうございます!
運営者に届きました。改善の参考にさせていただきます。