使い方
氏名を続けて入力して「分割する」。文字数では割りません—— サーバーの形態素解析器(MeCab + ipadic)が語に分け、品詞と人名辞書から姓・名を判定します。 だから「田中健太郎」も「佐々木小次郎」も「五十嵐一郎」も、辞書に載っている限り正しく割れます。 入力は保存もログ出力もしません(氏名は個人情報なので)。
「先頭2文字が姓」といった規則で当てにいくと必ず破綻します。3文字姓(佐々木・五十嵐)も 1文字姓(森・林・原)もあり、表記だけでは姓名の境界は決まらないからです。
辞書に無い姓は割れません。「別の例」の 4 つ目「八十田真希」は、ipadic が「八十田」を 姓として持たず「八十」を数字と読むため失敗します。この時 naqto は推測せず「分割できませんでした」と返します。判定の根拠(形態素解析の出力)を表示するので、 なぜ失敗したかが分かります。確実性が要るなら、そもそも入力欄を姓と名で分けるのが正解です。
よくある質問
「田中健太郎」はどこで姓と名に分かれますか?
「田中/健太郎」に分かれます。文字数ではなく MeCab の形態素解析と人名辞書で姓名の境界を判定するため、佐々木小次郎(佐々木/小次郎)や五十嵐一郎(五十嵐/一郎)のような3文字姓も正しく割れます。
「先頭2文字が姓」という規則で処理してはいけないのはなぜですか?
表記だけでは姓名の境界が決まらないからです。3文字姓(佐々木・五十嵐)も1文字姓(森・林・原)もあるため、文字数に基づく規則は必ず破綻します。だから品詞と人名辞書で判定します。
辞書に無い名前はどうなりますか?
推測せず「分割できませんでした」と返します。たとえば「八十田真希」は ipadic が「八十田」を姓として持たないため失敗し、その根拠(形態素解析の出力)を表示します。確実性が必要なら、入力欄を姓と名で分けるのが確実です。
入力した氏名は保存されますか?
いいえ。氏名は個人情報のため、サーバーでの解析に使うだけで、保存もログ出力もしません。