<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>個人開発</title><link>https://blog.ast.moe/tags/%E5%80%8B%E4%BA%BA%E9%96%8B%E7%99%BA/</link><description>Recent posts from 五里霧中</description><generator>Hugo</generator><item><title>日本の電話番号判定ライブラリを久しぶりに更新した</title><link>https://blog.ast.moe/blog/2026-09-28/</link><pubDate>Mon, 28 Sep 2026 12:42:00 +0900</pubDate><guid>https://blog.ast.moe/blog/2026-09-28/</guid><description>&lt;p&gt;2018年に&lt;a href="https://blog.ast.moe/blog/2018-11-08/"&gt;「電話番号の判定やりたくて」&lt;/a&gt;という記事を書いた。作り始めたばかりの&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp"&gt;go-tel-num-parser-jp&lt;/a&gt;を紹介して、&lt;code&gt;IsTelNumber&lt;/code&gt;の使い方を載せた短い記事だ。&lt;/p&gt;
&lt;p&gt;その後も少し手を入れたが、リポジトリの更新は2020年で止まっていた。久しぶりに見返してみると、電話番号の区分は当時のままだし、判定方法にも気になるところがあった。そこで、現在公表されている番号情報を見ながら、&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp/pull/4"&gt;番号区分と判定処理を更新した&lt;/a&gt;。&lt;/p&gt;
&lt;p&gt;今回やったのは、新しい番号の正規表現を足すことだけではない。入力文字列の一部だけが電話番号に見えるとき、何を成功とするかも整理した。&lt;/p&gt;
&lt;h2 id="何を判定するライブラリか"&gt;何を判定するライブラリか&lt;/h2&gt;
&lt;p&gt;Goから使う小さなパッケージで、主な入口は二つある。&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;pre tabindex="0" style="color:#f8f8f2;background-color:#272822;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;"&gt;&lt;code class="language-go" data-lang="go"&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#a6e22e"&gt;ok&lt;/span&gt;, &lt;span style="color:#a6e22e"&gt;kind&lt;/span&gt; &lt;span style="color:#f92672"&gt;:=&lt;/span&gt; &lt;span style="color:#a6e22e"&gt;tnp&lt;/span&gt;.&lt;span style="color:#a6e22e"&gt;IsTelNumber&lt;/span&gt;(&lt;span style="color:#e6db74"&gt;&amp;#34;060-1234-5678&amp;#34;&lt;/span&gt;)
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#75715e"&gt;// ok == true, kind == tnp.MobilePhone&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#a6e22e"&gt;number&lt;/span&gt;, &lt;span style="color:#a6e22e"&gt;err&lt;/span&gt; &lt;span style="color:#f92672"&gt;:=&lt;/span&gt; &lt;span style="color:#a6e22e"&gt;tnp&lt;/span&gt;.&lt;span style="color:#a6e22e"&gt;CropTelNumber&lt;/span&gt;(&lt;span style="color:#e6db74"&gt;&amp;#34;連絡先: 0800-123-4567&amp;#34;&lt;/span&gt;)
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#75715e"&gt;// number == &amp;#34;0800-123-4567&amp;#34;, err == nil&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;&lt;code&gt;IsTelNumber&lt;/code&gt;は入力全体が対応形式の電話番号かを判定する。&lt;code&gt;CropTelNumber&lt;/code&gt;は文章などの中から最初に見つかった番号を取り出す。同じ正規表現を使うとしても、この二つで求める振る舞いは違う。&lt;/p&gt;
&lt;p&gt;ここでいう「判定」は形式と区分の判定に限る。番号が実際に事業者へ指定されているか、現在使われているか、固定電話の市外局番が実在するかまでは確かめない。番号らしい形を見つける道具であって、電話をかけて到達できる番号の保証ではない。&lt;/p&gt;
&lt;h2 id="2020年から増えたもの直したもの"&gt;2020年から増えたもの、直したもの&lt;/h2&gt;
&lt;p&gt;今回、&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp/blob/master/README.md"&gt;README&lt;/a&gt;の対応表も作り直した。更新した区分のうち、特に分かりやすいのは次のあたりだ。&lt;/p&gt;
&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;形式の例&lt;/th&gt;
&lt;th&gt;今回の扱い&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;060-1234-5678&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;携帯電話の区分に追加&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;0200-12345-67890&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;14桁のデータ伝送携帯電話として追加&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;0800-123-4567&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;着信課金番号を11桁の形式に修正&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;0990-123-456&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;情報料代理徴収の区分を追加&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;&lt;code&gt;0600-123-4567&lt;/code&gt;&lt;/td&gt;
&lt;td&gt;FMC電話の区分を追加&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;&lt;code&gt;020&lt;/code&gt;の番号には11桁のものと&lt;code&gt;0200&lt;/code&gt;で始まる14桁のものがある。見た目が似ていても桁数は同じではない。&lt;code&gt;0800&lt;/code&gt;も、以前のコードでは10桁の形で扱っていたので修正した。ハイフンなしの表記にも対応している。&lt;/p&gt;
&lt;p&gt;もう一つ気を付けたいのが&lt;code&gt;060&lt;/code&gt;と&lt;code&gt;0600&lt;/code&gt;だ。前者を携帯電話の区分に加えたからといって、後者まで携帯電話として扱ってよいわけではない。&lt;code&gt;0600&lt;/code&gt;は別のFMC区分として判定する。先頭の数文字だけで大ざっぱに分類すると、こういうところで間違える。&lt;/p&gt;
&lt;p&gt;ただし、&lt;code&gt;060&lt;/code&gt;を判定できることと、&lt;code&gt;060&lt;/code&gt;の番号がすでに一般に利用されていることも別の話だ。番号計画上の形式を扱う実装として追加している。&lt;a href="https://www.soumu.go.jp/main_sosiki/joho_tsusin/top/tel_number/060keitai.html"&gt;総務省の案内&lt;/a&gt;や指定状況へのリンクはREADMEにもまとめた。&lt;/p&gt;
&lt;h2 id="正規表現に一致しただけでは困る"&gt;正規表現に一致しただけでは困る&lt;/h2&gt;
&lt;p&gt;以前の&lt;code&gt;IsTelNumber&lt;/code&gt;は、正規表現の&lt;code&gt;MatchString&lt;/code&gt;で判定していた。これは文字列のどこかに一致する部分があれば真になる。名前から期待する「この文字列全体が電話番号か」とは違う。&lt;/p&gt;
&lt;p&gt;例えば、&lt;code&gt;call 03-5321-1111&lt;/code&gt;は電話番号を含む文章だが、それ自体が電話番号ではない。&lt;code&gt;IsTelNumber&lt;/code&gt;では偽にし、&lt;code&gt;CropTelNumber&lt;/code&gt;で取り出すべき入力だ。今回、この二つを共通の探索処理で扱いながら、&lt;code&gt;IsTelNumber&lt;/code&gt;では一致位置が文字列の先頭から末尾までかを確認するようにした。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;CropTelNumber&lt;/code&gt;の方にも罠がある。&lt;code&gt;01201234567&lt;/code&gt;のように一桁多い文字列から、先頭の&lt;code&gt;0120123456&lt;/code&gt;だけを電話番号として切り出してしまうと、間違った番号を拾う。候補の直前や直後に数字が続いている場合は採用しないようにしている。文章中に複数の番号があれば、区分の列挙順ではなく、文字列内で最初に現れる完全な候補を返す。&lt;/p&gt;
&lt;p&gt;ハイフンを除いた番号では、固定電話向けの広めのパターンがサービス番号の一部と重なることもある。&lt;code&gt;0120&lt;/code&gt;や&lt;code&gt;0570&lt;/code&gt;などを先に固有の区分で調べ、固定電話への誤った分類へ落ちないようにした。正規表現を一個ずつ見るだけでは、区分同士の重なりに気づきにくい。&lt;/p&gt;
&lt;p&gt;&lt;code&gt;03(5321)1111&lt;/code&gt;のような括弧付き表記も引き続き扱う。これは判定前に&lt;code&gt;03-5321-1111&lt;/code&gt;へ置き換えるため、&lt;code&gt;CropTelNumber&lt;/code&gt;から返る文字列もハイフン付きになる。&lt;/p&gt;
&lt;h2 id="除外設定とテスト"&gt;除外設定とテスト&lt;/h2&gt;
&lt;p&gt;以前から、特定の区分を判定対象から外す&lt;code&gt;SetIgnoreTypes&lt;/code&gt;がある。今回、呼び出すたびに除外区分が積み重なる動作から、指定した区分で置き換える動作に変えた。引数なしの&lt;code&gt;SetIgnoreTypes()&lt;/code&gt;で解除できる。&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;pre tabindex="0" style="color:#f8f8f2;background-color:#272822;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;"&gt;&lt;code class="language-go" data-lang="go"&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#a6e22e"&gt;tnp&lt;/span&gt;.&lt;span style="color:#a6e22e"&gt;SetIgnoreTypes&lt;/span&gt;(&lt;span style="color:#a6e22e"&gt;tnp&lt;/span&gt;.&lt;span style="color:#a6e22e"&gt;MobilePhone&lt;/span&gt;)
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#75715e"&gt;// 携帯電話の区分を判定対象から外す&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#a6e22e"&gt;tnp&lt;/span&gt;.&lt;span style="color:#a6e22e"&gt;SetIgnoreTypes&lt;/span&gt;()
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#75715e"&gt;// 除外設定を解除する&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;共有する設定なので、読み書きは&lt;code&gt;sync.RWMutex&lt;/code&gt;で保護した。一方で、パッケージ全体の設定であること自体は変わらない。呼び出しごとに異なる除外条件を渡すAPIではないので、利用する側ではその点に注意がいる。&lt;/p&gt;
&lt;p&gt;今回は&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp/blob/master/tnp_test.go"&gt;回帰テスト&lt;/a&gt;も追加した。新しい区分の受理だけでなく、桁が一つ多い番号、以前の誤った&lt;code&gt;0800&lt;/code&gt;形式、対象外の&lt;code&gt;0170&lt;/code&gt;・&lt;code&gt;0180&lt;/code&gt;、&lt;code&gt;0600&lt;/code&gt;を携帯電話として扱わないことも確認する。手元のGo 1.27.1では&lt;code&gt;go test ./...&lt;/code&gt;と&lt;code&gt;go test -race ./...&lt;/code&gt;が通っている。&lt;/p&gt;
&lt;p&gt;ドキュメントも日本語のREADMEを整理し、&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp/blob/master/README.en.md"&gt;英語版&lt;/a&gt;と&lt;a href="https://github.com/ieee0824/go-tel-num-parser-jp/blob/master/LICENSE"&gt;MITライセンス&lt;/a&gt;を追加した。&lt;code&gt;go.mod&lt;/code&gt;の最低バージョンもGo 1.27.1に上げているので、以前の古いGo環境のまま使っていた場合はそこも変更点になる。&lt;/p&gt;
&lt;h2 id="番号の正しさには何段階かある"&gt;番号の「正しさ」には何段階かある&lt;/h2&gt;
&lt;p&gt;今回コードを直しながら、電話番号の「正しさ」は一つではないと改めて感じた。文字列全体が所定の桁数と形式か。どの番号区分に入るか。その番号が実際に割り当てられているか。今も使われていて発信できるか。後ろの方まで確認するには、正規表現だけでは足りない。&lt;/p&gt;</description></item></channel></rss>