文字種抽出ツール|数字・英字・ひらがな・カタカナ・漢字だけを抽出

テキストツール
抽出する文字

テキストを入力し、抽出する文字を選んでください。

このツールでできること

文章から数字、英字、ひらがな、カタカナ、漢字を選んで抽出できます。複数の文字種を組み合わせられるため、数字だけ、英字だけ、英数字、日本語文字だけといった形で結果をコピーできます。

使い方

  1. 入力欄へテキストを貼り付けます。
  2. 抽出する文字の種類を1つ以上選びます。
  3. 必要に応じて「改行を保持する」を切り替えます。
  4. 「文字を抽出」を押し、結果をコピーします。

入力例・出力例

数字と英字を選択した例です。ハイフン、括弧、漢字は選択外なので除きます。

入力: 商品A-123(青)
結果: A123
抽出文字数: 4文字

漢字とカタカナを選択した例です。数字を除き、元の順序と文字幅を変えずに抽出します。

入力: 東京タワー2026
結果: 東京タワー
抽出文字数: 5文字

よくある利用場面

  • 商品名や管理番号から英数字だけを取り出すとき
  • 文章から日本語文字だけを残し、記号や絵文字を除きたいとき
  • OCR結果やコピーしたデータを文字種ごとに確認するとき

処理仕様

数字は半角・全角の0~9、英字は半角・全角の英大文字・英小文字(A~Z、a~zとその全角形)、ひらがな、全角・半角カタカナ、漢字を対象にします。漢字を選んだ場合は々、〆、〇も含めます。ひらがなまたはカタカナを選んだ場合は長音符ーを保持します。濁点・半濁点は対応する仮名に付随する場合だけ、異体字セレクタは選択文字に付随する場合だけ保持し、単独の付随記号は抽出しません。

初期状態では数字と英字を選択し、改行を保持します。空白、タブ、記号、絵文字等の選択外文字は除外します。文字の順序、重複、大文字・小文字、全角・半角を変更せず、Unicode正規化や文字種変換は行いません。HTMLやMarkdownも解析せず、入力されたプレーンテキストとして扱います。保持した改行、仮名に付随する濁点・半濁点、異体字セレクタは抽出文字数へ個別に加算しませんが、長音符は1文字として数えます。

丸数字、ローマ数字、漢数字、アラビア・インド数字などは数字として扱わず、アクセント付きラテン文字も英字として扱いません。漢数字は漢字を選択した場合に抽出されます。空入力や空白だけの入力、文字種が1つも選択されていない状態はエラーです。入力があり、選択した文字が見つからない場合は正常に処理し、0文字として案内します。このとき保持対象の改行だけが結果欄に残る場合がありますが、コピーボタンは無効です。入力または設定を変更すると、以前の結果は無効になります。

入力データについて

処理はブラウザ内だけで行います。入力内容をToolRollのサーバーや外部サービスへ送信せず、CookieやWeb Storageにも保存しません。