文字種抽出ツール|数字・英字・ひらがな・カタカナ・漢字だけを抽出
テキストを入力し、抽出する文字を選んでください。
このツールでできること
文章から数字、英字、ひらがな、カタカナ、漢字を選んで抽出できます。複数の文字種を組み合わせられるため、数字だけ、英字だけ、英数字、日本語文字だけといった形で結果をコピーできます。
使い方
- 入力欄へテキストを貼り付けます。
- 抽出する文字の種類を1つ以上選びます。
- 必要に応じて「改行を保持する」を切り替えます。
- 「文字を抽出」を押し、結果をコピーします。
入力例・出力例
数字と英字を選択した例です。ハイフン、括弧、漢字は選択外なので除きます。
入力: 商品A-123(青)
結果: A123
抽出文字数: 4文字
漢字とカタカナを選択した例です。数字を除き、元の順序と文字幅を変えずに抽出します。
入力: 東京タワー2026
結果: 東京タワー
抽出文字数: 5文字
よくある利用場面
- 商品名や管理番号から英数字だけを取り出すとき
- 文章から日本語文字だけを残し、記号や絵文字を除きたいとき
- OCR結果やコピーしたデータを文字種ごとに確認するとき
処理仕様
数字は半角・全角の0~9、英字は半角・全角の英大文字・英小文字(A~Z、a~zとその全角形)、ひらがな、全角・半角カタカナ、漢字を対象にします。漢字を選んだ場合は々、〆、〇も含めます。ひらがなまたはカタカナを選んだ場合は長音符ーを保持します。濁点・半濁点は対応する仮名に付随する場合だけ、異体字セレクタは選択文字に付随する場合だけ保持し、単独の付随記号は抽出しません。
初期状態では数字と英字を選択し、改行を保持します。空白、タブ、記号、絵文字等の選択外文字は除外します。文字の順序、重複、大文字・小文字、全角・半角を変更せず、Unicode正規化や文字種変換は行いません。HTMLやMarkdownも解析せず、入力されたプレーンテキストとして扱います。保持した改行、仮名に付随する濁点・半濁点、異体字セレクタは抽出文字数へ個別に加算しませんが、長音符は1文字として数えます。
丸数字、ローマ数字、漢数字、アラビア・インド数字などは数字として扱わず、アクセント付きラテン文字も英字として扱いません。漢数字は漢字を選択した場合に抽出されます。空入力や空白だけの入力、文字種が1つも選択されていない状態はエラーです。入力があり、選択した文字が見つからない場合は正常に処理し、0文字として案内します。このとき保持対象の改行だけが結果欄に残る場合がありますが、コピーボタンは無効です。入力または設定を変更すると、以前の結果は無効になります。
入力データについて
処理はブラウザ内だけで行います。入力内容をToolRollのサーバーや外部サービスへ送信せず、CookieやWeb Storageにも保存しません。