URL抽出ツール
0件
URLを含むテキストを入力してください。
このツールでできること
文章、メール、ログ等に含まれるHTTP・HTTPS URLと、www.で始まるWebアドレスを抽出し、1件1行で表示できます。
使い方
- URLを含むテキストを入力します。
- 「URLを抽出」を押します。
- 抽出件数と結果を確認し、「結果をコピー」を押します。
入力例・出力例
次の文章からURLを1件抽出する例です。
入力:
詳細は https://toolroll.jp/example/?a=1 を確認してください。
抽出結果:
https://toolroll.jp/example/?a=1
抽出件数: 1件
同じURLが文章中に2回あれば、結果にも出現順で2件表示します。重複削除やURLの正規化は行いません。
よくある利用場面
- メールやチャット履歴から共有されたURLだけを一覧化するとき
- アクセスログや原稿からHTTP・HTTPSリンクを抜き出すとき
- 複数ページ分の文章から、確認対象のWebアドレスをまとめるとき
処理仕様
http://、https://、www.で始まるURLを、接頭辞の大文字・小文字を区別せず対象にします。- URLは出現順に1件1行で表示し、重複を削除しません。
- URLの大文字・小文字、パス、クエリ、フラグメント、末尾スラッシュは原則として維持します。
- 空白、半角の引用符(
"と')、山括弧(<と>)、「」、『』、【】をURL候補の境界として扱います。 - 候補末尾の
.、,、;、:、、、。、,、.、;、:は結果から除きます。 ()、[]、{}と対応する全角括弧は、URL内で釣り合う分を維持し、URL外側の余分な閉じ括弧だけを除きます。- スキームも
www.もないドメイン、HTTP以外のスキーム、メールアドレス、相対URLは対象外です。 - メールアドレスや別のドメイン等に埋め込まれた
www.は対象外です。 - 標準の
URLコンストラクターでHTTP・HTTPS URLとして解析できる候補だけを採用します。www.形式は検証時だけhttps://を補い、結果には入力中の表記をそのまま出します。 - 日本語ドメイン、IPv4、角括弧付きIPv6、
localhostに対応します。その他の単一ラベルのホスト名は対象外です。 - URLの正規化、デコード、リンク化は行わず、URLが実在するか、安全か、接続できるかも確認しません。
空文字列または空白だけの入力は処理しません。URLが見つからない場合は正常終了として0件を表示し、コピーを無効にします。
自然言語中のURL終端は完全には判定できません。除外対象の末尾記号が実際のURLの一部でも文章記号として除かれ、上記以外の引用符や記号はURL候補に含まれる場合があります。HTMLやMarkdownは構文解析せず、その中に書かれたURL文字列だけを抽出します。
入力データについて
入力したテキストと抽出結果はブラウザ内だけで処理されます。ToolRollのサーバーや外部サービスへ送信せず、抽出したURLへアクセスせず、Cookieやブラウザストレージにも保存しません。