ハッシュタグ抽出
#の後にUnicode文字・数字・underscoreが続くhashtagを抽出します。
使い方
- hashtag入りテキストを入力して実行します。
主な機能と処理範囲
Unicode対応patternで#を含むtoken全体を返します。
処理の仕組み
/#[\p{L}\p{N}_]+/guの全matchを出します。
例
#東京_旅行 #2026の両方を抽出します。
こんな場面で便利
- 投稿draftからhashtag一覧を抜くとき
利用前の確認
- hyphen・空白はtag内でなく、platform別有効性は検証しません。
よくある質問
hyphenも含まれますか?
いいえ。文字・数字・underscoreだけです。