メンション抽出
@の後にUnicode文字・数字・underscoreが続くmention候補を抽出します。
使い方
- mentionを含むテキストを入力して実行します。
主な機能と処理範囲
@を含む全tokenを探し、email等の文脈とは区別しません。
処理の仕組み
/@[\p{L}\p{N}_]+/guのmatchを1行ずつ返します。
例
Hi @user_1 and @太郎から2候補を抽出します。
こんな場面で便利
- 投稿文から@identifier候補を集めるとき
利用前の確認
- platform user名規則・実在確認はせずemail文脈も誤抽出する場合があります。
よくある質問
実在アカウント確認もしますか?
いいえ。文字patternだけです。