読み込み中...
読み込み中...
Unicodeの句読点カテゴリ(\p{P})と記号カテゴリ(\p{S})に属する文字を正規表現[\p{P}\p{S}]でまとめて削除する。判定はUnicodeカテゴリベースのため、ひらがな・カタカナ・漢字・アクセント付き文字(é等)などの文字(レター)は削除されず、半角・全角を問わず句読点や記号だけが取り除かれる。アンダースコア(_)はUnicode上「連結punctuation」(Pc)に分類されるため、記号として削除される点に注意。
最終更新日 ・ by yuzlrin