匹配中文常用 \u4e00-\u9fa5 区间。下面这条规则只接受纯中文,不含数字、字母与标点。
默认正则
/^[\u4e00-\u9fa5]+$/
匹配常用汉字区间 U+4E00–U+9FA5 的中文字符。
中文汉字主要集中在 Unicode 的 U+4E00 到 U+9FA5 区间,覆盖绝大多数常用字。
规则 ^[\u4e00-\u9fa5]+$ 表示整串只能由该区间汉字组成,数字、字母与标点都不允许。
该区间不含生僻字扩展区与部分符号;如需更完整,可使用 Unicode 属性 \p{Script=Han}(需 u 标志)。
你好正则表达式中文测试abc你好123Hello世界你好!Q:为什么“你好!”不匹配?
感叹号属于标点,不在汉字区间内。若允许标点,可在字符类中加入相应符号。
Q:如何匹配中英混排?
把字符类扩展为 [\u4e00-\u9fa5A-Za-z],或使用中英混排专用规则。
Q:生僻字匹配不了怎么办?
可改用 Unicode 属性写法 \p{Script=Han} 并启用 u 标志,覆盖更完整的汉字集合。
Q:中文正则和 Unicode 模式有关吗?
\u4e00-\u9fa5 这种范围写法在非 Unicode 模式下也可用;\p{...} 则必须启用 u。