正则表达式匹配中文问题

soft53ears 2009-10-28 11:56:53
在正则中匹配中文是匹配的Unicode的编码\u4e00-\u9fa5
假如说出现了生僻字,会不会没有出现在这段编码之中呢???
那这样的话怎么判断是否为中文呢??


求解
...全文
230 16 打赏 收藏 转发到动态 举报
写回复
用AI写文章
16 条回复
切换为时间正序
请发表友善的回复…
发表回复
tttiiillll 2012-04-06
  • 打赏
  • 举报
回复
“㛃”编码是36c3用正则表达式就无法检查出来
soft53ears 2009-11-04
  • 打赏
  • 举报
回复
前几天有点忙..没有来结贴.......不得不膜拜强大的火龙果...
onlyxing 2009-11-04
  • 打赏
  • 举报
回复
mark
szzxm 2009-10-29
  • 打赏
  • 举报
回复
学习学习,每天回复有10个可用分
summerXJY100 2009-10-29
  • 打赏
  • 举报
回复
\u4e00-\u9fa5
所有的中文
whb3118 2009-10-29
  • 打赏
  • 举报
回复
生僻字也是中文~!
你要写出阿拉伯文,就不是中文了。
py330316117 2009-10-29
  • 打赏
  • 举报
回复
没什么可说的了。。。(难道我也说不会,显而易见吗)
amdgaming 2009-10-29
  • 打赏
  • 举报
回复
不会的,这个 不用担心。。
coolbamboo2008 2009-10-29
  • 打赏
  • 举报
回复
mark,学习
johnston678 2009-10-29
  • 打赏
  • 举报
回复
学习中,还没怎么过匹配中文
lihao1129 2009-10-29
  • 打赏
  • 举报
回复
应该是所有的汉字,应该不会有问题的
loveofmylife 2009-10-29
  • 打赏
  • 举报
回复
这个是所有的汉字吧,应该不会有问题吧
如果真的有不能匹配在网上查一下它的unicode码
  • 打赏
  • 举报
回复
也可以使用 [\p{InCJK Unified Ideographs}&&\P{Cn}] 这个比较有扩展性,比如 Unicode 在 U+9FA6 新加了一个字的话,这也能匹配
苍蝇①号 2009-10-29
  • 打赏
  • 举报
回复
用utf-8全部问题不是问题

62,621

社区成员

发帖
与我相关
我的任务
社区描述
Java 2 Standard Edition
社区管理员
  • Java SE
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧