ruby 正则表达式 匹配中文
2013-07-25 23:47
148 查看
1.puts /[一-龥]+/.match("this is 中文") =>中文
2.str2="123中文"
puts /\p{Han}+/u.match(str2)
文本编码格式:utf-8
文件第一行:#encoding:utf-8
require "rubygems"
require "iconv"
print Iconv.iconv("GBK","UTF-8",/\p{Han}+/u.match("tiantianxin你好angshang天天向上")[0]) =>你好
Ruby 和部分语言可以直接
还有常用的:
适用于中韩日的正则表达式,参考:http://chrisyip.im/post/regular-expression-for-cjk/
学习参考:http://ruby-china.org/topics/5680
2.str2="123中文"
puts /\p{Han}+/u.match(str2)
文本编码格式:utf-8
文件第一行:#encoding:utf-8
require "rubygems"
require "iconv"
print Iconv.iconv("GBK","UTF-8",/\p{Han}+/u.match("tiantianxin你好angshang天天向上")[0]) =>你好
Ruby 和部分语言可以直接
#{Han}等方式匹配特定的语言,但是对于某些语言,如 JavaScript,是不可能如此简便的
还有常用的:
/\p{Word}+/u不限于 a-z0-9 的成词字符(就是非标点制表符空格等杂类的字符)
/\p{Hiragana,Katakana}+/u匹配平假名+片假名
适用于中韩日的正则表达式,参考:http://chrisyip.im/post/regular-expression-for-cjk/
学习参考:http://ruby-china.org/topics/5680
相关文章推荐
- IOS 正则表达式匹配文本中URL位置并获取URL所在位置(解决连接中文问题)
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- js 正则表达式匹配中文
- 正则表达式匹配中文的情况
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- Js 正则表达式匹配字符串中是否含有中文
- PHP正则表达式匹配中文
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- 正则表达式 匹配中文
- 匹配中文汉字的正则表达式介绍
- 匹配中文汉字的正则表达式介绍
- php匹配中文最准确的正则表达式
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- 匹配中文字符的正则表达式: [u4e00-u9fa5]
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- 常用正则表达式整合(可以匹配中文…
- 常用正则表达式大全!(例如:匹配中文、匹配html)
- Python正则表达式处理中文中的匹配