> 백엔드 개발 > PHP 튜토리얼 > 织梦中文分词 输入的词语返回乱码怎么办

织梦中文分词 输入的词语返回乱码怎么办

WBOY
풀어 주다: 2016-06-23 14:25:08
원래의
994명이 탐색했습니다.

php中文分词,织梦中文分词

织梦的中文分词 ,词库中明明有烦恼 ,忧愁这样的词语 ,但是测试输入 ,返回乱码 ,不知道是怎么回事   ,还有这样的代码  else if($n>0xA13F && $n 

回复讨论(解决方案)

if($n>0xA13F && $n 
他用的是 gbk 字符集,如果你不是的,那一定会乱码的

真的非常谢谢 ,但是应用的类 我都用编辑器存为utf-8 的格式了  ,输入的有些词语,就不会显示乱码啊 ,上面乱码的是经过分词后的词语 ,下面这一排是没有分词的原文,都没有显示乱码啊

他首先用 ReviseString 方法对传入串做预处理
其中有

        //如果中文字符        if(isset($str[$i+1])){          $c = $str[$i].$str[$i+1];
로그인 후 복사
就是说他认为一个中文是由两个字节组成的,这是 gbk 的编码规则
而一个非 ascii 的 utf-8 字符可以是 2个、3个、4个...字节组成
汉字的 utf-8 多由 3 个字节组成

你只把文件内容改为 utf-8 的,没有改变处理规则
出现乱码不就是很正常的了吗?

非常感谢 ,是代码处理的问题 ,所以源码害的深究一番了 !

调用前将 utf-8 转成 gbk 的
调用后在把 贵宾卡 转成 utf-8 的
这样就不需要研究算法了

呵呵 ,多谢多谢楼主 

错了    ,错了 ,多谢版主  。

원천:php.cn
본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
인기 튜토리얼
더>
최신 다운로드
더>
웹 효과
웹사이트 소스 코드
웹사이트 자료
프론트엔드 템플릿