情报杂志
情報雜誌
정보잡지
JOURNAL OF INFORMATION
2008年
5期
79-81
,共3页
条件随机场%中文分词%歧义词%未登陆词
條件隨機場%中文分詞%歧義詞%未登陸詞
조건수궤장%중문분사%기의사%미등륙사
提出了一种基于条件随机场(Conditional Random Fields,简称CRF)的中文分词方法.CRF模型利用词的上下文信息,对歧义词和未登陆词进行分词统计处理取得了理想的效果.以SIGHAN2006 Chinese Language Processing Bakeoff提供的数据作为实验数据.实验数据表明,基于CRF的中文分词方法取得了很好的效果,在Uppen,Msra两种语料的封闭测试中准确率分别达到了95.8%和95.9%.
提齣瞭一種基于條件隨機場(Conditional Random Fields,簡稱CRF)的中文分詞方法.CRF模型利用詞的上下文信息,對歧義詞和未登陸詞進行分詞統計處理取得瞭理想的效果.以SIGHAN2006 Chinese Language Processing Bakeoff提供的數據作為實驗數據.實驗數據錶明,基于CRF的中文分詞方法取得瞭很好的效果,在Uppen,Msra兩種語料的封閉測試中準確率分彆達到瞭95.8%和95.9%.
제출료일충기우조건수궤장(Conditional Random Fields,간칭CRF)적중문분사방법.CRF모형이용사적상하문신식,대기의사화미등륙사진행분사통계처리취득료이상적효과.이SIGHAN2006 Chinese Language Processing Bakeoff제공적수거작위실험수거.실험수거표명,기우CRF적중문분사방법취득료흔호적효과,재Uppen,Msra량충어료적봉폐측시중준학솔분별체도료95.8%화95.9%.