kenlm的使用

时间:2018-08-22 17:55:59   收藏:0   阅读:1301

1.训练模型

install_path/bin/lmplz -o 3 -S 80% -T /temp <text >text.arpa 

         技术分享图片

2.查询模型

    为了更快的加载将 text.arpa 转换为 binary 文件

install_path/bin/build_binary text.arpa text.binary 

    测试

install_path/bin/query text.binary <test.txt >result.txt

    结果如下图所示,输出每个句子的混淆度和未登录词,以及整个测试语料的混淆度和未登录词。

     技术分享图片

 

原文:https://www.cnblogs.com/Climbing-Snail/p/9519079.html

评论(0
© 2014 bubuko.com 版权所有 - 联系我们:wmxa8@hotmail.com
打开技术之扣,分享程序人生!