最近高产似母猪,写了个基于AP的中文分词器,在Bakeoff-05的MSR语料上F值有96.11%。最重要的是,只训练了5个迭代;包含语料加载等IO操作在内,整个训练一共才花费23秒。应用裁剪算法去掉模型中80%的特征后,F值才下降不到0.1个百分点,体积控制在11兆。如果训练一...
全文
回复(0) 2019-01-14 10:59 来自版块 - 网络技术
表情
啊哦,还没有人评论哦,赶快抢个沙发!

返回顶部