放牧代码和思想
专注自然语言处理、机器学习算法
    正处于一个非常忙的阶段,抱歉不会经常回应任何联络

2017年12月的文章

Structural Learning with Amortized Inference
机器学习

Structural Learning with Amortized Inference

hankcs阅读(113)评论(0)

Chang et al. 2015提出加速结构化学习的近似算法AI-DCD,通过缓存整数线性规划中相似的问题及解,减少对ILP solver的调用次数,从而加速训练,同时不损失精度。 平摊推断 记$\mathbf{y}=\{y_1,y_2,...

简单有效的多标准中文分词
中文分词

简单有效的多标准中文分词

hankcs阅读(414)评论(7)

本文介绍一种简洁优雅的多标准中文分词方案,可联合多个不同标准的语料库训练单个模型,同时输出多标准的分词结果。通过不同语料库之间的迁移学习提升模型的性能,在10个语料库上的联合试验结果优于绝大部分单独训练的模型。模型参数和超参数全部共享,复杂...

我的开源项目

HanLP自然语言处理包基于DoubleArrayTrie的Aho Corasick自动机