摘要: CRF简介Conditional Random Field:条件随机场,一种机器学习技术(模型)CRF由John Lafferty最早用于NLP技术领域,其在NLP技术领域中主要用于文本标注,并有多种应用场景,例如:分词(标注字的词位信息,由字构词)词性标注(标注分词的词性,例如:名词,动词,助词)命名实体识别(识别人名,地名,机构名,商品名等具有一定内在规律的实体名词)本文主要描述如何使用CRF技术来进行中文分词。CRF VS 词典统计分词基于词典的分词过度依赖词典和规则库,因此对于歧义词和未登录词的识别能力较低;其优点是速度快,效率高CRF代表了新一代的机器学习技术分词,其基本思路是对汉字 阅读全文
posted @ 2012-11-01 09:16 东嘉CEO 阅读(422) 评论(0) 推荐(0)
该文被密码保护。 阅读全文
posted @ 2012-10-26 23:31 东嘉CEO 阅读(0) 评论(0) 推荐(0)
摘要: 在.net 编程环境中,系统的资源分为托管资源和非托管资源。 对于托管的资源的回收工作,是不需要人工干预回收的,而且你也无法干预他们的回收,所能够做的只是了解.net CLR如何做这些操作。也就是说对于您的应用程序创建的大多数对象,可以依靠 .NETFramework 的垃圾回收器隐式地执行所有必要的内存管理任务。 对于非托管资源,您在应用程序中使用完这些非托管资源之后,必须显示的释放他们,例如System.IO.StreamReader的一个文件对象,必须显示的调用对象的Close()方法关闭它,否则会占用系统的内存和资源,而且可能会出现意想不到的错误。 我想说到这里,一定要清楚什么是... 阅读全文
posted @ 2012-10-25 09:03 东嘉CEO 阅读(174) 评论(0) 推荐(0)
摘要: 阅读全文
posted @ 2012-10-20 10:07 东嘉CEO 阅读(93) 评论(0) 推荐(0)