谷歌Chrome浏览器插件
订阅小程序
在清言上使用

基于两阶段特征选择的医疗敏感文本分类

Computer Technology and Development(2020)

引用 0|浏览2
暂无评分
摘要
为完成对医疗数据的敏感性分类,采用文本分类技术从对医疗敏感数据的分类的角度对医疗信息隐私保护进行了研究.在传统的医疗文本分类基础上,提出基于LSI-TF-IDF两阶段特征选择的文本分类方法对医疗文本数据进行敏感性分类.分别采用基于TF-IDF的传统文本分类方法和基于LSI-TF-IDF的两阶段特征选择的文本分类方法对糖尿病文本数据进行敏感性分类,利用朴素贝叶斯、KNN、SVM三个分类器进行实验比较,采用准确率、召回率和F1值作为评价标准.实验结果表明,基于LSI-TF-IDF两阶段特征选择的文本分类方法较之基于TF-IDF的传统文本分类方法在准确率、召回率和F1值上均有所提升.证明了该方法在医疗文本数据的敏感性分类上具有更好的分类效果.
更多
AI 理解论文
溯源树
样例
生成溯源树,研究论文发展脉络
Chat Paper
正在生成论文摘要