成人 站在国内属于灰色地带,即使在国外的一些合法的国家对于未成年人群也需要限制访问。因此无论国内外对于此类信息的识别特别重要。
成人 站包含大量的色情信息,目前对于色情信息的研究分为多个方面。有基于图像识别,来判定色情图片,色情视频等,主要应用场景是一些聊天软件中。有基于域名等关键信息过滤的来限制对此类站点的访问,主要应用场景是 络出口处,例如教育 和企业出口。本场 Chat 所阐述的是基于文本分类的方法来识别成人 站,例如有的浏览器会提示你访问的 站包含色情信息,就会用到类似的方法。
本场 Chat 主要包括以下几个方面:
- 分析 站哪些信息可以作为识别的语料信息;
- 语料信息的获取;
- 分词,去停用词形成词向量特征;
- 模型的训练识别及分析;
阅读全文: http://gitbook.cn/gitchat/activity/5b6e47ae96a58162ebcdbbe5

文章知识点与官方知识档案匹配,可进一步学习相关知识OpenCV技能树首页概览11609 人正在系统学习中 相关资源:软件标题修改器(标题修改工具)V1.0绿色版_exe标题修改-其它代码类…
声明:本站部分文章及图片源自用户投稿,如本站任何资料有侵权请您尽早请联系jinwei@zod.com.cn进行处理,非常感谢!