gensim
从基本的分词、词袋模型、分布式表示等概念开始
从基本的分词、词袋模型、分布式表示等概念开始,多面深入学习文本挖掘技术的各个方面。 文本挖掘(TM),又称自然语言处理(NLP),是AI时代炙手可热的数据分析挖掘前沿领域,其所涉及的人机对话系统,推荐算法,文本分类等技术在BAT等企业中都得到广泛应用。 本课程将使用经典武侠小说、大众点评抓取结果、微博语料数据等多个实际案例进行教学
从基本的分词、词袋模型、分布式表示等概念开始,多面深入学习文本挖掘技术的各个方面。 文本挖掘(TM),又称自然语言处理(NLP),是AI时代炙手可热的数据分析挖掘前沿领域,其所涉及的人机对话系统,推荐算法,文本分类等技术在BAT等企业中都得到广泛应用。 本课程将使用经典武侠小说、大众点评抓取结果、微博语料数据等多个实际案例进行教学