这篇文章主要介绍“spark集群如何使用hanlp进行分布式分词”,在日常操作中,相信很多人在spark集群如何使用hanlp进行分布式分词问题上存在疑惑,小编查阅了各式资料,整理出简单好用的操作方法,希望对大家解答”spark集群如何使用hanlp进行分布式分词”的疑惑有所帮助!接下来,请跟着小编一起来学习吧!分两步:第一步:实现hankcs.hanlp/corpus.io.IIOAdapter1.public class HadoopFileIoAdapter implements IIOAdapter {2.3.@Override4.public InputStream open(String path) throws IOEx免费主机域名ception {5.Configuration conf = new Configuration();6.FileSystem fs = FileSystem.get(URI.create(path), conf);7.retu免费主机域名rn fs.open(new Path(path));8.}9.10.@Override11.public OutputStream create(String path) throws IOException {12.Configuration conf = new Configuration();13.FileSystem fs = FileSystem.get(URI.create(path), conf);14.OutputStream out = fs.create(new Path(path));15.return out;16.}17. }第二步:修改配置文件。root为hdfs上的数据包,把IOAdapter改为咱们上面实现的类ok,这样你就能在分布式集群上使用hanlp进行分词了。到此,关于“spark集群如何使用hanlp进行分布式分词”的学习就结束了,希望能够解决大家的疑惑。理论与实践的搭配能更好的帮助大家学习,快去试试吧!若想继续学习更多相关知识,请继续关注云技术网站,小编会继续努力为大家带来更多实用的文章!
相关推荐: SQLServer 2000怎么定时执行SQL语句
本篇内容主要讲解“SQLServer 2000怎么定时执行SQL语句”,感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷,实用性强。下面就让小编来带大家学习“SQLServer 2000怎么定时执行SQL语句”吧!我不知道存储过程等能否实现,但是SQL Se…