本篇內(nèi)容介紹了“怎么在ubuntu下使用pycharm調(diào)用Hanlp自然語言處理包”的有關(guān)知識,在實(shí)際案例的操作過程中,不少人都會遇到這樣的困境,接下來就讓小編帶領(lǐng)大家學(xué)習(xí)一下如何處理這些情況吧!希望大家仔細(xì)閱讀,能夠?qū)W有所成!
讓客戶滿意是我們工作的目標(biāo),不斷超越客戶的期望值來自于我們對這個(gè)行業(yè)的熱愛。我們立志把好的技術(shù)通過有效、簡單的方式提供給客戶,將通過不懈努力成為客戶在信息化領(lǐng)域值得信任、有價(jià)值的長期合作伙伴,公司提供的服務(wù)項(xiàng)目有:域名與空間、網(wǎng)絡(luò)空間、營銷軟件、網(wǎng)站建設(shè)、洛扎網(wǎng)站維護(hù)、網(wǎng)站推廣。
首先點(diǎn)擊File,選擇Settings,在Project 下點(diǎn)擊Project Interpreter,并通過點(diǎn)擊右邊的加號:
搜索JPype,根據(jù)python版本選擇你需要的JPype版本安裝。
之后,在https://github.com/hankcs/HanLP/releases
網(wǎng)站下載hanlp.jar包、模型data包、配置文件hanlp.properties,新建一個(gè)文件夾Hanlp,
把hanlp.jar和hanlp.properties放進(jìn)去:
之后需要再新建一個(gè)文件夾hanlp,并將data放進(jìn)去:
修改Hanlp下的路徑為當(dāng)前data的路徑,由于我將data放在/home/javawork/hanlp下,因此:root=/home/javawork/hanlp/
接下來新建一個(gè)文件demo_hanlp.py,代碼如下:
#! /usr/bin/env python2.7
#coding=utf-8
from jpype import *
# startJVM(getDefaultJVMPath(), "-Djava.class.path=home/javawork/Hanlp/hanlp-1.2.7.jar;home/javawork/Hanlp/", "-Xms1g", "-Xmx1g")
startJVM(getDefaultJVMPath(), "-Djava.class.path=/home/qinghua/javawork/Hanlp/hanlp-1.2.7.jar:/home/qinghua/javawork/Hanlp")
HanLP = JClass('com.hankcs.hanlp.HanLP')
# 中文分詞
print(HanLP.segment('你好,歡迎在Python中調(diào)用HanLP的API'))
testCases = [
"商品和服務(wù)",
"結(jié)婚的和尚未結(jié)婚的確實(shí)在干擾分詞啊",
"買水果然后來世博園最后去世博會"]
for sentence in testCases: print(HanLP.segment(sentence))
# 命名實(shí)體識別與詞性標(biāo)注
NLPTokenizer = JClass('com.hankcs.hanlp.tokenizer.NLPTokenizer')
print(NLPTokenizer.segment('中國科學(xué)院計(jì)算技術(shù)研究所的宗成慶教授正在教授自然語言處理課程'))
# 關(guān)鍵詞提取
document = "水利部水資源司司長陳明忠9月29日在新聞辦舉行的新聞發(fā)布會上透露," \
"根據(jù)剛剛完成了水資源管理制度的考核,有部分省接近了紅線的指標(biāo)," \
"有部分省超過紅線的指標(biāo)。對一些超過紅線的地方,陳明忠表示,對一些取用水項(xiàng)目進(jìn)行區(qū)域的限批," \
"嚴(yán)格地進(jìn)行水資源論證和取水許可的批準(zhǔn)。"
print(HanLP.extractKeyword(document, 2))
# 自動摘要
print(HanLP.extractSummary(document, 3))
# 依存句法分析
print(HanLP.parseDependency("徐先生還具體幫助他確定了把畫雄鷹、松鼠和麻雀作為主攻目標(biāo)。"))
shutdownJVM()
需要注意的是ubuntu的路徑分割符為”:”,而window 為” ; ”
“怎么在ubuntu下使用pycharm調(diào)用Hanlp自然語言處理包”的內(nèi)容就介紹到這里了,感謝大家的閱讀。如果想了解更多行業(yè)相關(guān)的知識可以關(guān)注創(chuàng)新互聯(lián)網(wǎng)站,小編將為大家輸出更多高質(zhì)量的實(shí)用文章!