石家庄网站制作报价,免费的网站认证,校园网站首页模板,做移动网站优化快速排名软件spacy 简介
spacy 是 Python 自然语言处理软件包#xff0c;可以对自然语言文本做词性分析、命名实体识别、依赖关系刻画#xff0c;以及词嵌入向量的计算和可视化等。
1.安装 spacy
使用 “pip install spacy 报错#xff0c; 或者安装完 spacy#xff0c;无法正…spacy 简介
spacy 是 Python 自然语言处理软件包可以对自然语言文本做词性分析、命名实体识别、依赖关系刻画以及词嵌入向量的计算和可视化等。
1.安装 spacy
使用 “pip install spacy 报错 或者安装完 spacy无法正常调用可以通过以下链接将 whl 文件下载到本地然后 cd 到文件路径下通过 pip 安装。
pip install spacy下载链接
Archived: Python Extension Packages for Windows - Christoph Gohlke (uci.edu)
选择对应的版本 2. 语言库安装
2.1 zh_core_web_sm
2.1英文 python -m spacy download en_core_web_sm
2.2中文 python -m spacy download zh_core_web_sm可以手动下载包再安装
下载地址 https://github.com/explosion/spacy-models/releases/download/zh_core_web_sm-3.7.0/zh_core_web_sm-3.7.0-py3-none-any.whl
下载好之后执行命令pip install zh_core_web_sm-3.7.0-py3-none-any.whl通过下方链接下载 whl 文件到本地
zh_core_web_sm · Releases · explosion/spacy-models (github.com)
选择对应的版本 下载好对应版本的 zh_core_web_sm.whl 文件cd 文件保存目录然后通过 pip 安装。
pip install spacy
python -m spacy download zh_core_web_sm安装成功提示 2.2 安装 en_core_web_sm
通过下方链接下载 whl 文件到本地
en_core_web_sm · Releases · explosion/spacy-models (github.com)
选择对应的版本 下载好对应版本的 zh_core_web_sm.whl 文件cd 文件保存目录然后通过 pip 安装。
3.效果测试
3.1 英文测试
# 导入英文类
from spacy.lang.en import English
# 实例化一个nlp类对象包含管道pipeline
nlp English()
# print(nlp)
doc nlp(December is excited!)
# 迭代tokens
for token in doc:print(token.text)token doc[1]
print(token.text)输出结果
December
is
excited
!
is3.2 中文测试
# 处理文本
nlp spacy.load(zh_core_web_sm)
doc nlp(英伟达准备用20亿美金买下这家法国的创业公司。)# 遍历识别出的实体
for ent in doc.ents:# 打印实体文本及其标注print(ent.text, ent.label_)输出结果
英伟达 ORG
20亿美金 MONEY
法国 NORP