工业级开源 NLP 库,高性能分词、词性、依存句法与实体识别,支持中文。
Project story
spaCy 是工业级 NLP 处理库:分词、词性标注、依存句法、命名实体识别(NER)、文本分类等能力开箱即用,速度快、占用低,配合训练 API 可快速构建领域模型。
提供高质量多语言模型(含中文),支持自定义管道与 Transformer 集成,是文本预处理的常用基础设施。
适合场景:文本清洗与结构化、实体抽取、信息提取、NLP 产品后端。
上手方式:pip install spacy,下载语言模型后 nlp(text) 即可得到结构化结果。