#50 · 主分类: 自然语言处理与文本处理
scattertext
computational-social-science
d3
eda
exploratory-data-analysis
japanese-language
machine-learning
natural-language-processing
nlp
scatter-plot
semiotic-squares
sentiment
stylometric
stylometry
text-as-data
text-mining
text-visualization
topic-modeling
visualization
word-embeddings
word2vec
scattertext:美观地可视化不同文档类型中语言的差异。
项目最后更新:07/04/26
GitHub Stars
2.3K
Forks数量
286
贡献者数量
14
许可证
Apache-2.0
收录理由
研究者或分析师若想直观呈现两组文本在用语上的差异,这个工具相当实用。它能把语料库转成交互式HTML散点图,每个词按其对某一类文档的倾向程度定位,标签也会自动避让,不会互相遮挡。支持日文文本,也能配合spaCy等解析库使用,所以能嵌入现有的分析流程,而不只是停留在演示层面。最终产出一个自包含的HTML文件,用浏览器打开就能缩放、平移,无需搭建服务器。无论是拿产品评论对比客服工单,还是拿演讲稿对照新闻稿,它都能给出有说服力的可视化证据,远比静态词云可靠。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。