#55 · 主分类: 商业智能与分析
sweetviz
data-analysis
data-exploration
data-profiling
data-science
data-visualization
eda
exploration
exploratory-data-analysis
machine-learning
pandas
pandas-dataframe
python
statistics
用一行代码可视化和比较数据集、目标值及关联性。
项目最后更新:04/11/26
GitHub Stars
3.1K
Forks数量
289
贡献者数量
13
许可证
MIT
收录理由
Sweetviz 把探索性数据分析压缩成了两行代码,很适合在建模前快速摸清数据的底细。它能读取 pandas 的 DataFrame,生成一份自包含的 HTML 报告,里面涵盖缺失值、分布情况以及特征之间的相关性。真正出彩的地方在于对比能力:你可以指定一个目标列,看看每个特征与它的关联;也可以把训练集和测试集并排放置,提前发现数据泄露或分布偏移,免得事后返工。报告是单个便携文件,随手就能贴到 PR 里或发给同事,作为数据质量判断的依据,完全不需要搭建仪表盘。对日常处理表格型数据的 Python 用户来说,这是一种轻量、省事、能快速启动分析的工具。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。