#55 · 主分类: 商业智能与分析

sweetviz

data-analysis data-exploration data-profiling data-science data-visualization eda exploration exploratory-data-analysis machine-learning pandas pandas-dataframe python statistics

用一行代码可视化和比较数据集、目标值及关联性。

项目最后更新:04/11/26

GitHub Stars

3.1K

Forks数量

289

贡献者数量

13

许可证

MIT

收录理由

Sweetviz 把探索性数据分析压缩成了两行代码,很适合在建模前快速摸清数据的底细。它能读取 pandas 的 DataFrame,生成一份自包含的 HTML 报告,里面涵盖缺失值、分布情况以及特征之间的相关性。真正出彩的地方在于对比能力:你可以指定一个目标列,看看每个特征与它的关联;也可以把训练集和测试集并排放置,提前发现数据泄露或分布偏移,免得事后返工。报告是单个便携文件,随手就能贴到 PR 里或发给同事,作为数据质量判断的依据,完全不需要搭建仪表盘。对日常处理表格型数据的 Python 用户来说,这是一种轻量、省事、能快速启动分析的工具。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目