#29 · 主分类: 商业智能与分析

zeppelin

big-data database flink java javascript nosql scala spark zeppelin

基于Web的笔记本,支持数据驱动的交互式数据分析以及使用SQL、Scala等语言的协作文档。

项目最后更新:08/29/26

GitHub Stars

6.7K

Forks数量

2.8K

贡献者数量

605

许可证

Apache-2.0

收录理由

Apache Zeppelin 在大数据领域算得上是资格较老的项目之一,但它的设计理念至今依然实用。你可以在浏览器里把每次分析写成一段文字,然后给这段文字挂上一个解释器,比如 Spark、PySpark、JDBC 或者 Hive,这样一份文档里就能同时用 SQL 查询不同的数据库,旁边再放上 Scala 或 Spark 的代码。它真正的亮点在于解释器模型:一个环境可以对接多种后端,不用为了换数据源就重写分析逻辑,团队成员也能直接运行或修改同一段文字,省去了在脚本和邮件里来回传递 SQL 片段的麻烦。对于已经习惯 Spark/JVM 生态的分析师和工程师来说,如果你希望数据分析工作可复现、可共享,这个工具会很合适。另外,作为 Apache 项目,你可以下载二进制包或者从源码自行构建,完全自托管,不必依赖某个云端的笔记本服务。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目