You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Zeppelin如何读取多源数据并合并后在UI端展示为图表或表格

Zeppelin多数据源合并操作指南

完全可以实现该需求,你提供的Python解释器默认配置已经能够支撑多数据源拉取、合并、展示全流程,具体操作步骤如下:

  • 第一步:分别拉取不同数据源的数据存入Zeppelin共享上下文
    分别在两个独立的笔记段落使用对应的JDBC解释器执行查询,通过Zeppelin内置的z对象将查询结果存入全局共享上下文,示例代码如下:

    %jdbc1
    -- 拉取用户基础信息,存入变量user_base
    z.put("user_base", z.getDatasetFromSql("SELECT user_id, user_name, phone FROM user_base_table"))
    
    %jdbc2
    -- 拉取用户扩展信息,存入变量user_extra
    z.put("user_extra", z.getDatasetFromSql("SELECT user_id, account_level, register_time FROM user_extra_table"))
    
  • 第二步:使用Python解释器合并数据
    新建笔记段落使用%python解释器,读取上下文中的两个数据集,通过pandas的merge方法关联合并,直接输出即可自动渲染为交互表格,也可调用绘图API生成可视化图表:

    %python
    import pandas as pd
    
    # 读取上下文存储的两个数据集
    df_base = z.get("user_base")
    df_extra = z.get("user_extra")
    
    # 按user_id字段合并,关联规则(内连接、左连接等)可按需调整
    df_merged = pd.merge(df_base, df_extra, on="user_id", how="inner")
    
    # 输出合并结果,Zeppelin会自动渲染为可交互表格
    df_merged
    
  • 补充说明

    • 如果你更习惯用SQL处理合并后的数据,可以使用配置中已内置的%python.sql解释器,直接对df_merged执行SQL查询操作
    • 现有配置中zeppelin.python.maxResult默认限制最大输出1000行,若合并后数据行数超过该值,可按需调大该参数的数值
    • 合并后的结果支持直接使用Zeppelin内置的图表组件进行可视化,无需导出到其他工具处理

内容的提问来源于stack exchange,提问作者scoder

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.05 20:00:04