Databricks notebook中print结果被截断 如何完整展示df.schema.json()输出
解决PySpark DataFrame schema JSON输出截断问题
以下是不同运行场景下的完整输出方案:
- 普通Python脚本运行场景
直接将完整JSON内容写入本地文件,规避控制台输出长度限制:full_schema = df.schema.json() with open("dataframe_schema.json", "w", encoding="utf-8") as f: f.write(full_schema) - Jupyter Notebook/IPython交互式环境场景
可选用以下任意一种方法绕过默认输出截断:- 渲染为HTML展示完整内容
from IPython.display import display, HTML display(HTML(f"<pre>{df.schema.json()}</pre>"))- 结构化格式化输出
import json import pprint schema_dict = json.loads(df.schema.json()) # width参数可自定义调整,放宽每行字符限制 pprint.pprint(schema_dict, width=300) - Databricks运行场景
使用平台内置方法展示完整内容:full_schema = df.schema.json() displayHTML(f"<pre>{full_schema}</pre>")
内容的提问来源于stack exchange,提问作者Sean Fu
相关产品推荐
相关产品推荐

