You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Pandas中读取DataFrame的前10行样本数据?

Pandas读取文件时加载前N行测试数据的实现方法

你提到的sample参数并非pandas读取文件方法的原生参数,直接用以下内置参数即可实现仅加载前10行用于测试的需求:

  • 读取CSV格式文件:使用nrows参数指定读取行数
    df = pd.read_csv('path_to_my_csv/csv.csv', header=True, nrows=10)
    
    如果文件开头存在大量不需要的注释行,可搭配skiprows参数跳过指定行数后再读取前N行
  • 读取Parquet格式文件:同样使用nrows参数,主流的pyarrow和fastparquet引擎都原生支持该参数
    df = pd.read_parquet('path_to_my_parquet/csv.parquet', engine="pyarrow", nrows=10)
    

如果你需要的是随机抽取10行而非按顺序取前10行,才需要全量读取文件后调用df.sample(10)实现。如果仅用于验证字段格式、数据类型,用nrows参数无需加载全量数据,执行效率更高。

内容的提问来源于stack exchange,提问作者PicxyB

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.03 21:15:04