You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas按每行指定数量重复对应行出错,寻求解决方法

按指定数量重复DataFrame行的解决方案

你的代码问题出在第二个循环:每次都用整个原表的所有行重复i次,而且每次循环都会覆盖tabela_new变量,最终只会保留最后一次循环的结果——也就是用最后一行的重复次数重复整个表。

正确实现方法

不需要分两次循环,直接用每行对应的重复次数数组来处理就行,这里提供两种简洁的实现方式:

方法1:结合numpy的repeat函数

import pandas as pd
import numpy as np

# 获取每行对应的重复次数,转为整数数组
repeticoes = tabela['Quantidade Entrada'].astype(int).values
# 按指定次数重复每行,最后还原列名
tabela_new = pd.DataFrame(np.repeat(tabela.values, repeticoes, axis=0), columns=tabela.columns)

方法2:用pandas原生的repeat方法(更简洁)

# 生成重复后的索引,取出对应行,最后重置索引
tabela_new = tabela.loc[tabela.index.repeat(tabela['Quantidade Entrada'].astype(int))].reset_index(drop=True)

为什么原代码失效?

  • 第一个循环收集valorrepetir属于冗余操作,直接从Quantidade Entrada列提取即可
  • 第二个循环中,np.repeat(tabela.values, i, axis=0)是把整个原表重复i次,而非仅重复当前行;且每次循环都会覆盖tabela_new,前面的结果全部被丢弃,最终只保留最后一次循环的输出。

内容的提问来源于stack exchange,提问作者Shadow

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.25 00:13:20