You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python Pandas CSV关键词匹配填充列问题求助(初学者)

问题描述

我是Python初学者,正在用Pandas处理CSV数据,现在操作两个文件:

  • Extract.csv:工作文件,需要填充Accounts、Contact Name、Notes列
  • Masterlist.csv:字典文件,用Keywords列的内容匹配Extract.csv的Description列,匹配成功后把对应行的Accounts、Vendor Name、Notes值填充到工作文件中

我尝试了两段代码,但运行后填充内容为空:

第一段代码:

file2 = open('Masterlist.csv','r')
data2 = pd.read_csv(file2)
df2 = pd.DataFrame(data2)
content=()
for rows in range(len(content)):
          if df2['Keywords'].isin(df['Description']):
              df['Accounts'] = df2['Accounts']
              df['Contact Name'] = df2['Vendor Name']
              df['Notes'] = df2['Notes']
              print()

第二段代码:

file2= open('Masterlist.csv','r')
data2= pd.read_csv(file2, usecols= ['Keyterms','Accounts','Vendor Name'])
df2= pd.DataFrame(data2)
content=()
for rows in range(len(content)):
          if df[Description'].str.contains(content[df2['Keywords']]):
              df['Accounts'] = content[(df2['Accounts'])]
              df['Contact Name'] = content[(df2['Vendor Name'])]
              df['Notes'] = content[(df2['Notes'])]
              print()
问题分析

你的代码没生效主要有几个核心问题:

  1. 循环根本没执行:content=()是空元组,len(content)为0,range(len(content))不会生成任何循环次数,后续赋值代码完全没运行。
  2. 匹配逻辑错误:
    • 第一段代码里df2['Keywords'].isin(df['Description'])是检查Masterlist的关键词是否等于Extract的Description列完整字符串,而非Description包含关键词,逻辑完全颠倒。
    • 就算条件满足,直接把df2的列赋值给df的列,会把整列覆盖成同一个值,不是逐行匹配对应结果。
  3. 语法与索引错误:第二段代码里df[Description']少了左引号,且content[df2['Keywords']]写法完全错误,空元组无法这样索引。
解决方案

用Pandas的apply函数实现逐行匹配,逻辑清晰且符合需求:

import pandas as pd

# 直接读取CSV文件,Pandas自动处理文件IO,无需手动open
df = pd.read_csv('Extract.csv')
df_master = pd.read_csv('Masterlist.csv')

def fill_matched_fields(row):
    # 遍历Masterlist每一行,检查关键词是否在当前Description中
    for _, master_row in df_master.iterrows():
        # 转成字符串避免类型报错
        if str(master_row['Keywords']) in str(row['Description']):
            # 返回匹配到的对应字段值
            return pd.Series([master_row['Accounts'], master_row['Vendor Name'], master_row['Notes']])
    # 无匹配时返回空值
    return pd.Series([None, None, None])

# 应用函数到df每一行,填充目标列
df[['Accounts', 'Contact Name', 'Notes']] = df.apply(fill_matched_fields, axis=1)

# 保存更新后的文件(避免覆盖原文件)
df.to_csv('Updated_Extract.csv', index=False)

代码说明:

  • 用pd.read_csv直接读取文件,省去手动打开/关闭步骤,简洁安全。
  • fill_matched_fields函数接收Extract.csv的每一行,遍历Masterlist.csv所有关键词,检查是否包含在当前行的Description中。
  • 匹配成功返回对应字段值,否则返回空值。
  • 用apply函数将逻辑应用到每一行,自动填充对应列。

内容的提问来源于stack exchange,提问作者ATD

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.25 10:35:04