如何从DataFrame检索单词对应的所有文本?批量获取方法咨询
解决方案
可以通过Pandas的groupby方法批量处理所有单词,无需逐个指定,具体实现如下:
首先构造对应DataFrame:
import pandas as pd data = { 'word': ['a', 'a', 'a', 'b', 'b', 'c', 'c', 'c', 'd', 'e', 'e', 'f', 'g', 'h', 'i'], 'text': [1, 2, 5, 1, 3, 1, 3, 4, 4, 2, 4, 3, 2, 5, 5] } df = pd.DataFrame(data)
然后分组并按要求格式输出:
# 按word字段分组 grouped = df.groupby('word') # 遍历所有分组并打印指定格式内容 for word, group in grouped: print(word) # 将当前单词对应的text值转为空格分隔的字符串,添加[1]前缀 text_output = f"[1] {' '.join(map(str, group['text'].tolist()))}" print(text_output)
运行后会输出:
a [1] 1 2 5 b [1] 1 3 c [1] 1 3 4 d [1] 4 e [1] 2 4 f [1] 3 g [1] 2 h [1] 5 i [1] 5
该方法会自动遍历所有唯一单词,批量生成目标格式的输出,完全不需要手动逐个输入单词。
内容的提问来源于stack exchange,提问作者user21390049
相关产品推荐
相关产品推荐

