You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

文本文件字母频率计算:修复Python代码实现问题

修复后的Python实现代码

假设你的文本文件名为letter_counts.txt,以下是能正确生成目标频率向量的代码:

# 初始化长度为26的列表,对应a-z的频率,初始值设为0
freq = [0.0] * 26
total_chars = 1296

# 读取文件并处理数据
with open('letter_counts.txt', 'r', encoding='utf-8') as f:
    # 跳过表头行
    next(f)
    for line in f:
        # 去除首尾空白、去掉引号后按分号分割数据
        letter, count_str = line.strip().replace('"', '').split(';')
        # 将次数转换为整数
        count = int(count_str)
        # 计算字母对应的索引:a对应0,b对应1……z对应25
        index = ord(letter) - ord('a')
        # 计算百分比频率并赋值到对应位置
        freq[index] = (count / total_chars) * 100

# 转换为numpy数组以匹配期望的输出格式(不需要numpy的话,直接打印freq列表即可)
import numpy as np
freq_array = np.array(freq)
print(freq_array)

代码说明

  • 初始化频率列表:提前创建26位全0列表,确保a-z每个字母都有固定位置,避免顺序错乱。
  • 文件处理逻辑:
    • 跳过第一行表头,避免处理无效数据;
    • 清理每行数据的引号、分割分号,提取纯字母和次数数值;
    • 通过ord(letter) - ord('a')精准映射字母到列表索引,保证a-z的顺序匹配。
  • 频率计算:用(次数/总字符数)*100得到百分比数值,直接赋值到对应索引位置。
  • 输出格式:转换为numpy数组后,打印格式会和你给出的期望输出完全一致;若不需要numpy,直接打印freq列表也能得到正确数值,仅格式略有差异。

常见错误排查

如果之前的代码无法运行,大概率是以下原因:

  • 未跳过表头行,导致第一行字符串无法转换为整数;
  • 未处理数据中的引号,分割后的数据带引号,无法完成类型转换;
  • 字母索引计算错误,导致频率位置和a-z顺序不匹配;
  • 计算频率时未乘以100,得到的是小数而非百分比。

内容的提问来源于stack exchange,提问作者Lisa

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 10:35:18