You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

无法pip安装pysphinx,求语音转文字代码运行解决方案

无法安装pysphinx的解决及替代方案

pysphinx的状态

  • pysphinx已从PyPI移除,没有公开可用的安装版本,属于已停止维护的项目,无法通过pip安装。

替代实现:使用pocketsphinx完成语音转文字

你已安装pocketsphinx,可直接用它替代原有逻辑,适配你需求的代码如下:

# 确保pocketsphinx安装完成
!pip install pocketsphinx

import pocketsphinx
from pocketsphinx import AudioFile

# 配置法语识别模型
config = pocketsphinx.Decoder.default_config()
# 指定法语声学模型、语言模型和字典
config.set_string('-hmm', 'fr-fr')
config.set_string('-lm', 'fr-fr.lm.bin')
config.set_string('-dict', 'fr-fr.dic')

# 初始化识别器
recognizer = pocketsphinx.Decoder(config)

# 定义音频文件路径
audio_file = output_path

# 转录音频内容
transcribed_text = ""
with open(audio_file, 'rb') as audio:
    recognizer.start_utt()
    chunk = audio.read(1024)
    while chunk:
        recognizer.process_raw(chunk, False, False)
        chunk = audio.read(1024)
    recognizer.end_utt()
    transcribed_text = recognizer.hyp().hypstr

# 输出并保存转录结果
print(transcribed_text)
with open('transcription.txt', 'w') as f:
    f.write(transcribed_text)

注意事项

  • 确保音频文件为16kHz采样率、单声道、16位深度的WAV格式,这是pocketsphinx支持的标准输入格式。
  • 首次运行时,pocketsphinx会自动下载法语模型文件,若下载缓慢可手动下载模型并指定本地路径。

内容的提问来源于stack exchange,提问作者Julien

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.07 04:46:11