如何制作支持词形变化的离线可用Kindle自定义词典
可行的Kindle自定义词典制作方案
方案1:复用现有XHTML成果,快速生成合规EPUB
- 第一步:用Python脚本拆分已有的23MB XHTML文件,按单词条目拆分,每个输出文件控制在200~250KB,避免阅读器解析异常,拆分逻辑只需要按你写的条目标签(比如每个词条用
<div class="entry">包裹的话直接匹配拆分即可,不会破坏原有标记) - 第二步:使用Python
ebooklib库生成EPUB,该库可保留所有自定义HTML标签,不会像Pandoc一样剔除专用标记:- 安装命令:
pip install ebooklib - 代码逻辑中只需要按顺序导入拆分后的XHTML片段,补充符合Kindle词典规范的元数据(需添加
<dc:type>dictionary</dc:Type>、词条索引规则两类核心标记)、生成NCX目录文件,几秒即可输出完整EPUB
- 安装命令:
- 第三步:将输出的EPUB放入Kindle Previewer导出MOBI即可
方案2:跳过XHTML编写环节,用词典专用工具链直接转换
- 你可以先将已有的单词+词形变化数据导出为通用词典格式(比如StarDict、CSV),再使用
pyglossary工具完成格式转换,该工具原生支持Kindle词典生成,自带词形变化适配逻辑:- 安装命令:
pip install pyglossary - 转换时指定输入为你的词典数据、输出为Kindle兼容EPUB格式,工具会自动完成词条分片、添加Kindle专用标记、嵌入词形变化索引所有流程,无需人工干预
- 生成的EPUB可直接通过Kindle Previewer导出最终可用的MOBI词典
- 安装命令:
方案3:直接生成MOBI,省略EPUB中间环节
- 下载官方命令行工具KindleGen,你只要准备好拆分后的XHTML文件、对应的OPF配置文件(标注词典元数据、文件列表、索引规则),直接运行命令
kindlegen your_config.opf即可一步生成最终MOBI文件,不需要经过EPUB转换、也不需要打开Kindle Previewer操作
避坑提示
- 废弃Mobipocket Creator相关流程,该工具已停止维护多年,生成的PRC格式无法被新版Kindle系统和Previewer识别
- 若生成的文件导入设备后不被识别为词典,优先检查配置文件中是否正确标注了词典类型、源语言/目标语言代码是否和你Kindle设备的语言设置匹配
- 词形变化数据需要对应写入词典的索引字段,不要只放在词条正文内,否则Kindle查询时无法匹配变形词
内容的提问来源于stack exchange,提问作者Pux
相关产品推荐
相关产品推荐

