微调T5模型用于拼写检查时输出异常的问题求助
微调T5模型用于拼写检查时输出异常的问题求助
我现在在处理评论数据集的拼写检查任务,用的是自己微调过的T5模型,但遇到了一个有点头疼的小问题:模型在处理部分评论时,要么输出的不是完整的字符串,要么会重复输入评论里的某些短语。这种情况虽然不算大面积出现,但确实存在不少这样的异常样本,对结果的准确性有一定影响。
补充下模型微调时的损失情况:训练损失为0.0003,验证损失为0.0002,两个损失都很低,本来以为模型效果会很稳定,没想到还是出现了上述输出异常的问题。
我已经把相关代码和2个出现异常的评论样本附在下方,希望有经验的朋友能帮忙分析下可能的原因,或者给点解决思路,非常感谢!
内容来源于stack exchange
相关产品推荐
相关产品推荐

