首页|期刊导航|华东师范大学学报(自然科学版)|基于语言相似度的低资源机器翻译迁移学习框架

基于语言相似度的低资源机器翻译迁移学习框架OA

中文摘要

在模型训练资源极其有限的情境下,基于深度学习的机器翻译模型往往不能达到理想的效果.现有的利用相似语言进行迁移学习的方法,都是凭借直觉选择相似数据进行简单的预训练,可能无法选择出最相似的语言或最大化发挥出预训练的优势.针对以上问题,提出了一种基于语言相似度的低资源机器翻译迁移学习框架.该框架选择了5种低资源语言到英语的翻译任务,在实验中选择了6种高资源语言用于迁移,使用模型在这些高资源语言到英语的机器翻译数据集上进行预训练,然后利用语言相似度指标选择与目标最相似的语言的翻译模型进行迁移,最终通过改进微调策略进一步提升模型效果.实验结果表明,基于该训练框架的模型相较于基线模型有更好的效果,为低资源机器翻译任务提供了一种可行高效且泛用的解决方向.

殷炜;俞黎阳

华东师范大学计算机科学与技术学院,上海200062华东师范大学计算机科学与技术学院,上海200062

信息技术与安全科学

机器翻译迁移学习语言相似度低资源

《华东师范大学学报(自然科学版)》 2026 (4)

P.134-142,9

10.3969/j.issn.1000-5641.2026.04.014

评论