硕士论文研究进展:用大语言模型自动评估译文质量时评估倾向的重要性研究



报告人崔香
报告时间2026-04-09
讨论组语法理论与语言工程
关键词机器翻译 译文质量评估 评估倾向性 大语言模型
摘要或简介

论文题目是:X领域中,评估倾向的重要性
➡️ 因为目前在X领域,评估倾向不重要(没有显性标出或受到关注,详情在2文献综述)
➡️ 因为X领域的评估范式默认:人类评分=标准答案=唯一真值 (偏差=噪声)
➡️ 提出疑问:译文质量存在客观真值吗?X领域是否忽略了一个重要前提,是在“什么评估倾向下”的质量评估?(1.3研究问题)
➡️ 设计实验证明“评估倾向”非常重要,给LLM定好评估倾向直接影响质量判断。(4实验设计)
➡️ 实验结果证明不同评估倾向会显著影响评估结果,这些分歧多出自原语言和目标语言中没有完全对标的句法、词汇、惯用表达。(5实验结果)
➡️ 提倡X领域以后先确立和标明“评估倾向”之后再做评估。(6结论与展望)

发布人zwd
发布范围讨论组内部
讨论记录

下载次数0
浏览次数22

 登录后可执行更多操作


© CCL of   Peking University  2019