PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning2026年5月8日·Yunzhi Shen,Hao Zhou,Xin Huang,Xue Han,Junlan FengShujian Huang· 0 分钟阅读时长 引用 URL类型会议文章出版物Findings of the Association for Computational Linguistics: ACL 2026最近更新于 2026年5月8日← How Do Answer Tokens Read Reasoning Traces? Self-Reading Patterns in Thinking LLMs for Quantitative Reasoning 2026年5月8日Reasoning While Asking: Transforming Reasoning Large Language Models from Passive Solvers to Proactive Inquirers 2026年5月8日 →