CHARM: Calibrating Reward Models With Chatbot Arena Scores Paper • 2504.10045 • Published Apr 14, 2025
XL-Instruct: Synthetic Data for Cross-Lingual Open-Ended Generation Paper • 2503.22973 • Published Mar 29, 2025
DocHPLT: A Massively Multilingual Document-Level Translation Dataset Paper • 2508.13079 • Published Aug 18, 2025 • 1
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization Paper • 2510.05962 • Published Oct 7, 2025
HPLT 3.0: Very Large-Scale Multilingual Resources for LLM and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models Paper • 2511.01066 • Published Nov 2, 2025 • 3
Reinforcement Learning Elicits Contextual Learning of Unseen Language Translation Paper • 2606.06428 • Published Jun 4 • 25
An Expanded Massive Multilingual Dataset for High-Performance Language Technologies Paper • 2503.10267 • Published Mar 13, 2025 • 3
EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models Paper • 2409.17892 • Published Sep 26, 2024 • 2
The Highs and Lows of Simple Lexical Domain Adaptation Approaches for Neural Machine Translation Paper • 2101.00421 • Published Jan 2, 2021
To Adapt or to Fine-tune: A Case Study on Abstractive Summarization Paper • 2208.14559 • Published Aug 30, 2022
A Unified Model for Reverse Dictionary and Definition Modelling Paper • 2205.04602 • Published May 9, 2022
Approaching Neural Chinese Word Segmentation as a Low-Resource Machine Translation Task Paper • 2008.05348 • Published Aug 12, 2020
The University of Edinburgh's Submission to the WMT22 Code-Mixing Shared Task (MixMT) Paper • 2210.11309 • Published Oct 20, 2022
EEE-QA: Exploring Effective and Efficient Question-Answer Representations Paper • 2403.02176 • Published Mar 4, 2024
UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through Debiasing Paper • 2404.01253 • Published Apr 1, 2024
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice? Paper • 2404.14122 • Published Apr 22, 2024
Iterative Translation Refinement with Large Language Models Paper • 2306.03856 • Published Jun 6, 2023
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca Paper • 2309.08958 • Published Sep 16, 2023 • 2
PMIndiaSum: Multilingual and Cross-lingual Headline Summarization for Languages in India Paper • 2305.08828 • Published May 15, 2023