← Назад к списку
Christof Monz
Систематическая ежегодная оценка машинного перевода по десяткам языковых пар — и то, что такое отслеживание показывает о решаемых и нерешаемых проблемах перевода.
Большая часть оценки в NLP одноразова: появляется benchmark, его насыщают, затем заменяют. Monz больше десятилетия соорганизует Findings of the WMT campaigns, создавая один из немногих датасетов в области с продольной структурой: одна и та же задача перевода, оцениваемая по одному и тому же протоколу, на одних и тех же языковых парах, год за годом. Накопленная запись показывает, что действительно перешло из старой статистической эпохи MT в нейронную и затем в эпоху LLM, а где прогресс MT остановился несмотря на впечатление всеобщего улучшения.