The AI arena is free today

Open Superagent

Translation en→Set1 COMET22

Paper

Progress Over Time

Interactive timeline showing model performance evolution on Translation en→Set1 COMET22

State-of-the-art frontier
Open
Proprietary

Translation en→Set1 COMET22 Leaderboard

3 models
ContextCostLicense
1
Amazon
Amazon
2
Amazon
Amazon
3
Notice missing or incorrect data?
About this benchmark

What is Translation en→Set1 COMET22?

COMET-22 is an ensemble machine translation evaluation metric combining a COMET estimator model trained with Direct Assessments and a multitask model that predicts sentence-level scores and word-level OK/BAD tags. It demonstrates improved correlations compared to state-of-the-art metrics and increased robustness to critical errors.

Translation en→Set1 COMET22 is a text benchmark evaluating models on language tasks. LLM Stats tracks 3 models on this benchmark, scored on a 0–1 scale. The current average is 0.9, with the leader at 0.9.

Compare leaders on the best AI for language leaderboards.

Current leaders

Nova Pro from Amazon currently leads the Translation en→Set1 COMET22 leaderboard with a score of 0.891 across 3 evaluated AI models.

1Nova ProAmazon89.1%
2Nova LiteAmazon88.8%
3Nova MicroAmazon88.5%

FAQ

Common questions about the Translation en→Set1 COMET22 benchmark and leaderboard.

What is the Translation en→Set1 COMET22 benchmark?

COMET-22 is an ensemble machine translation evaluation metric combining a COMET estimator model trained with Direct Assessments and a multitask model that predicts sentence-level scores and word-level OK/BAD tags. It demonstrates improved correlations compared to state-of-the-art metrics and increased robustness to critical errors.

What is the Translation en→Set1 COMET22 leaderboard?

The Translation en→Set1 COMET22 leaderboard ranks 3 AI models based on their performance on this benchmark. Currently, Nova Pro by Amazon leads with a score of 0.891. The average score across all models is 0.888.

What is the highest Translation en→Set1 COMET22 score?

The highest Translation en→Set1 COMET22 score is 0.891, achieved by Nova Pro from Amazon.

How many models are evaluated on Translation en→Set1 COMET22?

3 models have been evaluated on the Translation en→Set1 COMET22 benchmark, with 0 verified results and 3 self-reported results.

Where can I find the Translation en→Set1 COMET22 paper?

The Translation en→Set1 COMET22 paper is available at https://aclanthology.org/2022.wmt-1.52/. The paper details the methodology, dataset construction, and evaluation criteria.

What categories does Translation en→Set1 COMET22 cover?

Translation en→Set1 COMET22 is categorized under language. The benchmark evaluates text models with multilingual support.

How recent are the Translation en→Set1 COMET22 leaderboard results?

The Translation en→Set1 COMET22 leaderboard was last updated in August 2026 and currently includes 3 evaluated models.