O Nexi Nova acertou os 30 problemas do AIME 2025
Corremos o exame americano de matemática de competição nos nossos modelos e nos das outras empresas, no mesmo corredor e no mesmo dia. O Nexi Nova acertou todos — pontuação máxima, ao lado do melhor modelo do mundo.
O AIME 2025 é o exame americano de matemática de competição: 30 problemas, e um dos poucos testes que ainda distingue modelos de topo uns dos outros.
Corremo-lo nós, dos dois lados — nos nossos modelos e nos das outras empresas, com o mesmo corredor, o mesmo prompt e o mesmo teto de tokens.
| Modelo | AIME 2025 |
|---|---|
| Nexi Nova | 100,0% |
| Claude Opus 5 | 100,0% |
| GPT-5.6 Sol | 96,7% |
| Claude Fable 5 | 96,7% |
Pontuação máxima. Um modelo português a acertar tudo, ao lado do Claude Opus 5 e à frente do GPT-5.6 Sol.
Medido por nós, na mesma prova
Quase todas as comparações entre modelos citam números medidos por outra pessoa, noutra amostra. Nós corremos os dois lados — dá trabalho e custa dinheiro, e é a única forma de uma comparação querer dizer alguma coisa.
Está tudo publicado: o método, os datasets, quantas tarefas correram e a data de cada corrida.