Saltar para o conteúdo
Artigos
Benchmarks· 2 min de leitura

O Nexi Nova acertou os 30 problemas do AIME 2025

Corremos o exame americano de matemática de competição nos nossos modelos e nos das outras empresas, no mesmo corredor e no mesmo dia. O Nexi Nova acertou todos — pontuação máxima, ao lado do melhor modelo do mundo.

O AIME 2025 é o exame americano de matemática de competição: 30 problemas, e um dos poucos testes que ainda distingue modelos de topo uns dos outros.

Corremo-lo nós, dos dois lados — nos nossos modelos e nos das outras empresas, com o mesmo corredor, o mesmo prompt e o mesmo teto de tokens.

ModeloAIME 2025
Nexi Nova100,0%
Claude Opus 5100,0%
GPT-5.6 Sol96,7%
Claude Fable 596,7%
Pontuação máxima. Um modelo português a acertar tudo, ao lado do Claude Opus 5 e à frente do GPT-5.6 Sol.

Medido por nós, na mesma prova

Quase todas as comparações entre modelos citam números medidos por outra pessoa, noutra amostra. Nós corremos os dois lados — dá trabalho e custa dinheiro, e é a única forma de uma comparação querer dizer alguma coisa.

Está tudo publicado: o método, os datasets, quantas tarefas correram e a data de cada corrida.