Testei 40 LLMs na "Caça a Bugs de Código" (Novo Benchmark!)
Quarenta LLMs enfrentam a Caça a Bugs de Código, revelando quem realmente domina a arte de encontrar falhas em programação.
Benchmark
Tecnologia
AI
OpenAI
Conteudo
Iniciando...
Tempo restante: 120s
Não foi possível completar a operação
Relacionados
Buscando itens relacionados...