Estudo da plataforma AI QI, que monitora o nível de inteligência das ferramentas, mostra que o desempenho dos principais modelos de inteligência artificial do mercado já superam o QI médio da população humana.
O levantamento analisou 12 modelos: as norte-americanas de destaque, como OpenAI e Anthropic, e startups chinesas em ascensão, como DeepSeek e Moonshot.
A maior pontuação de QI entre os modelos analisados aparece em atividades de conhecimento acadêmico, com 140 pontos. Em seguida, vêm matemática (137), programação (135) e uso do computador (134). Já em outras habilidades, a vantagem é menor. A média fica em 119 pontos em confiabilidade e chega a 118 em raciocínio abstrato, a menor das seis áreas analisadas.
Todas os modelos analisados apareceram acima do patamar humano de QI. A maior pontuação foi do Claude Fable 5, da Anthropic, com 137 pontos, seguido do GPT-5.6 Sol, da OpenAI, com 136. O menor QI entre as IAs foi do DeepSeek V4 Pro, com 117 pontos.
A referência utilizada é a média humana de 100 pontos de QI. Já no caso das IAs, as ferramentas não chegaram a realizar um teste de inteligência. O estudo analisou resultados de provas técnicas realizadas pelas IAs e converteu o desempenho em uma estimativa de QI.