O modelo o3 da OpenAI derrotou o modelo Grok 4 da xAI por 4 a 0 na final do torneio de xadrez Kaggle AI Exhibition, segundo o The Independent. Outros modelos de IA competindo incluíram Anthropic, DeepSeek, Google e Moonshot AI. O confronto final assumiu um significado especial devido à relação extremamente tensa entre os cofundadores da OpenAI, Sam Altman, e Elon Musk, que tentou adquirir a empresa após deixar a OpenAI.

Fonte da imagem: Steve Johnson/Unsplash

Na rodada final do torneio, o o3 demonstrou um jogo impecável, vencendo todas as quatro partidas contra o Grok 4. Ambos os sistemas avançaram para a rodada final após derrotar seus concorrentes nas rodadas anteriores. Em resposta à derrota do Grok 4 no xadrez, Musk afirmou que a jogabilidade do modelo era um “efeito adicional” e não uma prioridade em seu desenvolvimento.

A capacidade dos computadores de derrotar os melhores enxadristas do mundo é conhecida desde 1997, quando o supercomputador Deep Blue, da IBM, derrotou Garry Kasparov. Posteriormente, o Google DeepMind criou um modelo de IA capaz de aprender a jogar xadrez e Go por conta própria. Mas o novo torneio foi a primeira grande competição a testar modelos de grandes linguagens (LLMs) como o ChatGPT.

O CEO e cofundador da Take Take Take, Mats André Kristiansen, observou que, embora a partida de Kasparov contra o Deep Blue tenha sido um grande evento na década de 1990, o principal valor do torneio atual está em explorar como os modelos modernos de IA raciocinam e tomam decisões.

Curiosamente, em julho, o atual campeão mundial de xadrez, Magnus Carlsen, derrotou o ChatGPT em uma partida online sem perder uma única peça. Comentando sobre a final entre Grok e o3, Carlsen estimou o rating de Grok em cerca de 800, e o de o3 em 1200. Para efeito de comparação, seu próprio rating máximo é 2882. Em resposta a uma pergunta do usuário X, o próprio Grok estimou seu nível entre 1600 e 1800.

admin

Postagens recentes

O CEO da Ferrari explica a popularidade das telas sensíveis ao toque nos carros: elas custam metade do preço dos botões.

O CEO da Ferrari, Benedetto Vigna, concedeu recentemente uma longa entrevista à publicação britânica Autocar.…

1 hora atrás

A Arctic apresentou o Senza AI 370, um PC para instalação sob a mesa — e ele também é silencioso.

A Arctic apresentou o Senza AI 370, um computador de mesa sem ventoinhas que se…

1 hora atrás

Um novo trailer confirma a data de lançamento e o preço de Vampire Crawlers, o frenético jogo de cartas derivado de Vampire Survivors.

A desenvolvedora londrina poncle anunciou a data de lançamento e o preço de seu roguelike…

2 horas atrás

O gerador de imagens com IA do Adobe Firefly agora pode ser treinado com seus próprios trabalhos.

A Adobe anunciou o lançamento de geradores de imagens com IA personalizáveis ​​que podem imitar…

2 horas atrás