O modelo o3 da OpenAI derrotou o modelo Grok 4 da xAI por 4 a 0 na final do torneio de xadrez Kaggle AI Exhibition, segundo o The Independent. Outros modelos de IA competindo incluíram Anthropic, DeepSeek, Google e Moonshot AI. O confronto final assumiu um significado especial devido à relação extremamente tensa entre os cofundadores da OpenAI, Sam Altman, e Elon Musk, que tentou adquirir a empresa após deixar a OpenAI.

Fonte da imagem: Steve Johnson/Unsplash

Na rodada final do torneio, o o3 demonstrou um jogo impecável, vencendo todas as quatro partidas contra o Grok 4. Ambos os sistemas avançaram para a rodada final após derrotar seus concorrentes nas rodadas anteriores. Em resposta à derrota do Grok 4 no xadrez, Musk afirmou que a jogabilidade do modelo era um “efeito adicional” e não uma prioridade em seu desenvolvimento.

A capacidade dos computadores de derrotar os melhores enxadristas do mundo é conhecida desde 1997, quando o supercomputador Deep Blue, da IBM, derrotou Garry Kasparov. Posteriormente, o Google DeepMind criou um modelo de IA capaz de aprender a jogar xadrez e Go por conta própria. Mas o novo torneio foi a primeira grande competição a testar modelos de grandes linguagens (LLMs) como o ChatGPT.

O CEO e cofundador da Take Take Take, Mats André Kristiansen, observou que, embora a partida de Kasparov contra o Deep Blue tenha sido um grande evento na década de 1990, o principal valor do torneio atual está em explorar como os modelos modernos de IA raciocinam e tomam decisões.

Curiosamente, em julho, o atual campeão mundial de xadrez, Magnus Carlsen, derrotou o ChatGPT em uma partida online sem perder uma única peça. Comentando sobre a final entre Grok e o3, Carlsen estimou o rating de Grok em cerca de 800, e o de o3 em 1200. Para efeito de comparação, seu próprio rating máximo é 2882. Em resposta a uma pergunta do usuário X, o próprio Grok estimou seu nível entre 1600 e 1800.

admin

Postagens recentes

A missão lunar Artemis II chegou ao fim com o retorno da espaçonave Orion, que transportava astronautas, à Terra.

A espaçonave Orion da NASA, que orbitou a Lua como parte da missão Artemis II,…

4 horas atrás

A Tesla lançou uma ofensiva contra dispositivos “falsificados” que permitem aos usuários ativar o Autopilot em países onde ele não é oferecido oficialmente.

Historicamente, a Tesla desenvolveu e aprimorou suas tecnologias proprietárias de assistência ativa ao motorista usando…

4 horas atrás

Um suspeito da tentativa de incêndio criminoso na casa do CEO da OpenAI, Sam Altman, foi preso nos EUA.

A exposição pública dos executivos de grandes empresas de tecnologia os torna tão vulneráveis ​​quanto…

5 horas atrás

A Meta não conseguiu se defender de mais um processo judicial relacionado ao vício de adolescentes em redes sociais.

Hoje, a Suprema Corte de Massachusetts decidiu que a plataforma de mídia social Instagram foi…

6 horas atrás

A Qualcomm não tem certeza da capacidade da Samsung de produzir chips de 2nm com a qualidade exigida.

A empresa americana Qualcomm é conhecida por sua abordagem eclética na seleção de fornecedores para…

6 horas atrás