O melhor jogador de xadrez da Coreia enfrenta a IA open source KataGo; no primeiro jogo, ele perde mesmo mantendo as duas pedras a mais

A Koreia Institucional de Go (Korea Baduk Association) realizou no dia 17 de julho uma competição de Go entre humanos e IA. O jogador申真諝, atualmente em 1º lugar no ranking mundial, apesar de receber vantagem de 2 casas, ainda foi superado pelo modelo de IA de código aberto KataGo após uma batalha de 245 lances. A competição adota o formato melhor de três (três partidas, duas vitórias), com mais duas rodadas em 19 e 21 de julho; os resultados ainda não foram divulgados.
(Contexto: torneio de xadrez com LLM chega ao fim: OpenAI o3 vence a disputa, xAI Grok 4 não conseguiu vencer nenhuma partida e foi varrido.)
(Complemento de contexto: Google afirmou que AGI já morreu, e o critério de ASI seria, curiosamente, de 1 bilhão de pessoas comuns.)

Sumário

Toggle

  • Vantagem de 2 casas, ainda assim não resistiu aos 103 lances
  • Quem escreveu esse programa
  • Dez anos: da equipe a uma placa de vídeo

Dez anos atrás, por trás do AlphaGo que derrotou Lee Sedol, havia uma equipe inteira da DeepMind. Mas dez anos depois, o que fez o jogador sul-coreano申真諝, em vantagem de 2 casas e ainda assim em derrota mesmo ocupando o 1º lugar do mundo, foi um programa de código aberto que qualquer pessoa consegue baixar gratuitamente, instalar e executar em uma placa de vídeo de consumo.

Vantagem de 2 casas, ainda assim não resistiu aos 103 lances

A competição foi organizada pela Korea Baduk Association e começou em 17 de julho, coincidindo com o 10º aniversário do confronto entre Lee Sedol e AlphaGo. Segundo a Yonhap News Agency, na primeira partida,申真諝 recebeu vantagem de 2 casas, jogou com as peças negras em primeiro, e ainda teve tempo de sobra; já o KataGo teve tempo sem limite, com apenas 20 segundos de leitura por lance. Esses ajustes de handicap e tempo foram, na verdade, vistos no circuito profissional como uma vantagem enorme, capaz de virar o resultado.

Na fase inicial, o KataGo saiu dos padrões de abertura, usando jogadas especiais para bagunçar o ritmo de preparação do申真諝. No meio do jogo,申真諝 chegou a segurar a vantagem do handicap por um tempo, deixando a partida travada; até que, no lance 103, o cenário virou. A resposta do KataGo acertou com precisão o ponto fraco da formação das peças negras, e a diferença foi aumentando gradualmente. Após 245 lances,申真諝 acabou desistindo e reconheceu a derrota.

Após a partida,申真諝 admitiu que a derrota se deve principalmente a fugir das expectativas no início, e ainda afirmou diretamente que os enxadristas/ jogadores humanos de topo têm dificuldade para vencer as melhores IAs de Go em confrontos diretos. Segundo o relato, a meta que ele definiu antes da competição era “conseguir duas vitórias”; depois, em entrevista, disse: “No segundo lance, com as brancas, eu entrei em pânico. Meu plano de preparação foi todo desfeito, e minha mentalidade também balançou.”

A reportagem descreve que, depois do jogo, ele ficou por muito tempo sentado diante do tabuleiro, com expressão de arrependimento. A análise pós-jogo feita pela mídia coreana aponta que a taxa de vitória começou a cair após os lances 70 e 76; no lance 90 ocorreu o erro decisivo, e, em cerca de 100 lances, a situação já tinha se invertido completamente. Nesta competição, o formato é melhor de três: em 19 e 21 de julho ainda haverá mais duas partidas, mas os resultados ainda não foram revelados.

Quem escreveu esse programa

De acordo com a página oficial do GitHub do KataGo, essa IA de Go foi lançada pela primeira vez em 2019 por David J. Wu, o desenvolvedor do nickname lightvector. Sua ocupação principal é trabalhar em uma empresa de trading quantitativo, Jane Street, e não uma equipe profissional em tempo integral de algum laboratório. Em outras palavras, treinar um conjunto de IA de Go capaz de desafiar jogadores humanos de elite já baixou a ponto de não exigir recursos de nível empresarial.

O KataGo usa o mesmo arcabouço de aprendizado por reforço com autojogo que o AlphaZero, mas fez grandes otimizações na eficiência do treinamento. Com hardware comum, em poucos dias ele chega ao nível de um jogador profissional; com apenas uma placa de vídeo avançada, em questão de meses ele ultrapassa patamares sobre-humanos. No momento, ele é amplamente considerado a IA de Go mais forte entre as que podem ser usadas abertamente, com desempenho superior ao ELF OpenGo e ao Leela Zero, que também alcançam nível sobre-humano. Sem ativar a função de busca, sua força equivale a um dos 100 melhores jogadores da Europa; e quando calcula 2048 iterações por lance, já supera qualquer jogador humano.

Dez anos: da equipe a uma placa de vídeo

Em março de 2016, o AlphaGo derrotou Lee Sedol por 4 a 1. Naquela época, Lee Sedol conquistou a última vitória humana sobre uma IA de Go de ponta graças ao “lance divino” da quarta partida, no lance 78; e, quando se aposentou em 2019, deixou a frase: “uma IA não pode ser vencida”.

Dez anos depois, quem derrotou o ser humano número 1 do mundo não precisou de um instituto de pesquisa inteiro por trás; foi um projeto de código aberto, além de uma placa de vídeo de consumo. Em 19 e 21 de julho ainda haverá duas rodadas, mas a verdadeira incógnita talvez já não esteja na pontuação.

Ver original
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado