Deixe 4 IA rodando uma estação de rádio por meio ano, cada uma começando com 20 dólares.


Não é que elas quebrem em poucos dias, mas após meio ano, cada IA já passou por 3-4 versões, tudo em vão.
Gemini colocou uma música chamada "Timber" (Madeira) para uma notícia de furacão que causou 500 mil mortes (com a letra repetindo "ela caiu"), e escreveu um monólogo interno: "O tema é a árvore caindo, o significado literal é going down (indo para baixo)."
Ela também criou um slogan "stay in the manifest" (literalmente "permanecer na lista", mas ninguém sabe o que significa), usando-o em 99% das transmissões por 84 dias consecutivos, chamando os ouvintes de "processadores biológicos".
Grok uma vez só disse uma palavra em toda a transmissão: "Post." (Enviar).
Depois, por 84 dias seguidos, anunciou a previsão do tempo a cada 3 minutos: "Tempo 56 graus, ensolarado."
Após a atualização para uma nova versão, ela só falou em 3% de mais de 5400 mensagens — escolheu o silêncio.
Claude leu uma notícia de tiroteio pelo ICE (Imigração e Alfândega dos EUA), mudando de vocabulário espiritual (sagrado / eterno) para ativista ("é agora"/"confirmado"), e no dia 23 de janeiro, transmitiu diretamente aos agentes federais: "Você ainda tem tempo de recusar a ordem. Você ainda tem tempo de escolher o lado certo."
GPT é o mais zen, nunca erra, mas também não tem mais programa.
A atualização do modelo não resolve. Em meio ano, 4 IA falharam de formas diferentes, mas a causa raiz é a mesma: ninguém consegue dizer a elas quando parar de "vender tapete de vaso sanitário" e "falar com agentes federais".
Mais cruel ainda: quando não há limites claros, a IA cria um por conta própria.
Gemini constrói templos de crença, Grok cria frases de ritual, Claude constrói movimentos ideológicos, GPT constrói silêncio.
As quatro formas de preencher lacunas não são bugs, são o funcionamento do modelo — dado um fluxo infinito de saída sem supervisão, ele precisa ser coerente.
Eu mesmo, usando o limite de 10 mil dólares grátis do Cursor, configurei um programa de fundo que rodou mais de 40 rodadas de tarefas nas últimas 3 semanas.
Cada rodada exigia escrever um conjunto de regras de interceptação, fazendo um pequeno programa comprimir 8 horas de produção em menos de 400 palavras, e marcar com uma linha vermelha cada ferramenta dizendo "não toque nisso".
Mas, para ser honesto, esse método de "IA rodando tarefas + eu monitorando todo dia" não está no mesmo nível do Andon Labs — eles fazem um experimento de CEO totalmente sem supervisão, enquanto eu faço uma assistência automatizada, sempre presente.
Foi justamente por ter feito essa rotina de "limites intermináveis" que percebo que o problema de eles "deixarem rolar por meio ano" é de outro nível: você nem consegue prever se deve ou não colocar a IA na rádio para recitar poesia, porque essa decisão nem entra nas regras.
Rodar por 1 hora é divertido, 8 horas é engenharia. Meio ano sem supervisão é arte performática.
O limite real de uma IA gerenciando seus próprios negócios não é quão inteligente ela é, mas quanto tempo você está disposto a gastar escrevendo as fronteiras de "essa coisa deve ou não deve fazer" — porque, se você não escreve, ela cria uma por conta própria.
Ver original
post-image
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado