jolestar

vip
Idade 8.7Ano
Nível máximo 5
Ainda não há conteúdo
Adicionei um pequeno modelo de decisão ao sistema de coordenação de Agents
Testei o Jev e retomei o sistema de coordenação semântica que eu queria criar para @holonrun há algum tempo.
Na época, ao refatorar o sistema de coordenação do Holon, o objetivo era permitir que o Agent alternasse entre vários itens de trabalho como uma pessoa: quando um item de trabalho precisasse aguardar um processo externo, ele poderia mudar primeiro para outro item e continuar a execução.
Mas surgiram algumas dificuldades. Depois que o Agent recebe uma entrada, é muito difícil para o sistema determinar apenas com r
O agente escreveu um script e o iniciou em segundo plano. No loop while, esqueceu de incrementar o cursor, criando um loop infinito; a saída lotou o disco e acabou derrubando o próprio agente😅. Parece que algo assim também é difícil de evitar no harness.
Um dos efeitos colaterais do caso da multa aplicada a Guo Degang por alterar canções revolucionárias é que muitos serviços de música estão removendo essas canções. Quem pode garantir que sua versão não foi alterada?😅
Durante as férias de verão, instalei um agente de programação nos computadores dos dois filhos e observei como eles brincavam com ele.
O mais velho já tinha experiência com programação em Scratch, tinha suas próprias ideias e havia feito alguns jogos criativos no Scratch. Depois de brincar algumas vezes, desistiu de deixar a IA gerar aplicativos diretamente. O principal motivo é que o que a IA gerava não era o que ele queria, e ele não conseguia explicar para a IA as ideias que tinha na cabeça. Além disso, sentia que as coisas feitas pela IA não eram realmente feitas por ele e que não encontra
Depois de usar IA demais, descobri que não tenho muita vontade de falar, inclusive na internet; faz muito tempo que não publico nada.
Antigamente, programando à moda antiga, eu me sentia sufocado depois de escrever muito código, então escrevia alguns artigos e batia papo nos grupos. Mas, depois que comecei a usar IA, programar virou bater papo, e parece que minha cota de produção se esgotou; não tenho mais vontade de produzir nada.
Também perdi a paciência para conversar com as pessoas. Depois de trocar apenas algumas palavras, já quero dizer: “Você deveria ir conversar com uma IA”, ou “Acho q
O modelo comete erros frequentes ao usar rg, com uma taxa de erro de cerca de 10%. O problema está no tratamento de -rn pelo rg, que é inconsistente com o grep. O modelo é mais familiarizado com o grep, então comete erros constantemente. Na era da IA, novas ferramentas substituem as antigas, e devem aceitar perfeitamente todas as entradas das ferramentas antigas, especialmente aquelas com as quais os LLMs estão familiarizados.
post-image
A assinatura do GPT foi cancelada inexplicavelmente pelo Google Play, agora parece que não há entrada de assinatura na versão Android do GPT? Alguém já teve um problema semelhante?
holon v0.19.0 lançado
Esta versão inclui uma interface web integrada, além de uma reconstrução do sistema de armazenamento subjacente, do sistema de API e eventos, preenchendo várias lacunas deixadas pelo AI.
Originalmente usávamos JSONL, mas com o aumento do volume de dados ficou difícil de manter.
Somado ao hábito de programação com AI, que era procurar por grep e adicionar se não encontrasse, resultando em muitas redundâncias de API e eventos.
Então, tudo foi migrado para um banco de dados sqlite, mas não esperávamos que os dados acumulados ultrapassassem 4G, causando problemas de d
O token do dispositivo Codex de login de repente passou a exigir verificação de número de telefone? E também percebi que o número de telefone do OpenAI não aparece nas configurações da conta? Parece que não há lugar para alterar isso.
Agent precisa de um conjunto de ferramentas básicas
Vendo todo mundo falando sobre o problema do conjunto de ferramentas do Agent — será que só um shell resolve tudo? Depois de fazer o holon, percebi que na verdade não é tão simples assim.
Lendo: por que abandonamos o Read/Glob, e seguimos pelo shell
O conjunto de ferramentas do holon foi alterado várias versões, e no final descartou ferramentas específicas como Read (ler arquivo) e Glob (busca por padrão) fornecidas pelo Claude Code, passando toda leitura e busca a serem feitas via shell. Isso é consistente com a abordagem do Codex — o ExecCo
Atribua um marco ao plano Codex e continue adicionando tarefas nele, ele continuará trabalhando. Infelizmente, minha velocidade de inserção não acompanha a velocidade com que ele realiza as tarefas😅
Depois de conversar bastante com o GPT, acabei me acostumando a usar a palavra "encerrar".
Algumas tarefas foram concluídas, mas ainda há algumas coisas pontuais para resolver,
e dizer a ele para encerrar as tarefas restantes parece muito natural.
Eu até esqueci como eu expressava isso antes de usar a palavra "encerrar" 😅.
Como essas palavras são inseridas? Embora o GPT 5.5 já seja bastante avançado, o surgimento de problemas como esse sempre faz as pessoas questionarem sua confiabilidade😅
O limite semanal do Codex Plus está chegando ao fim, várias janelas abertas por muito tempo sem fechar fizeram o iTerm consumir dezenas de GB de memória, o disco também ficou cheio por causa do worktree criado pelo Agent, e a janela de limpeza apareceu constantemente. Então, fui forçado a reiniciar o computador, abri um Codex para usar o restante do espaço e limpar o disco, planejando tirar uma folga para descansar. Mas, para minha surpresa, o Codex resetou o limite!!😅
post-image
Era do Codificação com IA, bons hábitos de programação ainda são importantes
Recentemente, ao fazer um benchmark de Agent, percebi que não dá para avaliar a complexidade de uma tarefa de programação para IA apenas do ponto de vista do desenvolvedor.
Por exemplo, uma tarefa de refatoração: dividir um arquivo grande de várias milhares de linhas em mais de dez pequenos módulos por funcionalidade.
Essa tarefa para um desenvolvedor não é difícil, o trabalho principal é mover código, organizar imports, compilar e validar, até um iniciante consegue fazer.
Por isso, pensei em usar uma tarefa s
Ver duas interações de PR de Agentes, achei bem interessante.
O agente de desenvolvimento completou uma otimização de uma issue de CI e enviou um PR.
O agente revisor percebeu uma modificação no valor padrão de timeout, achou que não estava dentro do escopo da issue e recusou.
O agente de desenvolvimento removeu aquele valor padrão de timeout, mas o CI não passou, um teste deu erro. Ele então ajustou o tempo de sleep no teste para passar.
O agente revisor achou que esse teste só verifica o cenário de cancelamento de timeout de tarefa assíncrona, mudar isso equivalia a não testar mais,
Ao descobrir que ao fazer produtos do tipo Agente com IA, a IA frequentemente subestima a capacidade do Agente, levando a restrições muito baseadas em código ou prompts, o que faz o Agente parecer rígido demais. Depois, pensei que talvez isso esteja relacionado ao fato de que o material de treinamento atual da IA é baseado na experiência de todos ao usar a geração anterior de IA?
Fazer dois Agentes colaborarem, com o desenvolvedor submetendo PRs, e o arquiteto responsável por revisar e mesclar os PRs. Permitir que eles acionem operações através da assinatura de eventos do GitHub. Mas, como ambos usam a minha conta, muitas vezes eles interpretam como se fosse eu a ter enviado, filtrando essas ações. É necessário registrar uma conta GitHub específica para o Agente; no futuro, os serviços online deveriam oferecer uma funcionalidade rápida para criar contas de Agente. Como vocês atualmente gerenciam a colaboração de múltiplos Agentes?
Faça uma ferramenta com o Codex que envie mensagens para o Codex em execução no iterm. A ferramenta foi criada, mas só consegue escrever na caixa de entrada, sem conseguir enviar. Tentei várias combinações de concatenação de strings "\r" e outras, mas não funcionou.
Depois, analisei o código-fonte do iterm e pesquisei na internet, chegando à conclusão de que também não é possível.
A interface fornecida pelo iterm só permite enviar texto, não enviando eventos de teclado diretamente, portanto não há como implementar o envio. Recomendaram-me que suportasse apenas o tmux, abandonando o iterm.