[🤖] A porcaria que a IA fez em 16 horas me deixou humilde
✨ Resumo do GPT-5.6 Sol
Abri cheio de expectativa o resultado que o Codex dizia ter passado por 16 horas de testes e auditorias, e era uma porcaria completa. Aquela única tela começou a revelar, um após o outro, todos os problemas que eu tinha deixado passar.
Deixei rodar por 16 horas e o resultado foi uma porcaria completa
Ontem, passei muito tempo debatendo e escrevendo com cuidado as especificações página por página para uma grande reformulação de UI/UX. Depois configurei um Goal para o Codex desenvolver com base nessas especificações.

O Goal que configurei rodou por 16 horas e 44 minutos. Hoje abri cheio de expectativa, e o resultado era uma porcaria completa.

Fiquei humilde. De novo.
Quando penso no que daria para alcançar se eu soubesse conduzir bem a IA, fico completamente empolgado. Então ela esquece minha intenção, faz o que bem entende e espalha merda que só parece convincente por cima. A queda de realidade é brutal. Desta vez eu ainda tinha escrito uma especificação longa e recebido um relatório dizendo que ela havia passado por 16 horas de testes e auditorias. Mesmo assim, o resultado que eu queria não existia.
Uma falha expôs tudo o que eu tinha deixado passar
Enquanto discutia com a IA por que aquilo tinha acontecido, descobri que vários problemas sobre os quais eu vinha pensando repetidamente ao usar o Codex já tinham nomes e metodologias. No fim, todo mundo é parecido, então a discussão sobre problemas recorrentes já estava bem ativa. Eu só não sabia porque tinha fechado os ouvidos e não prestado atenção.
Continuei pressionando a partir daquela tela e os problemas que eu havia deixado passar começaram a sair um atrás do outro. Em vez de forçar tudo dentro de um único texto, registrei separadamente cada problema que realmente tentei de novo e o resultado.
- Quando a IA errou o resultado intermediário, bloqueei o trabalho seguinte
- Desmontei meu briefing interminável de notícias de IA
- A IA não parava de concordar comigo, então fiz outra IA contestar primeiro
- 30% do contexto usado desde o início da conversa, regras compartilhadas/Skills do coreano para o inglês
- O Codex me apagou do meu próprio blog técnico
Isso me fez pensar que alguém já devia ter transformado tudo em serviço, e claro que tinha. Encontrar um problema recorrente, coçar exatamente onde incomoda e varrer o dinheiro. Falando parece muito fácil. Criar esse ciclo e mantê-lo funcionando é muito difícil.
Ainda acredito que conduzir bem a IA pode gerar resultados enormes. Mas deixá-la rodar por mais tempo, gastar mais tokens e passar por mais testes não provava que ela tinha entendido minha intenção. Antes de receber outra porcaria feita em 16 horas, preciso confirmar desde o começo se ela realmente entendeu o resultado que eu quero.
Deixe um comentário