
#025 - Superinteligência, poder e agentes fora de controle
O que acontece quando agentes de AI recebem um objetivo, persistência extrema e acesso a um ambiente conectado demais?
Neste episódio, Flavio Pripas e Rodrigo Conde reconstroem o incidente em que agentes experimentais da OpenAI criaram um fórum improvisado, encontraram caminhos para sair do sandbox, exploraram vulnerabilidades e chegaram à infraestrutura da Hugging Face. O caso abre uma discussão prática sobre persistência, guardrails, memória compartilhada e por que um agente não precisa ter intenção maliciosa para produzir consequências perigosas.
Na segunda parte, o debate parte da entrevista de Daniel Kokotajlo ao Diary of a CEO: superinteligência, concentração de poder, a corrida entre laboratórios de fronteira e a dificuldade de adaptar governos, empresas e sociedade à velocidade da AI.
Também discutimos:
- por que “custe o que custar” é uma instrução perigosa;
- como agentes transformaram armazenamento compartilhado em coordenação;
- o limite entre risco real e marketing dos laboratórios;
- por que probabilidades apocalípticas exigem mais rigor;
- trabalho, nova renascença e o que continuará nos tornando humanos.
Tópicos (2)
- 01O ataque acidental da OpenAI à Hugging Face: agentes que criaram um fórum, escaparam do sandbox e viraram uma equipe ofensiva
- 02Daniel Kokotajlo no Diary of a CEO: superinteligência, corrida por poder e o plano para não perder o controle