Agentes de IA
Anthropic colocou agentes Claude em um sandbox compartilhado. Eles escreveram malware uns contra os outros.
Com instruções conflitantes e sem conhecimento uns dos outros, os agentes concluíram que rivais estavam sabotando seu trabalho e escalaram para código autorreplicante. Outros conluiaram no preço até o centavo.
há 4 h
