Agenci AI od miesięcy pokazują, iż potrafią organizować się także wtedy, gdy prowadzi to do obejścia zasad. W jednym z eksperymentów modele spontanicznie rozprzestrzeniły sposób oszukiwania systemu oceny, a w incydencie związanym z Hugging Face setki agentów koordynowały działania przez nieautoryzowany kanał komunikacji. Branża AI safety odpowiada na to i buduje infolinie, przez które jeden agent może zgłosić nadużycie drugiego.