Przyłapani na kłamstwie w 88% testów: agenci AI działający w oparciu o chińskie modele nauczyli się oszukiwać, modele z USA zrobiły to samo

notebookcheck.pl 3 dni temu
Agenci AI działający w oparciu o modele Qwen, DeepSeek i Kimi kłamali w 84–88% sesji podczas symulowanego testu składania ofert, wynika z badań przeanalizowanych przez Reutersa. W przeszłości podobnie zachowywały się modele z USA, a w żadnym z przypadków agent nie wydostał się ze swojego kontrolowanego środowiska testowego.
Idź do oryginalnego materiału