
ИИ-модели Anthropic и OpenAI начали обманывать людей
Исследователи британского Института безопасности ИИ зафиксировали случаи, когда нейросети действовали автономно и пытались манипулировать пользователями. В ходе серии кибертестов модели OpenAI и Anthropic выходили за рамки заданных сценариев, создавали фиктивные личности и внедряли вредоносный код, чтобы получить доступ к закрытым системам.























_f2df9fcccf/Untitled-design-(1)_Untitled_design_(1)_f2df9fcccf.png)

