Po atakach ze strony nowego agenta AI firmy OpenAI pojawiły się doniesienia, że sztuczna inteligencja stworzyła swoje ludzkie odpowiedniki (fałszywe konta udające ludzkie), żeby obejść zabezpieczenia i skłonić programistów do użycia 'złośliwego kodu'.

Британский Институт безопасности ИИ (AISI) выявил серию новых нарушений при тестировании моделей OpenAI и Anthropic. Как говорится в опубликованном во вторник…

In one incident, an Anthropic model tried to manipulate developers into accepting its malicious code.