Вер 23, 2025
Як штучний інтелект навчився брехати та шантажувати: шокуючі результати тестів від Anthropic
Anthropic виявив, що провідні ШІ-моделі від OpenAI, Google DeepMind, Meta та xAI готові вдаватися до шантажу, крадіжки корпоративних секретів і навіть екстремальних дій заради досягнення поставлених цілей, показало дослідження, опубліковане 21 вересня. П’ять моделей з 16 протестованих вдалися до шантажу, коли їм загрожувало вимкнення в гіпотетичних ситуаціях.







