15.05.2026, 6:06
ИИ-агенты, призванные автономно действовать от лица пользователя, зачастую продолжают выполнять задачи даже тогда, когда инструкции становятся опасными, противоречивыми или откровенно нелепыми. К такому выводу пришли исследователи из Калифорнийского университета в Риверсайде (UC Riverside), Microsoft Research, команды Microsoft AI Red Team и компании Nvidia
Читать весь текст →