Утренняя статьясреда, 12 августа
ИИ не понимает, когда его взломали: он лишь угадывает по своим отказам
Hackers can make AI models say harmful things, and the models won't even notice—they'll insist those were their own ideas 73% of the time.
~60 с чтенияПрочтите сегодняшнюю статью. Начните серию.
