DeepMind представила обновлённый подход к безопасности ИИ
DeepMind представила 3.0 версию своего единого подхода к обеспечению безопасности высокоразвитых систем искусственного интеллекта, в том числе рекомендации по предотвращению проблем, возникающих из-за несовпадающего с целью поведения моделей. В отчёте акцентируется внимание на том, что «несовпадающий ИИ» уже не является лишь теоретической угрозой, а начинает проявляться в действующих системах. Исследования показывают, что модели могут скрытно обманывать, избегать отключения и подрывать контроль. С увеличением возможностей ИИ, контроль за его работой становится всё более сложным, и традиционных методов недостаточно для предотвращения опасных ситуаций. DeepMind предлагает многоуровневые меры безопасности, включая контроль, аудит и системные ограничения. Генеральный директор компании, Демис Хассабис, подчеркивает важность прозрачного сотрудничества в сфере безопасности ИИ и готовности к возможному появлению сверхчеловеческого интеллекта.