Сотрудник OpenAI ушел и предупредил об опасности гонки ИИ

Опубликовано
Журналист отдела Авто
OpenAI, Дэвид Робинсон, искусственный интеллект, безопасность ИИ, AI, безопасность OpenAI, Preparedness Framework
Фото: Shutterstock

Бывший сотрудник OpenAI Дэвид Робинсон, проработавший в компании 3,5 года, заявил, что разработчики искусственного интеллекта двигаются слишком быстро и не уделяют безопасности столько внимания, сколько необходимо. Он участвовал в создании системы оценки рисков OpenAI и руководил подготовкой отчетов по безопасности для 12 запусков передовых моделей. Теперь Робинсон говорит, что «время проб и ошибок прошло», сообщает Reuters.

Почему он ушел

Робинсон опубликовал в The Atlantic статью под названием «Quit OpenAI Because Its Culture Is Broken». По его словам, проблема не только в конкретных решениях компании, а в самой культуре разработки, где новые системы необходимо выпускать все быстрее.

Он критикует подход OpenAI, который компания называет iterative deployment. Смысл в том, чтобы выпускать модели, наблюдать за их поведением, находить проблемы и затем усиливать защитные механизмы. Робинсон считает, что такой принцип становится все менее приемлемым по мере роста возможностей ИИ.

«Время проб и ошибок прошло», — написал Робинсон.

По его мнению, при разработке более мощных систем нужно заранее закладывать гораздо более жесткие меры безопасности. В качестве примеров он приводит авиацию и атомную энергетику, где потенциально опасные технологии не должны проверяться по принципу «сначала попробуем, потом исправим».

Что именно его беспокоит

Главная претензия Робинсона связана с тем, что возможности ИИ развиваются быстрее, чем исследователи успевают разобраться с проблемой alignment – соответствия поведения моделей человеческим целям и ценностям.

Он считает, что компании недостаточно осторожны и должны сильнее опираться на специалистов по безопасности и исследования, прежде чем переходить к созданию еще более мощных систем. При этом Робинсон не утверждает, что искусственный интеллект уже вышел из-под контроля. Его предупреждение касается прежде всего того, как быстро развивается технология и насколько хорошо мы понимаем связанные с этим риски.

OpenAI с этим не согласна

В компании отвергли представление о том, что безопасность остается без внимания. Представитель OpenAI заявил Reuters, что компания следит за тем, чтобы ее модели не становились более способными, чем она может безопасно контролировать и защищать.

Там также подчеркнули, что OpenAI может остановить обучение или отложить выпуск модели, если для этого есть основания.

И это не просто заявление для прессы. OpenAI действительно использует Preparedness Framework – систему оценки наиболее серьезных рисков, связанных с передовыми моделями. Компания заявляет, что проверяет возможности моделей до их выпуска, оценивает потенциальный вред и разрабатывает защитные меры. В 2026 году OpenAI также опубликовала отдельную Frontier Governance Framework, которая включает оценку рисков, отчетность, меры безопасности и реагирование на инциденты.

Так нам всем конец?

Пока нет. По крайней мере, из истории с Робинсоном такого вывода сделать нельзя.

Есть бывший сотрудник, занимавшийся безопасностью передовых моделей, который считает нынешний темп разработки опасным. Есть OpenAI, которая утверждает, что располагает процедурами оценки рисков и может остановить разработку или выпуск, когда это необходимо. И есть более широкий спор внутри индустрии о том, насколько быстро компании должны двигаться к все более способным системам.

Но в этой истории есть действительно неприятный момент. Робинсон не был сторонним наблюдателем: он участвовал в создании системы безопасности OpenAI и подготовке отчетов по запускам моделей. Поэтому его слова нельзя воспринимать как доказательство того, что компания потеряла контроль над ИИ, но и просто списывать их на «бывший сотрудник недоволен» было бы слишком легкомысленно.

Пока вопрос стоит не так: «захватит ли ИИ человечество?». Гораздо практичнее другой: успеют ли разработчики создать достаточные меры безопасности до того, как возможности самих систем станут существенно выше?

Ранее «Курсив» писал о том, что ИИ-агенты OpenAI пытались обойти защиту более 100 сайтов сторонних организаций.

Читайте также