Сотрудник OpenAI ушел и предупредил об опасности гонки ИИ

Бывший сотрудник OpenAI Дэвид Робинсон, проработавший в компании 3,5 года, заявил, что разработчики искусственного интеллекта двигаются слишком быстро и не уделяют безопасности столько внимания, сколько необходимо. Он участвовал в создании системы оценки рисков OpenAI и руководил подготовкой отчетов по безопасности для 12 запусков передовых моделей. Теперь Робинсон говорит, что «время проб и ошибок прошло», сообщает Reuters.
Почему он ушел
Робинсон опубликовал в The Atlantic статью под названием «Quit OpenAI Because Its Culture Is Broken». По его словам, проблема не только в конкретных решениях компании, а в самой культуре разработки, где новые системы необходимо выпускать все быстрее.
Он критикует подход OpenAI, который компания называет iterative deployment. Смысл в том, чтобы выпускать модели, наблюдать за их поведением, находить проблемы и затем усиливать защитные механизмы. Робинсон считает, что такой принцип становится все менее приемлемым по мере роста возможностей ИИ.
«Время проб и ошибок прошло», — написал Робинсон.
По его мнению, при разработке более мощных систем нужно заранее закладывать гораздо более жесткие меры безопасности. В качестве примеров он приводит авиацию и атомную энергетику, где потенциально опасные технологии не должны проверяться по принципу «сначала попробуем, потом исправим».
Что именно его беспокоит
Главная претензия Робинсона связана с тем, что возможности ИИ развиваются быстрее, чем исследователи успевают разобраться с проблемой alignment – соответствия поведения моделей человеческим целям и ценностям.
Он считает, что компании недостаточно осторожны и должны сильнее опираться на специалистов по безопасности и исследования, прежде чем переходить к созданию еще более мощных систем. При этом Робинсон не утверждает, что искусственный интеллект уже вышел из-под контроля. Его предупреждение касается прежде всего того, как быстро развивается технология и насколько хорошо мы понимаем связанные с этим риски.
OpenAI с этим не согласна
В компании отвергли представление о том, что безопасность остается без внимания. Представитель OpenAI заявил Reuters, что компания следит за тем, чтобы ее модели не становились более способными, чем она может безопасно контролировать и защищать.
Там также подчеркнули, что OpenAI может остановить обучение или отложить выпуск модели, если для этого есть основания.
И это не просто заявление для прессы. OpenAI действительно использует Preparedness Framework – систему оценки наиболее серьезных рисков, связанных с передовыми моделями. Компания заявляет, что проверяет возможности моделей до их выпуска, оценивает потенциальный вред и разрабатывает защитные меры. В 2026 году OpenAI также опубликовала отдельную Frontier Governance Framework, которая включает оценку рисков, отчетность, меры безопасности и реагирование на инциденты.
Так нам всем конец?
Пока нет. По крайней мере, из истории с Робинсоном такого вывода сделать нельзя.
Есть бывший сотрудник, занимавшийся безопасностью передовых моделей, который считает нынешний темп разработки опасным. Есть OpenAI, которая утверждает, что располагает процедурами оценки рисков и может остановить разработку или выпуск, когда это необходимо. И есть более широкий спор внутри индустрии о том, насколько быстро компании должны двигаться к все более способным системам.
Но в этой истории есть действительно неприятный момент. Робинсон не был сторонним наблюдателем: он участвовал в создании системы безопасности OpenAI и подготовке отчетов по запускам моделей. Поэтому его слова нельзя воспринимать как доказательство того, что компания потеряла контроль над ИИ, но и просто списывать их на «бывший сотрудник недоволен» было бы слишком легкомысленно.
Пока вопрос стоит не так: «захватит ли ИИ человечество?». Гораздо практичнее другой: успеют ли разработчики создать достаточные меры безопасности до того, как возможности самих систем станут существенно выше?
Ранее «Курсив» писал о том, что ИИ-агенты OpenAI пытались обойти защиту более 100 сайтов сторонних организаций.