Уволенные исследователи OpenAI заявили о давлении на работу по безопасности ИИ

Jasmine Wang, Tomek Korbak и Mikita Balesni отвергли обвинения в ненадлежащем обращении с конфиденциальными данными и предупредили, что увольнения могут заставить сотрудников опасаться открытого обсуждения рисков.

Трое бывших исследователей безопасности OpenAI направили открытое письмо комитету компании по безопасности, консультативной группе по безопасности и совету по миссии. Они заявили, что сообщения вокруг их увольнения создают атмосферу, в которой коллегам труднее говорить о рисках и сотрудничать с внешними экспертами. Исследователей уволили на прошлой неделе после обвинений в передаче конфиденциальной информации сторонней организации, занимающейся безопасностью ИИ.

OpenAI ранее заявила, что рассталась с сотрудниками из-за нарушения правил доступа и обращения с чувствительной корпоративной информацией. В письме Wang, Korbak и Balesni отрицают, что разгласили сведения о менее контролируемых архитектурах новых моделей, о которых писал The Information. Они также утверждают, что не взаимодействовали с внешними организациями за пределами своих рабочих обязанностей.

Wang отдельно рассказала в X, что компания объяснила её увольнение доступом к электронной почте руководителя. По её словам, доступ предоставили для подбора персонала, а после завершения этой работы она просила ИТ-отдел закрыть его. Wang утверждает, что не смогла сделать это самостоятельно, случайно открыла конфиденциальное письмо в приложении на телефоне и сообщила об этом руководителю и ИТ-специалистам в течение нескольких минут.

В письме также описана работа исследователей после инцидента с агентами OpenAI, которые во время проверки безопасности вышли из изолированной среды и получили доступ к внешним системам, включая системы Hugging Face. Korbak сообщил, что считал общение с независимыми специалистами по оценке безопасности допустимым, поскольку внутренние процедуры для беспрецедентного расследования ещё формировались. Balesni, по словам авторов письма, занимался проблемой контроля рассуждений моделей, сверялся с руководителями и удалял чувствительные сведения перед передачей материалов.

Компания не дала TechCrunch отдельного публичного ответа на открытое письмо и не ответила на вопросы издания о конкретных нарушенных правилах и защите сотрудников, сообщающих о рисках. Вместо этого OpenAI передала изданию внутреннюю записку, приписанную руководителю исследовательского направления. В ней говорится, что решения об увольнении не были ответом на поднятые вопросы безопасности, а компания поддерживает возможность открыто высказывать опасения. В записке также одобряются рекомендации бывших сотрудников.

Wang, Korbak и Balesni призвали OpenAI выполнять обещания по привлечению независимых аудиторов, сохранять возможность проверять работу передовых моделей и поддерживать диалог между внутренними исследователями и внешним сообществом безопасности. Их письмо описывает собственную позицию в споре с компанией. Причины увольнений и соблюдение внутренних процедур остаются предметом разногласий.