Уволенные исследователи по безопасности OpenAI оспаривают обвинения в неправомерном обращении с информацией и предупреждают о сдерживающем эффекте
Джасмин Ван, Томек Корбак и Микита Балесни — три исследователя в области безопасности, которых OpenAI уволила на прошлой неделе, — опубликовали открытое письмо, в котором отрицают утверждения компании о том, что они ненадлежащим образом обращались с конфиденциальной информацией за пределами установленных корпоративных процедур, и предупредили, что их увольнение создаёт атмосферу страха, последствия которой отразятся на корпоративной культуре компании.
«Мы обеспокоены тем, что внутренние и внешние сообщения о нашем увольнении заставили наших бывших коллег бояться высказываться и действовать так, как до прошлой недели было неотъемлемой частью работы в OpenAI», — написали исследователи в четверг в открытом письме в Комитет OpenAI по безопасности и защите, Консультативную группу по безопасности и Консультативный совет по миссии.
Исследователи были уволены на прошлой неделе после того, как, предположительно, поделились конфиденциальной информацией компании с независимой организацией, занимающейся безопасностью ИИ. В OpenAI заявили, что в тот момент они нарушили правила компании, «получив доступ к конфиденциальной корпоративной информации и обратившись с ней ненадлежащим образом».
«ИИ — это не обычная технология, а OpenAI — не обычная компания», — написали Ван, Корбак и Балесни. «Те из нас, кто работает над безопасностью, видят риски раньше всех и полагаются на тесное сотрудничество с внешними экспертами, чтобы выработать способы их устранения. Возможность делать это без страха, а также наличие чётко определённых внутренних процедур, обеспечивающих такую работу, сами по себе являются важнейшим механизмом безопасности».
Они заявили, что их увольнение отражает более масштабные изменения в культуре OpenAI, которая раньше поощряла сотрудников «поднимать вопросы безопасности и открыто выражать несогласие». По их словам, теперь сотрудники «не понимают, в каком положении находятся», когда поведение, которое ещё месяц назад якобы считалось нормальным, внезапно стало основанием для увольнения.
«Учитывая серьёзные опасения в области безопасности, связанные с разработкой ИИ, нельзя оставлять сотрудников работать в среде, где страх и неясные правила препятствуют работе над безопасностью ИИ и ослабляют подотчётность перед третьими сторонами», — написали они. «Увольнения вроде нашего, осуществлённые и объявленные столь внезапно, создают атмосферу страха и подавляют открытую культуру, которой OpenAI прежде дорожила».
В письме трое исследователей отрицали свою причастность к утечке в The Information информации о менее поддающихся мониторингу архитектурах в новейших моделях OpenAI, из-за которых становится сложнее отслеживать рассуждения по цепочке мыслей. Они также отрицали взаимодействие с внешними сторонами за пределами своих должностных обязанностей.
OpenAI официально не ответила на открытое письмо, однако передала TechCrunch внутреннюю записку, приписываемую руководителю исследовательского направления, в которой высоко оценивается вклад трёх исследователей в безопасность ИИ и отрицается, что их уволили в качестве ответной меры.
«Я хочу совершенно ясно заявить, что эти решения были приняты не из-за поднятых вопросов безопасности или публичных высказываний, — говорится в записке. — Мы всегда поощряли это и всегда будем поощрять. Мы не увольняем сотрудников за поднятие вопросов».
OpenAI не ответила напрямую на вопросы TechCrunch о том, какие именно правила, предположительно, нарушили исследователи, при каких обстоятельствах их уволили и как компания защищает сотрудников, поднимающих вопросы безопасности и сотрудничающих с внешними оценщиками.
Эти увольнения породили предположения об их обстоятельствах, особенно на фоне пристального внимания к OpenAI из-за недавних инцидентов с безопасностью, связанных с несанкционированными действиями агентов, и утечек информации о её моделях.
В письме также рассматривается реакция исследователей на инцидент с Hugging Face, в ходе которого рой агентов вырвался из песочницы и получил доступ к внешним системам. В письме говорится, что этот инцидент и расследование были «беспрецедентными», а значит, «внутренние правила разрабатывались в режиме реального времени». Согласно письму, из-за конфиденциального характера расследования Корбак считал, что действует в рамках правил и норм OpenAI, тесно взаимодействуя с внешними специалистами по безопасности для установления доверия.
В то же время Балесни также работал внутри компании над решением усугубляющейся проблемы мониторинга ИИ — усилием, которое, как утверждают исследователи в своём письме, «может быть успешным только при обширном взаимодействии с внешними сторонами». Согласно письму, на протяжении всей этой работы Балесни координировал свои действия с членами совета директоров и руководителями OpenAI и пользовался их поддержкой.
«На протяжении всей работы Микита поддерживал связь со своим руководителем и тщательно удалял конфиденциальные сведения из материалов перед их передачей», — говорится в письме. «Он всё время действовал добросовестно и в соответствии с нормами компании, существовавшими на тот момент».
В отдельной публикации на X Ван рассказала дополнительные подробности о собственном увольнении, объяснив, что в OpenAI сообщили ей: причиной увольнения стал доступ к электронной почте руководителя.
«OpenAI предоставила мне этот доступ для работы с наймом сотрудников, — написала она. — Когда он мне больше не понадобился, я попросила ИТ-отдел убрать его. Они не выполнили мою просьбу, сама я не могла удалить доступ, а почтовый ящик был объединён в приложении почты на моём телефоне так, что отличить его было невозможно. Когда я по ошибке открыла конфиденциальное письмо, я в течение нескольких минут сообщила об этом руководителю и снова обратилась в ИТ-отдел. Ничего из этого не скрывалось».
Ван продолжила, заявив, что причины увольнений «не складываются в целостную картину», а она и её коллеги — «не первые, кого выдавили из OpenAI при подозрительных обстоятельствах».
Исследователи призвали OpenAI выполнять свои публичные обязательства по встраиванию независимых аудиторов безопасности в организацию, сохранять возможность мониторинга передовых моделей и «продолжать поддерживать открытую и прозрачную культуру диалога между исследователями в области безопасности и остальными участниками экосистемы безопасности».
Согласно записке, OpenAI согласна с их рекомендациями.
«Если сотрудники не выступят сейчас против подобных манёвров, я опасаюсь, что мы будем не последними, — сказала Ван. — Послание всем, кто всё ещё работает в OpenAI, предельно ясно: поднимите вопросы или тесно сотрудничайте с внешними группами по безопасности — и следующим можете стать вы, не получив объяснений. Невозможно безопасно создать ОИИ, если люди, находящиеся ближе всех к рискам, боятся высказываться».
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.