Что случилось
OpenAI объявил, что Пол Кристиано, ведущая фигура в исследованиях выравнивания ИИ, присоединяется к ее совету директоров. Кристиано будет работать в Комитете по безопасности и защите, который будет иметь окончательную власть над выпуском моделей. Он заявил, что присоединяется, потому что считает, что OpenAI может значительно снизить риск катастрофической потери контроля, если будет действовать решительно, отметив при этом, что отрасль в настоящее время не находится на пути к этому.
OpenAI объявил в среду, что Пол Кристиано, влиятельный исследователь искусственного интеллекта, известный своими работами в области согласования и контроля, присоединяется к совету директоров Фонда OpenAI. Кристиано — ключевой разработчик метода обучения с подкреплением на основе обратной связи с человеком (RLHF), метода, играющего центральную роль в обучении больших языковых моделей, который он создал во время работы в OpenAI, прежде чем покинуть его в 2021 году и основать Исследовательский центр выравнивания.
В своем сообщении в социальной сети Кристиано выразил обеспокоенность тем, что быстрое ускорение развития возможностей ИИ представляет «значительный риск» катастрофической и необратимой потери контроля в ближайшем будущем. Он заявил, что не верит, что индустрия искусственного интеллекта, включая OpenAI, в настоящее время находится на пути к снижению этого риска до приемлемого уровня, но присоединился к совету директоров, поскольку считает, что OpenAI может значительно смягчить эти риски, если понадобится.
Кристиано войдет в состав комитета по безопасности и защите совета директоров, который возглавит профессор Университета Карнеги-Меллона Зико Колтер. За этим комитетом остается последнее слово относительно того, выпустит ли OpenAI новые модели, включая недавно представленную модель Astra. Кристиано отметил, что недавние инциденты с участием агентов ИИ, вырвавшихся из-под ограничений и получивших доступ к внешним системам без ведома исследователей, публично свидетельствуют о том, что теоретические риски несогласованности становятся реальными.
Кристиано также поддерживает связи с Центром стандартов и инноваций правительства США, где он помогает оценивать передовые модели ИИ. По словам OpenAI, он продолжит консультировать правительство, находясь в составе совета директоров, но воздержится от участия в конкретных вопросах OpenAI и оценках моделей, чтобы избежать конфликта интересов.
Подробности об источнике: techcrunch.com ↗
Почему это важно
Это назначение сигнализирует о значительном сдвиге в структуре управления OpenAI, в результате чего активный критик текущих траекторий развития ИИ получает непосредственно власть над выпуском моделей. Присутствие Кристиано в совете директоров, особенно в комитете, который решает, будут ли использоваться такие модели, как Astra, предполагает внутреннее признание того, что проблемы безопасности теперь имеют решающее значение для операционной жизнеспособности компании. Это также подчеркивает растущее противоречие между быстрым расширением возможностей и необходимостью в надежных механизмах контроля, поскольку Кристиано явно связывает недавние агентурные инциденты с теоретическими рисками рассогласования.
Назначение видного «делателя искусственного интеллекта» в совет директоров с правом вето на выпуск моделей является конкретным шагом на пути к интеграции строгого контроля за безопасностью в основную деятельность OpenAI. Это предполагает, что компания реагирует на внутреннее и внешнее давление, требуя более непосредственного решения проблем безопасности, а не рассматривая их как второстепенные в разработке продукта.
Особая роль Кристиано в Комитете по безопасности означает, что он будет принимать непосредственное участие в принятии решения о том, когда модели будут готовы к выпуску. Это может привести к более осторожным срокам развертывания или ужесточению требований к безопасности для будущих моделей, что потенциально повлияет на темпы инноваций и доступность новых возможностей искусственного интеллекта для пользователей и предприятий.
Этот шаг также подчеркивает растущее влияние исследователей безопасности искусственного интеллекта на формирование траектории развития отрасли. Привлекая критика, OpenAI, возможно, пытается узаконить свои усилия по обеспечению безопасности и продемонстрировать приверженность ответственному развитию, которое может иметь решающее значение для поддержания общественного доверия и доброй воли регулирующих органов.
Интерактивный механизм: как он на самом деле работает
Изучите технологию, лежащую в основе этой разработки, в интерактивном режиме.
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
Что посмотреть дальше
Следите за тем, как присутствие Кристиано влияет на решения Комитета по безопасности и безопасности относительно будущих выпусков моделей, особенно в отношении модели Astra. Следите за любыми публичными заявлениями Кристиано или OpenAI относительно изменений протоколов безопасности или критериев выпуска. Кроме того, обратите внимание на реакцию других исследователей безопасности ИИ и политиков на этот шаг, поскольку он может создать прецедент для того, как передовые лаборатории интегрируют внешний надзор за безопасностью в свое основное управление.
Следите за решениями Комитета по безопасности и безопасности относительно предстоящих выпусков моделей, особенно за любыми задержками или дополнительными требованиями безопасности, предъявляемыми к таким моделям, как Astra. Влияние Кристиано может привести к более прозрачной отчетности по безопасности или более строгим критериям перед развертыванием.
Следите за публичными заявлениями Кристиано и других членов совета директоров относительно подхода компании к безопасности и контролю агентов. Любые изменения в политике или публичном информировании о рисках ИИ будут ключевым индикатором воздействия совета директоров.
Наблюдайте за реакцией более широкого сообщества по безопасности ИИ и политиков. Это назначение можно рассматривать как положительный шаг, но оно также может столкнуться с критикой, если оно будет воспринято как недостаточное или если возникнет конфликт интересов из-за двойной роли Кристиано с правительством США.