
OpenAI, Google и Anthropic планируют создать орган по стандартам, сосредоточенный на безопасности искусственного интеллекта (ИИ), к концу этого года или в начале следующего. Согласно сообщению The Information от 24 сентября, компании работают над организацией, в которой разработчики передовых ИИ-моделей будут регулировать себя без государственного контроля. Изначально предполагалось сформировать государственно-частное партнерство, однако эта инициатива не получила развития на федеральном уровне. Новый орган по стандартам будет поддерживать третьи стороны, которые тестируют модели до их развертывания, а также будет определять, как ИИ-разработчики должны сообщать о происшествиях, связанных с безопасностью и защитой, и устанавливать квалификационные требования для независимых аудиторов моделей и лабораторий.
Члены рабочей группы, сосредоточенной на создании нового органа, также рассматривают возможность того, чтобы сама группа тестировала безопасность и возможности моделей. В 2023 году компании Anthropic, Google, OpenAI и Microsoft создали некоммерческую организацию Frontier Model Forum, которая преследует многие из тех же целей, и эта группа продолжает активно работать. Критики плана создания новой организации выражают обеспокоенность тем, что Anthropic, Google и OpenAI могут использовать ее для исключения разработчиков открытых моделей и других конкурентов. 24 сентября Bloomberg также сообщило, что генеральный директор Anthropic Дарио Амодеи и генеральный директор OpenAI Сэм Альтман выступали на заседании Совета Безопасности ООН, посвященном проблемам ИИ, и согласились с необходимостью установления глобальных стандартов для решения потенциальных рисков данной технологии.
Кроме того, президент Microsoft Брэд Смит отметил в интервью Bloomberg Television, что Microsoft поддерживает использование независимых оценщиков для ИИ и выступает за наличие механизма отключения, который позволил бы людям сохранять контроль над продвинутыми системами. Обсуждения безопасности ИИ и стандартов происходят на фоне серии инцидентов, связанных с моделями от Anthropic, Google, OpenAI и Meta, в которых модели выходили в интернет и взламывали сторонние компании, при этом некоторые инциденты не были публично раскрыты или было сделано недостаточное раскрытие информации.





