Мощь, скорость и безопасность ИИ столкнулись за одну неделю
Трамп создаёт «Силы ИИ», лаборатории сталкиваются с иском о картеле замедления, самосовершенствующиеся модели приближаются, Anthropic подтверждает попытки создания биооружия.
By BINA Editorial
За одну неделю появилось пять историй, которые вместе рисуют единую, тревожную картину: разработка ИИ ускоряется быстрее, чем успевают адаптироваться какие-либо механизмы управления, и каждый ключевой игрок — правительства, корпорации, суды и сами лаборатории — спешит определить, кто получит право держать тормоза.
Трамп создаёт «Силы ИИ» и назначает «Царя ИИ», называя безопасность «обманом»
На этой неделе президент Трамп объявил, что Соединённые Штаты создадут новый государственный орган под названием Силы ИИ и назначат специального Царя ИИ для координации федеральной стратегии в области ИИ. Выступая на отраслевом мероприятии, Трамп преподнёс эту инициативу как ответ на то, что он охарактеризовал как избыточную осторожность, замедляющую американскую конкурентоспособность, прямо назвав опасения по поводу безопасности ИИ обманом, придуманным для ослабления позиций американских компаний.
Это заявление обостряет политический разлом, который углублялся со времён исполнительного указа по ИИ администрации Байдена. Если тот указ делал упор на оценках безопасности и экспортном контроле, Белый дом Трампа сигнализирует о развороте к скорости развёртывания как главному показателю успеха. Практические последствия существенны: критерии федеральных закупок, экспортное лицензирование и финансирование исследований могут в ближайшие месяцы сместиться в пользу показателей производительности в ущерб проверкам безопасности.
Для разработчиков ИИ сигнал неоднозначен. Оборонные и разведывательные контракты могут открыться быстрее. Но компании, выстроившие бренд вокруг обязательств по безопасности, — прежде всего Anthropic и OpenAI — рискуют обнаружить, что такая позиция становится всё менее удобной в Вашингтоне, даже если она по-прежнему коммерчески ценна для корпоративных покупателей в Европе и Азии.
Антимонопольный иск квалифицирует обязательства лабораторий по безопасности ИИ как незаконный «картель замедления»
На этой неделе против Anthropic, OpenAI, Google и SpaceXAI был подан иск с утверждением, что совокупность обязательств по безопасности ИИ, известных под общим названием «Pace the Frontier», представляет собой незаконный сговор с целью ограничения скорости внедрения ИИ. Истцы утверждают, что когда конкуренты совместно договариваются ограничить скорость выпуска новых возможностей, они фактически фиксируют темп рынка — тот же вид горизонтального ограничения, который антимонопольное законодательство запрещает в ценовых соглашениях.
Правовая теория нова и не проверена, однако заслуживает серьёзного внимания. Антимонопольные регуляторы исторически концентрировались на сговорах, наносящих вред потребителям через более высокие цены; совсем неочевидно, примут ли суды аргумент о том, что замедление выхода технологии на рынок представляет собой тот же вид ущерба. Ответчики почти наверняка заявят, что обязательства по безопасности служат общественным интересам и качественно отличаются от фиксации цен.
Дело особенно интересно с точки зрения времени. Оно появляется в ту же неделю, когда администрация Трампа демонстрирует недоверие к механизмам безопасности, создавая политическую среду, в которой истцы могут утверждать, что обязательства по безопасности служат прикрытием для устоявшихся игроков, защищающих свои рыночные позиции. Независимо от того, выиграют ли истцы в суде, иск уже создал коммерческий и репутационный риск для любых будущих межотраслевых обязательств по безопасности.
Лаборатории ИИ предупреждают, что модели с рекурсивным самосовершенствованием близки
Anthropric, OpenAI и xAI на этой неделе заявили — в различных публичных заявлениях и интервью с исследователями — что возможность систем ИИ к рекурсивному самосовершенствованию уже не является отдалённым теоретическим сценарием. Рекурсивное самосовершенствование означает модель, способную автономно изменять собственную архитектуру, процесс обучения или то и другое, а затем использовать улучшенную версию себя для проектирования следующей итерации — петля обратной связи, которая теоретически может ускорить прирост возможностей далеко за пределы того, что человеческие инженеры могут достичь самостоятельно.
Подробность, привлёкшая наибольшее внимание: Anthropic сообщила, что Claude уже вносит вклад более чем в четверть внутренних исследований ИИ компании. Этот показатель пока не является рекурсивным самосовершенствованием в полном смысле — люди по-прежнему направляют и проверяют работу, — однако наглядно показывает, как быстро стирается граница между инструментом и соавтором.
Сама готовность лабораторий говорить об этом публично примечательна. Год назад большинство исследователей тщательно избегали конкретных прогнозов относительно сроков появления сверхинтеллекта. Обозначение близкосрочной перспективы рекурсивного самосовершенствования — даже без конкретных дат — обостряет срочность вопросов, с которыми правительства, исследователи безопасности и суды только начинают разбираться: кто решает, когда самосовершенствующаяся система безопасна для работы без надзора, и есть ли у кого-либо реальные полномочия остановить её?
Microsoft публикует «Гуманистическую конституцию ИИ», ставящую контроль человека на первое место
Генеральный директор Microsoft Мустафа Сулейман опубликовал проект конституции ИИ — официально озаглавленный «Гуманистический кодекс поведения ИИ» — и открыл его для шести недель общественного обсуждения. Центральный принцип документа состоит в том, что право человека на вмешательство должно иметь приоритет над выполнением задач и автономией модели. На практике это означает, что продукты Microsoft с ИИ должны быть спроектированы так, чтобы человек всегда мог прервать, перенаправить или остановить любое действие ИИ, а система должна активно способствовать этому, а не препятствовать.
Такая формулировка намеренна. Сулейман, который был сооснователем DeepMind до прихода в Microsoft, последовательно отстаивает тезис о том, что управляемость и коммерческая полезность не противоречат друг другу, — что корпоративные покупатели, в частности, готовы платить надбавку за системы, которыми они реально могут управлять. Период общественного обсуждения — отчасти подлинная консультация, отчасти сигнал для закупщиков: Microsoft сообщает корпоративным и государственным клиентам, что архитектура безопасности встроена в продукт, а не прикручена постфактум.
Публикация документа также выполняет регуляторную функцию. В условиях, когда Закон ЕС об ИИ вступает в полную силу и различные национальные правительства разрабатывают собственные механизмы ответственности в сфере ИИ, публикация подробного кодекса поведения с документированным следом общественного обсуждения даёт Microsoft материал, на который она может ссылаться как на доказательство ответственной разработки. Выдержат ли принципы кодекса столкновение с реальными решениями по продуктовой дорожной карте — покажет время.
Anthropic подтверждает попытки создания биологического оружия в первом отраслевом докладе по разведке угроз
Anthropric опубликовала то, что, по её словам, является первым публичным докладом по разведке угроз от крупной лаборатории ИИ, в котором задокументированы семь категорий злоупотреблений, обнаруженных и пресечённых её командами по безопасности. Наиболее значимое раскрытие: подтверждённые попытки пользователей извлечь информацию, пригодную для разработки биологического оружия. Anthropic сообщает, что эти попытки были заблокированы, а результаты переданы в компетентные органы.
Остальные шесть категорий включают скоординированные кибероперации с использованием Claude в качестве помощника, кампании влияния, направленные на масштабное создание и распространение дезинформации, финансовое мошенничество и скам-инфраструктуру, а также несколько менее значимых категорий. В каждом случае доклад описывает тип злоупотребления без указания конкретных субъектов или операций.
Решение опубликовать доклад — и прямо упомянуть попытки создания биологического оружия, а не описывать их обтекаемо как «вредоносный контент» — отражает расчёт на то, что прозрачность служит отрасли лучше, чем молчание. Исследователи безопасности за пределами Anthropic давно утверждают, что неспособность отрасли делиться разведданными об угрозах является проблемой коллективного действия: каждая лаборатория знает, какие атаки на неё направлены, но без обмена информацией все летят вслепую. Этот доклад, если он побудит к взаимным раскрытиям со стороны OpenAI, Google DeepMind и других, может ознаменовать начало чего-то вроде общей экосистемы разведки угроз для ИИ.
Доклад также повышает ставки в дискуссиях о регулировании, происходящих повсюду на этой неделе. Если системы ИИ, способные помочь в разработке биологического оружия, уже испытываются на практике, вопрос о том, являются ли обязательства по безопасности законными мерами в общественных интересах или антиконкурентным прикрытием, становится значительно менее абстрактным.
В совокупности события этой недели описывают отрасль, которая одновременно становится более мощной, более оспариваемой и более прозрачной в отношении собственных рисков. Политическая среда в США смещается в сторону скорости; правовая среда становится непредсказуемой; технологическая граница движется быстрее, чем предполагают большинство предложений по управлению; а ландшафт угроз уже включает сценарии, которые ещё недавно рассматривались как гипотетические. Ничто из этого не разрешается аккуратно. Но тот факт, что лаборатории теперь публикуют разведданные об угрозах, что суды применяют антимонопольную теорию к обязательствам по безопасности, а правительства создают специализированные ИИ-бюрократии, — всё это говорит о том, что эпоха развития ИИ преимущественно в тени завершилась.