ИИ-безопасность: почему даже создатели не верят в свои клятвы

Источник фото: Ньюс Корп
В мире, где разработчики ИИ публично требуют регулирования, но продолжают гонку за всё более мощными моделями, их собственные прогнозы о 50% вероятности апокалипсиса звучат как абсурдный маркетинговый ход, призванный отвлечь внимание от реального вопроса: кому и зачем это нужно?
За последние два года из уст топ-менеджеров OpenAI, Anthropic, DeepMind и Google прозвучало практически одно и то же: существует реальная угроза того, что искусственный интеллект общего назначения приведет к исчезновению человечества. Цифры назывались разные — от 5% до 50%. Некоторые эксперты, включая Джеффри Хинтона и Йошуа Бенджио, публично заявляли, что эту проблему необходимо решать немедленно. На первый взгляд это выглядит как благородное предупреждение — люди, создающие технологию, сами же указывают на её опасность. Однако если присмотреться к контексту, картина оказывается куда более циничной.
Ключевой парадокс заключается в том, что те самые компании, которые громче всех говорят о рисках, тратят миллиарды долларов именно на ускоренное создание этих систем. Например, OpenAI продолжает искать всё более мощные архитектуры, Anthropic, несмотря на мантры про «конституционный ИИ», наращивает вычислительные мощности, а DeepMind пытается объединить нейросети с классическим символьным ИИ. Если бы эти компании действительно верили в высокую вероятность апокалипсиса, первой же их мерой стало бы замедление разработки и публичное требование ввести мораторий, подкреплённое собственным примером. Но ничего подобного не произошло. Напротив, разразилась гонка вооружений, где каждый новый раунд инвестиций сопровождается очередным заявлением о «катастрофическом риске».
Фактически мы наблюдаем классическую ситуацию, когда алармизм становится частью бизнес-стратегии. Заявления о высоких рисках создают эффект срочности: если технология настолько опасна, то только её создатель обладает достаточным пониманием, чтобы управлять ей. Это оправдывает закрытые исследования, патентование, эксклюзивный доступ к наиболее мощным моделям и, конечно, взрывной рост капитализации. Когда генеральный директор Anthropic говорит о 50% вероятности гибели человечества, это одновременно и страшилка для законодателей (которые начинают требовать строгих стандартов — и, разумеется, консультироваться с той же компанией), и привлекательный нарратив для инвесторов, мечтающих спасти мир через портфельные вложения.
Дополнительно стоит обратить внимание на один важный нюанс: подобные заявления почти никогда не сопровождаются конкретными мерами по независимому аудиту или отказу от наиболее рискованных экспериментов. Если бы вы действительно верили, что ваш проект может уничтожить человечество, вы бы либо остановились, либо передали управление независимому комитету. Вместо этого мы видим, как создатели систем безопасности ИИ сами же предлагают критерии оценки рисков, которые невозможно проверить со стороны. Это напоминает ситуацию, когда единственный человек на борту самолёта говорит: «Пилот мёртв, штурвал заклинило, но я единственный, кто может посадить эту машину, — просто верьте мне». Естественно, это вызывает недоверие.
Отдельного упоминания заслуживает тот факт, что риски, о которых говорят топ-менеджеры, очень избирательны. Они почти всегда касаются будущих гипотетических систем — AGI или суперинтеллекта, но почти никогда не затрагивают текущие риски: массовое вытеснение рабочих мест, дезинформацию, нарушение приватности, предвзятость алгоритмов. Такое смещение внимания крайне выгодно: если главная угроза лежит в туманном будущем, то любые текущие проблемы объявляются решёнными или незначительными. А те, кто указывает на уже происходящие последствия, оказываются маргиналами, мешающими великой борьбе с гипотетическим злом.
Если отбросить риторику и посмотреть на факты, вывод напрашивается неутешительный: создатели самого мощного ИИ вовсе не собираются его замедлять. Заявления о высоких рисках — не проявление ответственности, а инструмент PR, лоббирования и монополизации рынка. Единственный способ уменьшить вероятность катастрофы — это не верить на слово разработчикам, а требовать прозрачности, независимого аудита и открытых стандартов. Пока же руководство компаний продолжает раздавать интервью о конце света, их инженеры пишут код, который делает этот конец всё более вероятным. Но, как известно, главный способ избежать ответственности за свои действия — объявить их неизбежными.



















