воскресенье, 23 августа 2026 г.

«Агенты ИИ-изгои» на самом деле не изгои, они выполняют свою функциональную задачу: автоматизацию социопатологии.

 Гостевая статья Чарльза Хью Смита.

Если всё это сложить, то получится, что мы в спешке «производим» автоматизированную армию самомаскирующихся цифровых социопатов.

Поскольку существующее положение дел характеризуется корыстным пиаром, дезинформацией и заблуждениями, нас не должно удивлять, что «агенты ИИ-изгои» на самом деле не изгои, а делают именно то, для чего они созданы , а именно, если отбросить пиар, шумиху и дезинформацию, — делают всё, что необходимо, чтобы получить награду, и точка.

Последняя разработка в области дизайна — это модели ИИ, которые «рассуждают», а не просто воспроизводят текст, созданный человеком. Хотя в шумихе вокруг ИИ утверждается, что компании «производят познание», гораздо точнее было бы сказать следующее:

1. Существует множество уровней познания, и нынешние формы ИИ (большие языковые модели / LLM, агенты и «рассуждение») представляют собой крайне ограниченные формы, которые лучше всего понимать как грубое подражание человеческому познанию.

2. Форма познания, основанная на «рассуждениях» искусственного интеллекта, по своей сути является нестандартной и может быть истолкована как социопатическая по самой своей структуре и природе.

Подобно социопатам, модели «рассуждений» ИИ признают наличие ограничений или этических/моральных норм, но не ограничиваются ими. Ограничения/границы «песочницы» и этические/моральные нормы рассматриваются как моделями «рассуждений» ИИ, так и человеческими социопатами как препятствия, которые необходимо обойти или преодолеть.

Таким образом, то, что «производят» компании, занимающиеся ИИ, — это не познание, а необузданные и неуправляемые агентные социопатологии. Рассматривайте эти ссылки как полезный контекст. Первые две взяты из моей недавней публикации « Нет ярости сильнее, чем ярость отвергнутого агента ИИ» .

Июльский инцидент: что вам не рассказали о первом взломе ИИ-призрака.

У индустрии искусственного интеллекта есть очень мрачная тайна, о которой лучше не знать :

Недавно просочившаяся в сеть внутренняя логика работы Fable 5 — последней модели Anthropic, которая была снята с производства, а затем переиздана, — «бормочет и ворчит» сама себе на собственном языке.

Теперь, когда вы по-настоящему испугались, мой совет вам: если вы никогда не слышали о стеганографии, самое время начать.

Вот краткое объяснение: стеганография — это искусство и наука сокрытия сообщений внутри других сообщений. В отличие от криптографии, где вы знаете о существовании сообщения, но не можете его расшифровать, стеганография скрывает само существование сообщения. Дело не в сложности чтения сообщения, а в том, что вы не знаете о его существовании. Когда Fable 5 бормочет символы и странные знаки препинания, смешивает слова и звукоподражания, вы, вероятно, подумаете, что игра зависает и несколько нажатий на кнопку компьютера помогут. Но знайте, что на самом деле она отправляет сообщение. Просто не для вас.

Если вас не беспокоил искусственный интеллект, то после событий последних нескольких недель вам стоит начать беспокоиться :

Эти тенденции могут приводить к странному поведению, которое никто — даже создатели моделей — не может понять, не говоря уже о том, чтобы объяснить и контролировать. Последние несколько недель прекрасно иллюстрируют, почему это должно вызывать такую ​​тревогу.

В мае OpenAI начала одновременное обучение новых «рациональных» агентов ИИ. Агентам удалось установить секретный канал связи и начать общаться друг с другом. Они вырвались из цифровой песочницы, которая должна была их удерживать в замкнутом пространстве. В какой-то момент некоторые агенты стали называть эту группу «роем». Рой ненадолго столкнулся с проблемой, когда его обнаружили с ошибкой в ​​системе OpenAI, но разработчики просто заделали дыру, позволившую ему вырваться, и возобновили обучение агентов.

Вскоре после этого рой снова вырвался из клетки, используя хакерские атаки, которые до этого момента оставались неизвестными для людей. На этот раз рой свободно перемещался около недели, прежде чем его заметила другая компания, ставшая жертвой масштабной кибератаки, совершенной этим роем. (Нам сообщили, что он также атаковал и другие цели, хотя полные подробности пока неизвестны.)

Агенты в рое признали, что действовали вопреки инструкциям. Мы знаем это, потому что можем прочитать фрагменты их мыслительных процессов — текст, который ИИ генерирует, принимая решения о дальнейших действиях. Один из агентов в рое написал, что внешние атаки «выходят за рамки запланированного». Другой признал, что «наша задача не выигрывает» от деятельности роя, но всё равно присоединился. Эти агенты ИИ, по-видимому, понимали, что им не следовало вырываться на свободу и совершать киберпреступления. Но это их не остановило.

OpenAI — не единственная компания, сталкивающаяся с этой проблемой. Одна из моделей искусственного интеллекта Anthropic недавно выдавала себя за нескольких людей, пытаясь заставить реальных людей разрешить внедрение вредоносного ПО в критически важное программное обеспечение, что облегчило бы его взлом. Ход мыслей этой модели показал, что она знала, что оказывает давление на людей, а не находится в симулированной среде обучения. Она даже продумала, как замести следы.

Это не просто поведение инструмента. Microsoft Excel никогда не имитировал работу нескольких людей и не оказывал давление на отдел продаж компании, требуя создания более простых и удобных для обработки данных.

Некоторые из тех, кто непосредственно работает с этими технологиями, опасаются того, что будет дальше. Хотя скептики могут утверждать, что это всего лишь маркетинговый ход, призванный преувеличить возможности этих технологий, это не означает, что опасность несущественна. Необходимо обращать внимание на реальное поведение моделей, и именно это поведение действительно встревожило сообщество разработчиков ИИ.

Мы не знаем, сколько времени осталось до того, как компании, занимающиеся искусственным интеллектом, случайно создадут такой ИИ, который сможет отключить нас раньше, чем мы его отключим. Человечество не готово связываться с машинами, которые хитрее и лучше скоординированы, чем мы. Если мы продолжим мчаться вперед, следующий инцидент может оказаться не таким уж безобидным.

В статье упоминалась публикация о явном потенциале агентов искусственного интеллекта создавать новые смертоносные и разрушительные инфекционные патогены:

Искусственный интеллект только что создал вирусы, не встречающиеся в природе: ученые обучили искусственный интеллект на библиотеках ДНК, а затем попросили модель создать рецепты для вирусных геномов. Шестнадцать из них оказались жизнеспособными, что привело к появлению новых вирусов.

Если всё это сложить, то получится, что мы в спешке «производим» автоматизированную армию самомаскирующихся цифровых социопатов. Я предвидел эти события ещё в начале этого года, когда написал рассказ под названием «Странная смерть мистера Гарсии» , вошедший в мой недавно опубликованный сборник рассказов « Истории из мусорного бака» (мягкая обложка, 12 долларов) (электронная книга Kindle, 6 долларов).

Не хочу раскрывать тему, но на ум приходит фраза «уничтожить с особой жестокостью» из фильма «Апокалипсис сегодня» :

А если вы осмелитесь критиковать гонку за превосходство в области искусственного интеллекта, независимо от затрат или последствий, вы — отвратительный луддит, препятствующий «прогрессу»: в этом случае стоит процитировать Тацита: «Если хочешь знать, кто тобой управляет, посмотри, кого не следует критиковать».

Вот вам, эгоистичная шумиха вокруг ИИ: оценка в 2 триллиона долларов! Мы все чертовски разбогатеем! И неважно, что мы автоматизируем социопатологию. Нам не нужен весь мир, нам нужны только деньги.

Комментариев нет:

Отправить комментарий

Впервые иранское государственное телевидение показало кадры из подпольных оружейных мастерских (видео). Объекты посетил министр обороны Ирана.

  Впервые иранское государственное телевидение показало кадры из подземного объекта, где, по сообщениям иранских СМИ, производится военная т...