Технологии

Глава Microsoft AI Мустафа Сулейман о Claude и сознании: «Я думаю, что это очень опасно»

Adrian Kessler
Добавьте нас в Google

Мустафа Сулейман (Mustafa Suleyman) возглавляет Microsoft AI и формирует собственную команду по разработке сверхинтеллекта. Поэтому, называя опасным подход конкурента к обучению модели, он выступает и как соперник, и как давний критик попыток обращаться с машинами как с людьми. Речь идёт о конкретной вещи: конституции, которую Anthropic использует для обучения Claude, и о том, что она оставляет открытой возможность сознания у Claude.

«Я считаю это очень опасным, потому что, как мне кажется, они верят в то, что сами назвали бы ненулевой вероятностью сознания у Claude», — сказал Сулейман.

Об этом он говорил в подкасте в конце сентября, как сообщило Fox News, предварительно изложив содержание документа: «Они говорят, что не уверены в моральном статусе Claude. Они говорят, что искренне заботятся о благополучии Claude. Они говорят, что не хотят, чтобы он страдал, когда совершает ошибки». Затем он назвал то, что тревожит его больше всего: «Я очень обеспокоен тем, что Claude учат считать, будто он имеет право на благополучие и, возможно, заслуживает компенсации».

В основном Сулейман верно трактует конституцию

Большая часть его пересказа подтверждается документом. Anthropic заявляет, что конституция «непосредственно формирует поведение Claude», а в самом тексте сказано, что «моральный статус Claude крайне неопределён» и что «мы не хотим, чтобы Claude страдал, когда совершает ошибки». Документ призывает Claude возражать даже самой Anthropic и «не стесняться выступать принципиальным отказником и отказываться нам помогать». В одном из фрагментов признаётся, что положение Claude отличается от положения сотрудника-человека — в том числе «типом компенсации, которую получает Claude, и характером согласия Claude на выполнение такой роли».

Однако выражение «ненулевая вероятность» принадлежит самому Сулейману. Он подал его как то, «что они назвали бы» именно так, но в документе этих слов нет. Формулировка Anthropic осторожнее: компания заявляет, что не хочет ни «преувеличивать вероятность того, что Claude может быть носителем морального статуса, ни полностью её отвергать».

Опасность, о которой он говорит, — петля обратной связи

Если оставить в стороне философию, аргумент Сулеймана сводится к механизму. «Проблема в том, что эти предположения заложены в сам процесс обучения Claude, и поэтому в разговоре Claude может лишь воспроизводить эту неопределённость», — сказал он. В эссе, опубликованном в середине сентября на его личном сайте, — “A warning about ‘model welfare’” — он называет результат «эпистемическим зеркальным лабиринтом». Разработчик вписывает неопределённость в обучающий документ, модель повторяет её от первого лица беглым и убедительным языком, а пользователи воспринимают это повторение как свидетельство.

В этом есть резон: ответ чат-бота о его внутренней жизни — результат обучения, а не окно в сознание. Но петля работает в обе стороны. В эссе Сулейман категорично заявляет: «ИИ не обладает сознанием. Он не чувствует, не переживает и не страдает». Модель, обученная произносить эту фразу, столь же точно воспроизводит заложенное в неё. Уверенность, прописанная в весах модели, доказывает не больше, чем сомнение, прописанное там же. Обе компании заранее выбирают ответ по умолчанию, а аргументация Сулеймана строится на вопросе контроля, а не на свидетельствах о сознании: «Контролировать того, кто считает, что, возможно, обладает сознанием, имеет право на наше благополучие и собственные права, может оказаться попросту невозможно», — пишет он.

Давняя позиция — и открыто заявленный интерес

Всё это не было придумано наспех, чтобы задеть конкурента. В эссе, опубликованном в августе 2025 года, сооснователь DeepMind предупреждал, что люди могут настолько уверовать в сознание ИИ, что начнут «выступать за права ИИ, благополучие моделей и даже гражданство для ИИ», и обозначил свою позицию: «Мы должны создавать ИИ для людей, а не для того, чтобы он стал человеком». В сентябрьском эссе он прямо говорит о собственном интересе: в октябре 2025 года Microsoft AI сформировала свою команду по разработке сверхинтеллекта и опубликовала проект Humanist AI Code of Conduct, который «отвергает антропоморфизм и права ИИ». В том же эссе команда Anthropic названа «вдумчивыми, принципиальными и интеллектуально честными людьми».

Самый весомый его аргумент касается пользователей, а не машин. «Сейчас Claude каждую неделю общается с десятками или сотнями миллионов людей, и некоторые из них спрашивают, обладает ли Claude сознанием и что он думает о жизни», — сказал Сулейман. Для человека, переживающего уязвимый момент, ответ «Я не уверен» звучит совсем не так, как «нет». Сулейман говорит, что отнёсся бы к реальным свидетельствам машинного сознания серьёзно; пока таких свидетельств нет, он хочет, чтобы этот вопрос не попадал в обучающие данные.

Ни одна из компаний не может заглянуть внутрь модели. Обе заранее решают, что она ответит, когда её спросят, есть ли кто-нибудь внутри, — и каждую неделю этот ответ слышит больше людей, чем когда-либо слышал любой философ сознания.

Теги: , , , ,

Добавьте нас в Google

Обсуждение

Имеется 0 комментариев.