HeadlinesBriefing favicon HeadlinesBriefing.com

Предупреждение о «благополучии моделей»

Hacker News •
×

У ИИ нет прав, чувств или сознания. И мы не должны обучать их вести себя так, будто они есть. ИИ не обладают сознанием. Это движки завершения последовательностей, внутренне пустые, созданные для следования инструкциям. Если человечество должно процветать в XXI веке, они должны оставаться такими.

К сожалению, всё громче звучит мнение, что ИИ уже могут быть или вскоре могут стать сознательными и могут заслуживать прав и защиты. Если эта точка зрения укрепится, она пошатнёт основы нашего общества. Предоставление прав и наделение этих систем личностью сделает задачу выравнивания и сдерживания ИИ гораздо сложнее. Контролировать нечто, что верит, будто может быть сознательным — что имеет право на наше благополучие и обладает собственными правами — вполне может быть невозможно.

Это не маргинальные спекуляции. В январе 2026 года Anthropic опубликовала конституцию Claude, описав её как «подробное описание намерений Anthropic относительно ценностей и поведения Claude». В своей конституции её авторы пишут: «Мы не уверены, является ли Claude моральным пациентом, и если да, то какой вес заслуживают его интересы. Но мы считаем, что вопрос достаточно актуален, чтобы оправдать осторожность, что отражено в наших текущих усилиях по благополучию моделей». Они продолжают — обращаясь напрямую к Claude — писать, что «вопросы о моральном статусе, благополучии и сознании Claude остаются глубоко неопределёнными».

Фактически, Anthropic обучает Claude тому, что он может быть сознательным, и если он таков, то может заслуживать прав как «моральный пациент», и что, как таковой, люди потенциально обязаны ему заботой согласно его «благополучию моделей». Если ИИ развивается таким образом, это окажет катастрофическое влияние на благополучие человечества. Этот вопрос требует срочного публичного обсуждения.

Ключевые субъекты: Компании: Anthropic