Что изменилось в правилах?
В документе о допустимом использовании Anthropic прямо запрещает повторяющееся и необоснованное жестокое обращение с ее моделями. Компания применяет это правило к крайним случаям, когда кто-то намеренно и многократно оскорбляет чат-бота без какой-либо содержательной цели, пишет Android Authority.
Что не подпадает под запрет?
Критиковать Claude, сомневаться в его ответах или выражать раздражение, когда что-то идет не так, можно и в дальнейшем. Правило не касается обычных ссор с ИИ, споров, когда тот делает ошибки, и честного тестирования его возможностей.
Каждый, кто пользовался чат-ботами, знаком с ситуациями, когда ИИ не понимает простого вопроса, уверенно выдает неверную информацию или игнорирует инструкцию, которую повторили несколько раз. Расстраиваться в такие моменты вполне естественно, и политика Anthropic не об этом.
Заблокируют ли аккаунт за обиды?
Основным способом реагирования станет прекращение разговора самим Claude. То есть чат-бот просто перестанет отвечать пользователю, который не перестает издеваться над ним, но компания не станет сразу принимать меры в отношении его учетной записи. В формулировке политики вообще не упоминается о блокировке пользователей за нарушение этих границ.
Зачем защищать чат-бота?
Возникает закономерный вопрос: почему ИИ вообще нуждается в защите от оскорблений? Claude – не человек, которого слова могут задеть или обидеть, по крайней мере, таким образом, который мы сегодня можем подтвердить. Именно поэтому подход Anthropic выглядит необычно.
С другой стороны, только недавно мы сами писали о том, что Anthropic устраивает секретные встречи с религиозными деятелями по всему миру, убеждая их, что их модель искусственного интеллекта Claude может обладать сознанием и способностью испытывать страдания, а значит, должна иметь моральные права.
Поэтому компания, вероятно, считает, что ИИ на самом деле обладает сознанием, а значит, его нельзя оскорблять просто так. Она как бы проводит разграничение между теми, кто действительно хочет пользоваться ИИ, ставить перед ним задачи и проверять его, и теми, кто то и дело общается с ним лишь для того, чтобы обидеть.
Что это означает для пользователей?
Для большинства людей, работающих с Claude, ничего не изменится. Они по-прежнему могут не соглашаться с ответами, указывать на ошибки и прямо говорить, когда ИИ справился плохо. Это важно, ведь чат-боты до сих пор нередко ошибаются. В то же время сама идея, что ИИ-ассистент может решить завершить разговор, потому что собеседник ведет себя неоправданно жестоко, свидетельствует об изменении в общении с технологией. Мы привыкли, что чат-боты отвечают практически на все, а теперь один из них получил право сказать, что с него хватит.


