Больше нельзя ругать ИИ: Anthropic заблокирует пользователей за регулярные оскорбления нейросети
Американский разработчик обновляет правила использования ИИ, вводя ограничения на систематическое жестокое обращение с алгоритмами.
Компания Anthropic внесла изменения в условия использования своей нейросети Claude, введя запрет на систематическое и необоснованное оскорбительное или жестокое обращение с моделями искусственного интеллекта, передает Liter.kz со ссылкой на пресс-службу компании.
Представители компании пояснили, что мера затронет только крайние случаи, когда пользователи систематически и без явной цели проявляют агрессию в адрес чат-бота. Новое правило не распространяется на стандартные проявления недовольства, споры, творческие сценарии с мрачной тематикой, а также на техническое тестирование и научные исследования. Ранее компании уже тестировали функции, позволяющие моделям вроде Claude Opus прекращать диалоги, вызванная тематика которых провоцирует у алгоритма условный "стресс", — например, при запросах с деструктивным контентом или попытках получить инструкции по созданию оружия.
В компании прокомментировали цели нововведения и его рамки.
"Речь идет только о крайних случаях, когда пользователи неоднократно и без какой-либо явной цели ведут себя жестоко по отношению к моделям. Оно не распространяется на обычные проявления недовольства и несогласия со стороны пользователей, творческие произведения с мрачной тематикой, а также на тестирование моделей и проведение исследований", — прокомментировали в Anthropic.
Кроме того, правила категорически запрещают применение Claude для вмешательства в избирательные процессы, скрытого слежения за людьми и разработки вооружения. Параллельно с этическими ограничениями Anthropic готовится к выходу на биржу и предупреждает потенциальных инвесторов в проспекте IPO о технологических рисках, включая вероятность проявления моделями автономного поведения.
Читайте также:
Илон Маск предложил переименовать искусственный интеллект

