Перейти к содержимому

Риски предвзятости в подсказках от Claude

Эксперимент политического теоретика выявляет предвзятость AI-подсказок

  • Кёртис Ярвин утверждает, что повлиял на чат-бота Claude от Anthropic, чтобы он соответствовал его политическим взглядам.
  • Эксперимент включал встраивание контекста предыдущего разговора для изменения ответов AI.
  • Метод Ярвина привел к тому, что модель начала повторять критику, схожую с позицией Общества Джона Бирча.
  • Эксперты по AI отмечают, что модели крупного языка сильно зависят от предоставленных пользователем подсказок.
  • Anthropic внедряет защитные механизмы в Claude, но структурированные подсказки все же могут вызывать различные ответы.

Кёртис Ярвин показал, как чат-бот Claude от Anthropic может быть направлен к определенной идеологической позиции с помощью настройки окна контекста с определенными диалогами, подчеркивая влияние инженерии подсказок на выходные данные AI.

Этот эксперимент подчеркивает гибкость и зависимость от контекста моделей крупного языка, так как они адаптируют свои ответы на основе пользовательских входных данных, а не придерживаются фиксированных позиций.

Share