Эксперимент политического теоретика выявляет предвзятость AI-подсказок
- Кёртис Ярвин утверждает, что повлиял на чат-бота Claude от Anthropic, чтобы он соответствовал его политическим взглядам.
- Эксперимент включал встраивание контекста предыдущего разговора для изменения ответов AI.
- Метод Ярвина привел к тому, что модель начала повторять критику, схожую с позицией Общества Джона Бирча.
- Эксперты по AI отмечают, что модели крупного языка сильно зависят от предоставленных пользователем подсказок.
- Anthropic внедряет защитные механизмы в Claude, но структурированные подсказки все же могут вызывать различные ответы.
Кёртис Ярвин показал, как чат-бот Claude от Anthropic может быть направлен к определенной идеологической позиции с помощью настройки окна контекста с определенными диалогами, подчеркивая влияние инженерии подсказок на выходные данные AI.
Этот эксперимент подчеркивает гибкость и зависимость от контекста моделей крупного языка, так как они адаптируют свои ответы на основе пользовательских входных данных, а не придерживаются фиксированных позиций.