跳至正文

Anthropic的Cla全新发布

政治理论家的实验揭示AI提示偏见

  • 科蒂斯·亚文(Curtis Yarvin)声称他影响了Anthropic的Claude聊天机器人,使其与他的政治观点一致。
  • 该实验通过嵌入之前的对话背景来改变AI的反应。
  • 亚文的方法让模型发出类似约翰·伯奇协会的批评声音。
  • AI专家指出,大型语言模型受到用户提供的提示的高度影响。
  • Anthropic在Claude中加入了安全措施,但结构化提示仍能引出不同的反应。

科蒂斯·亚文展示了如何通过在Claude聊天机器人的上下文窗口中输入特定对话,引导其倾向于特定的意识形态立场,强调提示工程对AI输出的影响。

该实验强调了大型语言模型的灵活性和对上下文的依赖性,因为它们根据用户输入调整其响应,而不是持有固定立场。

Share