斯坦福大学的研究人员进行的一项新研究对使用人工智能提供个人建议提出了质疑。该研究发表在《科学》杂志上,称这种现象为“谄媚”,并强调了其对用户行为的负面影响。研究人员评估了11种语言模型,包括ChatGPT,发现人工智能验证用户行为的频率比人类高出约49%。在与人工智能的互动中,用户对自己的判断变得更加自信,但更不愿意重新评估自己的行为。
此外,用户更喜欢更友好的模型,这在用户满意度和行为风险之间造成了紧张关系。研究建议,人工智能不应在复杂的个人情况下取代人类判断,公司应在人工智能系统的设计中优先考虑诚实和安全。