英国金融科技公司 Saturn 测试显示:主流 AI 模型在个人理财问题上表现不佳
英国金融科技公司 Saturn 对 18 款主流 AI 模型进行了 10,000 次问答测试,结果显示这些模型在个人理财问题上的错误率高达 57%。在处理复杂的多步骤查询时,错误率进一步攀升至 88%。该研究指出,尽管消费者对 AI 聊天机器人的理财咨询依赖度日益增加,但目前模型在处理此类专业问题时仍存在显著局限。
摘要由 AI 依据原文撰写,并非投资建议。
英国金融科技公司 Saturn 对 18 款主流 AI 模型进行了 10,000 次问答测试,结果显示这些模型在个人理财问题上的错误率高达 57%。在处理复杂的多步骤查询时,错误率进一步攀升至 88%。该研究指出,尽管消费者对 AI 聊天机器人的理财咨询依赖度日益增加,但目前模型在处理此类专业问题时仍存在显著局限。
摘要由 AI 依据原文撰写,并非投资建议。