CoinScoop汇集全球加密货币新闻

研究:AI 在处理复杂金融任务时错误率高达 88%

ForkLog ·

科技公司 Saturn 的研究显示,ChatGPT、Claude、Copilot、Grok 和 Gemini 等主流 AI 模型在处理金融查询时平均错误率为 57%。在涉及多重计算的复杂任务中,错误率飙升至 88%,部分模型甚至高达 99%。表现最佳的 Claude Opus 5 模型在推理模式下错误率仍为 39%。研究指出,AI 提供的错误建议可能导致用户面临巨额税务罚款。

  • #인공지능
  • #금융
  • #오류
  • #새턴

摘要由 AI 依据原文撰写,并非投资建议。

同一天的其他新闻