研究:AI 在處理複雜財務任務時錯誤率高達 88%
科技公司 Saturn 的研究顯示,ChatGPT、Claude、Copilot、Grok 及 Gemini 等主流 AI 模型在處理財務查詢時,平均錯誤率達 57%。在涉及多重計算的複雜任務中,錯誤率飆升至 88%,部分模型甚至高達 99%。表現最佳的 Claude Opus 5 在推理模式下仍有 39% 的錯誤率。研究指出,AI 提供的錯誤建議可能導致嚴重的財務損失,例如稅務罰款。
摘要由 AI 依據原文撰寫,並非投資建議。
科技公司 Saturn 的研究顯示,ChatGPT、Claude、Copilot、Grok 及 Gemini 等主流 AI 模型在處理財務查詢時,平均錯誤率達 57%。在涉及多重計算的複雜任務中,錯誤率飆升至 88%,部分模型甚至高達 99%。表現最佳的 Claude Opus 5 在推理模式下仍有 39% 的錯誤率。研究指出,AI 提供的錯誤建議可能導致嚴重的財務損失,例如稅務罰款。
摘要由 AI 依據原文撰寫,並非投資建議。