調査:AI、複雑な金融タスクの88%で誤回答
テクノロジー企業Saturnの調査によると、ChatGPT、Claude、Copilot、Grok、Geminiなどの主要AIモデルは、金融関連の質問に対して平均57%の確率で誤った回答をした。特に計算を伴う複雑なタスクでは誤答率が88%に達し、一部のモデルでは99%に及んだ。最も性能が高かったClaude Opus 5でも39%の誤答率を記録した。
要約は原文をもとに AI が作成しました。投資助言ではありません。
テクノロジー企業Saturnの調査によると、ChatGPT、Claude、Copilot、Grok、Geminiなどの主要AIモデルは、金融関連の質問に対して平均57%の確率で誤った回答をした。特に計算を伴う複雑なタスクでは誤答率が88%に達し、一部のモデルでは99%に及んだ。最も性能が高かったClaude Opus 5でも39%の誤答率を記録した。
要約は原文をもとに AI が作成しました。投資助言ではありません。