Estudo aponta que IAs falham em 88% de tarefas financeiras complexas
Uma pesquisa da empresa de tecnologia Saturn revelou que modelos de IA como ChatGPT, Claude, Copilot, Grok e Gemini apresentaram erros em 57% das consultas financeiras em média. Em tarefas complexas que exigem múltiplos cálculos, a taxa de erro subiu para 88%, chegando a 99% em alguns modelos. O Claude Opus 5 obteve o melhor desempenho, ainda assim com 39% de falhas. Em um dos testes, uma recomendação incorreta poderia resultar em uma multa fiscal de £ 17.500.
Os resumos são escritos por IA a partir do artigo original. Não é recomendação de investimento.