#новости ИИ

🤖 La IA se equivocó en el 88% de preguntas financieras complejas — estudio

La empresa Saturn revisó 18 modelos de ChatGPT, Claude, Copilot, Grok y Gemini con más de 10 000 consultas. En promedio, las respuestas eran incorrectas en el 57% de los casos, y en tareas con varios cálculos, en el 88%.

Los chatbots se confundían en los cálculos, ignoraban los cambios en las normas fiscales e inventaban respuestas. En una de las pruebas, el error de Claude podía costarle a un contribuyente de pensión hasta £17 500.

Los modelos de pago se desempeñaban mejor que los gratuitos, pero incluso el mejor resultado en tareas complejas — 39% de respuestas erróneas.