💸 🧮 ИИ всё ещё плохо считает деньги
Исследование Saturn проверило популярные чат-боты на финансовых задачах — результат отрезвляющий. В среднем модели ошибались в 57% случаев, на сложных расчётах — в 88%.
Даже лучший результат у Claude Opus 5 в режиме рассуждений: 39% неверных ответов — почти каждая третья финансовая задача решается неправильно.
Особенно тревожно, что это не абстрактные тесты: в одном из кейсов совет модели мог обернуться налоговым штрафом на 17 500. Доверять ИИ расчёты налогов, бюджета или инвестиций пока рано — перепроверяй вручную.