☰
︎

ИИ ошибается в 99% случаев при ответах на сложные финансовые вопросы

Уровень неверных ответов на простые вопросы составляет 57%
21 сентября 2026, понедельник 11:47
Блогер для раздела Блоги

Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта

Издание Financial Times со ссылкой на исследование технологической компании Saturn сообщает, что популярные ИИ-модели ChatGPT, Claude, Copilot, Grok и Gemini в среднем дают 57% неправильных ответов на финансовые вопросы. Если вопрос более сложный и требует проведения нескольких расчётов, количество ошибок растёт до 88%, а в худшем случае модели ошибаются в 99% случаев.

Специалисты задали свыше 100 вопросов бесплатным и платным вариантам моделей, повторив каждый вопрос пять раз. В сумме 18 моделей получили более 10 000 вопросов.

Изображение: Gemini

Модели выдавали ошибки в расчётах, не принимали во внимание будущие изменения налогового законодательства или использовали нормы, которые в реальности не существуют. Использование подобных ответов людьми может привести к финансовым потерям.

Платные модели давали более точные ответы по сравнению с бесплатными, а новые версии справлялись лучше старых. Лидером является модель Claude Opus 5 в режиме рассуждений, которая выдала ошибки в 39% случаев.

Проведённое в 2026 году в России исследование показало, что 37% потребителей при покупках онлайн делают выбор без помощи искусственного интеллекта. 65% покупателей принимают во внимание рекомендации ИИ.