Написать в блог
Блоги
Блогер

Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта

Уровень неверных ответов на простые вопросы составляет 57%
реклама

Издание Financial Times со ссылкой на исследование технологической компании Saturn сообщает, что популярные ИИ-модели ChatGPT, Claude, Copilot, Grok и Gemini в среднем дают 57% неправильных ответов на финансовые вопросы. Если вопрос более сложный и требует проведения нескольких расчётов, количество ошибок растёт до 88%, а в худшем случае модели ошибаются в 99% случаев.

Специалисты задали свыше 100 вопросов бесплатным и платным вариантам моделей, повторив каждый вопрос пять раз. В сумме 18 моделей получили более 10 000 вопросов.

Изображение: Gemini

реклама

Модели выдавали ошибки в расчётах, не принимали во внимание будущие изменения налогового законодательства или использовали нормы, которые в реальности не существуют. Использование подобных ответов людьми может привести к финансовым потерям.

Платные модели давали более точные ответы по сравнению с бесплатными, а новые версии справлялись лучше старых. Лидером является модель Claude Opus 5 в режиме рассуждений, которая выдала ошибки в 39% случаев.

Проведённое в 2026 году в России исследование показало, что 37% потребителей при покупках онлайн делают выбор без помощи искусственного интеллекта. 65% покупателей принимают во внимание рекомендации ИИ.

Источник: internet.cnews.ru
Теперь в новом формате

Наш Telegram-канал @overclockers_news
Подписывайся, чтобы быть в курсе всех новостей!

Популярные новости