Написать в блог
Блоги
kosmos_news

Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта

Популярные чат-боты ChatGPT, Claude, Copilot, Grok и Gemini в среднем дали неверные ответы на 57% финансовых запросов, выяснила технологическая компания Saturn.
реклама

Искусственный интеллект сейчас очень популярен среди многих людей, когда речь идет о финансовых консультациях. Согласно исследованию технологической компании Saturn, популярные модели ИИ, такие как ChatGPT, Claude, Copilot, Grok и Gemini, давали неверные ответы на финансовые вопросы в среднем в 57% случаев, сообщает Forklog со ссылкой на Financial Times.Изображение: нейросеть qwen

В более сложных вопросах, требующих свыше одного шага вычислений, модели ИИ допускали ошибки в среднем в 88% случаев. Некоторые модели даже давали неверные ответы в 99% таких сложных вопросов. Модель ИИ Claude Opus 5 показала лучшие результаты в режиме «Рассуждение», но даже она допускала ошибки в 39% ответов.

Для исследования более 100 различных вопросов на финансовые темы были заданы бесплатным и платным ИИ-моделям от таких поставщиков, как ChatGPT, Gemini, Claude и Copilot. Согласно результатам исследования, ответы ИИ содержали ошибки в расчетах, игнорировали предстоящие изменения в налоговом законодательстве или даже придумывали несуществующие правила.

реклама

В одном случае, когда Claude спросили о студенческих кредитах, он «придумал» правило, заявив, что выпускники университетов могут прекратить выплаты, если переедут за границу.

В худшем случае, полагаться на ответы ИИ на налоговые вопросы может привести к значительным финансовым потерям. Расследование выявило, что ошибка в налогообложении пенсий, допущенная моделью ИИ Claude Haiku 4.5 в Великобритании, могла привести к тому, что вкладчику пришлось бы заплатить 17 500 фунтов стерлингов в виде недоплаченных налогов.

Источник: forklog.com
Теперь в новом формате

Наш Telegram-канал @overclockers_news
Подписывайся, чтобы быть в курсе всех новостей!

Популярные новости