Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Fox News Russia@Putin_tramp_mobilizaciya_migrantНовости и СМИ20 сентября 2026, 07:20

ИИ-боты дают неверные ответы на финансовые вопросы в 57% случаев, а в сложных расчётах ошибаются почти всегда. К такому выводу пришли авторы отчёта: самые популярные модели — ChatGPT, Claude, Copilot, Grok и Gemini — в среднем ошибались в 57% финансовых запросов. Там, где требовалось несколько расчётов подряд, доля ошибок подскочила до 88%. А отдельные модели выдавали неправильный ответ почти в 99% таких случаев. Вывод простой: доверять ИИ личные деньги пока рано. Fox News Russia - Подписаться

  • 78
  • 21
  • 13
  • 2
  • 2
  • 1

Похожие посты

Ридовка@readovkanewsНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы
  • Фото поста канала Ридовка

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах — до 99% Популярные модели ИИ — ChatGPT, Claude, Copilot, Grok и Gemini — выдают неверные ответы на финансовые вопросы в среднем в 57% случаев, пишет FT. В сложных вопросах с несколькими расчетами средняя доля ошибок возрастает до 88%, а у некоторых моделей достигает 99%. В рамках эксперимента 18 моделям задали более 10 тыс вопросов. Как итог: алгоритмы ошибались в расчетах, не учитывали изменения в налоговых правилах и ссылались на ...

  • 399
  • 67
  • 44
  • 19
  • 14
  • 9
Раньше всех. Ну почти@bbbreakingНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Использование ИИ-ботов для финансовых вопросов может обернуться крупными потерями, пишет FT. Согласно отчету, самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При более сложных вопросах, требующих нескольких расчетов, модели ошибались в среднем в 88% случаев, а некоторые модели давали неправильные ответы на 99% таких вопросов.

Топор. Экономика.@ecotoporЭкономика и бизнес20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах доля ошибок достигает 99%. В исследовании 18 моделей получили более 10 тысяч вопросов: алгоритмы путались в расчётах, игнорировали новые налоговые правила и ссылались на несуществующие нормы. В одном из случаев ошибка Claude Haiku в налоговом вопросе могла привести к крупному штрафу, а другой бот выдумал правило об отмене студенческих займов при переезде за границу. Лучший результат показал Claude Opus 5 в режиме рассуждений, но и он о...

  • 1.2К
  • 559
  • 195
  • 44
ТОПОР - Горячие новости@toporНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы
  • Фото поста канала ТОПОР - Горячие новости

ИИ ошибается больше чем в половине финансовых ответов. В тесте 18 моделей, включая ChatGPT, Claude, Copilot, Grok и Gemini, средняя доля ошибок составила 57%, а на сложных задачах с несколькими вычислениями — 88%. Модели путались в расчётах, не учитывали изменения налоговых правил и ссылались на несуществующие нормы. Лучше всех выступил Claude Opus 5 в режиме рассуждений, но и он ошибался в 39% случаев.

Банки, деньги, два офшора@bankrolloПолитика и власть20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах доля ошибок достигает 99% — исследование. 18 моделей получили более 10 тысяч вопросов: алгоритмы путались в расчётах, игнорировали новые налоговые правила и ссылались на несуществующие нормы. В одном из случаев ошибка Claude Haiku могла привести к крупному штрафу, а другой бот выдумал правило об отмене студенческих займов при переезде за границу. Лучший результат показал Claude Opus 5 в режиме рассуждений, но он ошибся в 39% ответов. @...

Банкста@bankstaЭкономика и бизнес20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Применение ИИ-ботов для финансовых советов может привести к крупным потерям. Модели часто дают неправильные ответы, сообщает исследование технологической компании Saturn. Самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При более сложных вопросах, требующих нескольких расчётов, модели ошибались в среднем в 88% случаев, а некоторые модели давали неправильные ответы на 99% таких вопросов. В исследовании ис...

КБ. экономика@cb_economicsЭкономика и бизнес21 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Исследование: ИИ ошибаются в 99% финансовых ответов, связанных со сложными вопросами. В работе ученые тестировали 18 моделей и задали им более 10 тысяч финансовых вопросов связанных с законодательством различных стран. Общий процент правильных ответов - 43%. В подавляющем случае - на элементарные вопросы. На сложные вопросы, количество верных ответов - меньше 1%. В одном из случаев, ответ Claude мог привести к огромному штрафу бизнеса, а ChatGPT выдумывал правила студенческих займов. Даже Cl...

  • 883
  • 48
  • 35
  • 33
Картавых Александр@AlexCarrierПолитика и власть22 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Неплохо расписано про западные ИИ-стартапы. Там сейчас надут огромный финансовый пузырь, с которым не знают че и делать. Потомушта уже очевидно, что дебет с кредитом не бьется и если прорыва не будет в ближайшие год-два, то вся ИИшка может рухнуть и похоронить своих инвесторов. https://t.me/swaneconomy/5200 Telegram Чёрный Лебедь Людям, которым уже давно морочат голову сказками про «сверхмощный искусственный интеллект», пора наконец прозреть и понять простую истину: это всего лишь компьютерный ...

  • 800
  • 410
  • 111
  • 84
  • 38
  • 31
Хазин@khazinmlПолитика и власть20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Вот интересно, это они анализируют или пузырь спускают: https://t.me/bbbreaking/238202 ? Telegram Раньше всех. Ну почти. Использование ИИ-ботов для финансовых вопросов может обернуться крупными потерями, пишет FT. Согласно отчету, самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При…

  • 241
  • 82
  • 63
  • 17
  • 12
  • 4
БРИКС Финансы@brics_financesФинансы и криптовалюты20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

ИИ ошибается в большинстве финансовых ответов В исследовании 18 моделей проверили более 10 тысяч вопросов. Алгоритмы путались в расчётах, не учитывали новые налоговые правила и ссылались на несуществующие нормы. На сложных задачах доля ошибок доходила до 99%. Одна из ошибок Claude Haiku в налоговом вопросе могла обернуться крупным штрафом. Другой бот выдумал правило, якобы отменяющее студенческие займы после переезда за границу. Лучший результат показал Claude Opus 5 в режиме рассуждений — но ...