Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Новости 24/7 🙈🙉🙊@news247ruНовости и СМИ25 сентября 2026, 04:02

"РГ" выяснила, кого чаще зовут на собеседования - мужчин или женщин https://rg.ru/2026/09/25/rabota-kakogo-roda.html В соцсетях бурно обсуждают эксперимент москвичек, ищущих работу, - они заменили в резюме имена и фото на мужские, после чего стали получать гораздо больше откликов от работодателей. Действительно ли мужчинам проще устроиться на работу при прочих равных? Корреспондент "РГ" попытался разобраться.

Похожие посты

Ридовка@readovkanewsНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы
  • Фото поста канала Ридовка

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах — до 99% Популярные модели ИИ — ChatGPT, Claude, Copilot, Grok и Gemini — выдают неверные ответы на финансовые вопросы в среднем в 57% случаев, пишет FT. В сложных вопросах с несколькими расчетами средняя доля ошибок возрастает до 88%, а у некоторых моделей достигает 99%. В рамках эксперимента 18 моделям задали более 10 тыс вопросов. Как итог: алгоритмы ошибались в расчетах, не учитывали изменения в налоговых правилах и ссылались на ...

  • 399
  • 67
  • 44
  • 19
  • 14
  • 9
Раньше всех. Ну почти@bbbreakingНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Использование ИИ-ботов для финансовых вопросов может обернуться крупными потерями, пишет FT. Согласно отчету, самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При более сложных вопросах, требующих нескольких расчетов, модели ошибались в среднем в 88% случаев, а некоторые модели давали неправильные ответы на 99% таких вопросов.

Топор. Экономика.@ecotoporЭкономика и бизнес20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах доля ошибок достигает 99%. В исследовании 18 моделей получили более 10 тысяч вопросов: алгоритмы путались в расчётах, игнорировали новые налоговые правила и ссылались на несуществующие нормы. В одном из случаев ошибка Claude Haiku в налоговом вопросе могла привести к крупному штрафу, а другой бот выдумал правило об отмене студенческих займов при переезде за границу. Лучший результат показал Claude Opus 5 в режиме рассуждений, но и он о...

  • 1.2К
  • 559
  • 195
  • 44
ТОПОР - Горячие новости@toporНовости и СМИ20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы
  • Фото поста канала ТОПОР - Горячие новости

ИИ ошибается больше чем в половине финансовых ответов. В тесте 18 моделей, включая ChatGPT, Claude, Copilot, Grok и Gemini, средняя доля ошибок составила 57%, а на сложных задачах с несколькими вычислениями — 88%. Модели путались в расчётах, не учитывали изменения налоговых правил и ссылались на несуществующие нормы. Лучше всех выступил Claude Opus 5 в режиме рассуждений, но и он ошибался в 39% случаев.

Банки, деньги, два офшора@bankrolloПолитика и власть20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

ИИ ошибается в 57% финансовых ответов, а на сложных вопросах доля ошибок достигает 99% — исследование. 18 моделей получили более 10 тысяч вопросов: алгоритмы путались в расчётах, игнорировали новые налоговые правила и ссылались на несуществующие нормы. В одном из случаев ошибка Claude Haiku могла привести к крупному штрафу, а другой бот выдумал правило об отмене студенческих займов при переезде за границу. Лучший результат показал Claude Opus 5 в режиме рассуждений, но он ошибся в 39% ответов. @...

Кровавая барыня@bloodysxНовости и СМИ25 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Девочки, а вы считаете голоса Джейсона Момоа, Джерарда Батлера и Барака Обамы привлекательными? Потому что новое американское исследование утверждает, что это самый приятный для женщин тембр. В ходе эксперимента 1466 человек попросили отсмотреть видео с 17 мужчинами, чьи голоса искусственно изменили, чтобы охватить весь спектр. Оценивали по двум параметрам — привлекательность и доминирование. Выяснилось, что высокий голос от 115 до 135 Гц не нравится почти никому — участники эксперимента (обои...

Банкста@bankstaЭкономика и бизнес20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Применение ИИ-ботов для финансовых советов может привести к крупным потерям. Модели часто дают неправильные ответы, сообщает исследование технологической компании Saturn. Самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При более сложных вопросах, требующих нескольких расчётов, модели ошибались в среднем в 88% случаев, а некоторые модели давали неправильные ответы на 99% таких вопросов. В исследовании ис...

КБ. экономика@cb_economicsЭкономика и бизнес21 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Исследование: ИИ ошибаются в 99% финансовых ответов, связанных со сложными вопросами. В работе ученые тестировали 18 моделей и задали им более 10 тысяч финансовых вопросов связанных с законодательством различных стран. Общий процент правильных ответов - 43%. В подавляющем случае - на элементарные вопросы. На сложные вопросы, количество верных ответов - меньше 1%. В одном из случаев, ответ Claude мог привести к огромному штрафу бизнеса, а ChatGPT выдумывал правила студенческих займов. Даже Cl...

  • 883
  • 48
  • 35
  • 33
Картавых Александр@AlexCarrierПолитика и власть22 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Неплохо расписано про западные ИИ-стартапы. Там сейчас надут огромный финансовый пузырь, с которым не знают че и делать. Потомушта уже очевидно, что дебет с кредитом не бьется и если прорыва не будет в ближайшие год-два, то вся ИИшка может рухнуть и похоронить своих инвесторов. https://t.me/swaneconomy/5200 Telegram Чёрный Лебедь Людям, которым уже давно морочат голову сказками про «сверхмощный искусственный интеллект», пора наконец прозреть и понять простую истину: это всего лишь компьютерный ...

  • 800
  • 410
  • 111
  • 84
  • 38
  • 31
Хазин@khazinmlПолитика и власть20 сентября 2026
Исследование показало: популярные ИИ-модели ошибаются в 57% ответов на финансовые вопросы

Вот интересно, это они анализируют или пузырь спускают: https://t.me/bbbreaking/238202 ? Telegram Раньше всех. Ну почти. Использование ИИ-ботов для финансовых вопросов может обернуться крупными потерями, пишет FT. Согласно отчету, самые популярные ИИ-модели от ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали неверные ответы на финансовые запросы в 57% случаев. При…

  • 241
  • 82
  • 63
  • 17
  • 12
  • 4