Нейросети допустили ошибки почти во всех сложных финансовых задачах
Популярные модели искусственного интеллекта допускают ошибки почти во всех сложных финансовых задачах. К такому выводу пришли исследователи, протестировавшие ChatGPT, Claude, Copilot, Gemini, Grok и другие системы.
Компания Saturn проверила работу нейросетей на более чем 100 финансовых вопросах. В среднем модели дали неверные ответы в 57% случаев, а при решении сложных задач уровень ошибок достиг 99%.
Исследователи выяснили, что ИИ нередко ошибается в расчетах, игнорирует изменения законодательства и даже придумывает нормы, которых не существует. Лучше всего нейросети справились с задачами по составлению бюджета. Об этом пишет «Коммерсант» со ссылкой на Financial Times.
«Миллионы людей доверяют моделям искусственного интеллекта в вопросах финансов, но они получают неправильные ответы, из-за которых могут потерять свои деньги», — сказал исполнительный директор Saturn Амаль Джоли.
Лучшую точность в исследовании показала модель Claude Opus 5 в режиме рассуждений.
🔥 БУХ.СОВЕТ 2027
XII Всероссийская бухгалтерская онлайн-конференция
Не пропустите главное событие декабря для бухгалтеров — 10–11 декабря 2026 года.
За два дня разберём все важные изменения 2027 года в учёте, налогах и работе бухгалтера. Вместо того, чтобы тратить недели на поиск информации о новых правилах — просто регистрируйтесь на бесплатный эфир.
Практикующие эксперты расскажут о реальных спорах, проверках и сложных вопросах учёта. Вы сможете задать им вопросы прямо во время эфира.



Вы не поверите, но однажды приехав на бывший адрес проживания, обнаружил немного непонятное, где эти д/сады и школы в момент проживания были "забиты" до упора, то в настоящий момент этот же показатель равен только (условно) где-то 2/3 от своего запол