Волна освещения событий по обе стороны Атлантики привела к серьезному беспокойству, которое регуляторы высказывают уже два года: когда люди задают чат-ботам с искусственным интеллектом вопросы о своих деньгах, ответы чаще неправильные, чем правильные. По данным Financial Times, недавнее исследование в Великобритании показало, что чат-боты с искусственным интеллектом «большую часть времени» дают неверные ответы на финансовые вопросы.
Чтобы узнать последние новости и анализ искусственного интеллекта, посетите AI Buzz Wire.
Что обнаружили исследования
Основная цифра взята из торгового издания Financial Reporter, которое ранее в сентябре сообщило, что модели ИИ дают неверные финансовые советы в 57% случаев, ссылаясь на исследование Saturn. IBS Intelligence сообщила о том же уровне ошибок в 57%. В репортаже Yahoo Finance описывалось исследование, связанное с британской пенсионной платформой PensionBee, а BeInCrypto сообщила, что тест охватывал около 10 000 ответов. Различия в первоначальном освещении позволяют предположить, что в исследовании участвовало несколько сторон; последовательная нить между торговыми точками — это масштаб частоты отказов.
Ошибки не абстрактны. Mortgage Professional America привела один пример из репортажа: чат-бот сообщил ипотечному заемщику, что предоставление платежных каникул не повлияет на его кредитный рейтинг. Может, и для семьи, принимающей важное финансовое решение по этому ответу, такое различие обходится дорого.
К этой неделе эта история стала мейнстримом. InvestmentNews сообщил под заголовком «Чат-боты с искусственным интеллектом большую часть времени дают неправильные финансовые ответы, как показало исследование», а Tom's Guide предупредил читателей, что ИИ может стоить им денег, основываясь на результатах исследования.
Шаблон, а не выброс
Выводы Великобритании дополняют растущую серию исследований с аналогичными выводами. Предыдущий анализ, широко освещавшийся в марте, показал, что ChatGPT давал неправильные ответы на вопросы о деньгах примерно в 35% случаев. В августе сообщалось, что исследователи из Стэнфорда и Массачусетского технологического института обнаружили, что ИИ дает женщинам худшие инвестиционные советы, чем мужчинам. Сама Financial Times сообщила в августе, что почти половина молодых британцев ошибочно полагают, что финансовые консультации ИИ регулируются — разрыв в восприятии, который делает неточные ответы более опасными, а не менее опасными.
И использование продолжает расти, несмотря ни на что. Отчет NerdWallet за полугодие показал, что американцы уже используют чат-ботов для получения финансовых консультаций в значительном количестве, и именно поэтому результаты точности привлекают внимание защитников прав потребителей, а не отбрасываются как академические пустяки.
Почему финансовые вопросы ломают работу чат-ботов
Финансовые консультации находятся на стыке всего, что для больших языковых моделей является самым трудным. Правильные ответы зависят от действующих правил, специфичных для конкретной юрисдикции — налоговых порогов, механизмов кредитного рейтинга, пенсионных правил — которые меняются и различаются в зависимости от страны. Модели также имеют тенденцию хеджировать уверенно звучащими обобщениями, и пользователи часто не предоставляют личный контекст (доход, существующие долги, цели), который определяет, применимы ли к ним общие рекомендации.
Существует также проблема асимметрии, уникальная для денег: неправильный ответ о стихотворении вызывает неловкость, но неправильный ответ о влиянии платежных каникул на кредит может усугубиться реальным финансовым ущербом, обнаруженным несколько месяцев спустя.
Что регулирующие органы и пользователи должны извлечь из этого
Регулирующие органы Великобритании предупреждают потребителей о нерегулируемых финансовых рекомендациях по ИИ, по крайней мере, с конца 2025 года, когда The Guardian сообщила об официальных предупреждениях по поводу чат-ботов, дающих неточные финансовые советы. Новое исследование дает этим предупреждениям конкретный процент неудач. Разумное прочтение заключается не в том, что ИИ бесполезен для личных финансов (модели могут хорошо объяснять концепции), а в том, что грань между образованием и советами остается размытой для пользователей и четкой только в сводах правил регулирующих органов.
До тех пор, пока точность чат-ботов в финансовых вопросах, специфичных для конкретной предметной области, резко не улучшится, практическое руководство из исследования будет простым: рассматривайте ответы ИИ о деньгах как отправную точку для исследования, а не как само решение, и проверяйте все, что имеет важное значение — кредитные последствия, налоговый режим, пенсионные правила — против регулируемых источников, прежде чем действовать.
Будьте впереди ИИ
Чтобы постоянно освещать самые важные события в индустрии искусственного интеллекта, добавьте в закладки AI Buzz Wire и никогда не пропустите самые важные новости.
Читать больше новостей об искусственном интеллекте