Хвиля висвітлення по обидва боки Атлантики поставила серйозну цифру на занепокоєння, яке регулятори висловлювали протягом двох років: коли люди задають чат-ботам штучного інтелекту запитання про їхні гроші, відповіді частіше неправильні, ніж правильні. За даними Financial Times, нещодавнє дослідження у Великій Британії показало, що чат-боти ШІ дають неправильні відповіді на фінансові запити «більшу частину часу».
Щоб переглянути останні новини та аналіз ШІ, відвідайте AI Buzz Wire.
Що виявили дослідження
Цю заголовну цифру оприлюднило спеціальне видання Financial Reporter, яке раніше у вересні повідомило, що моделі AI дають неправильні фінансові поради в 57% випадків, посилаючись на дослідження Saturn. IBS Intelligence повідомила про той самий рівень помилок у 57%. Yahoo Finance описує дослідження у зв’язку з британською пенсійною платформою PensionBee, тоді як BeInCrypto повідомляє, що тест охоплював приблизно 10 000 відповідей. Різні атрибуції в початковому висвітленні свідчать про те, що дослідження бере участь кілька сторін; послідовний потік між торговими точками є масштабом частоти відмов.
Помилки не абстрактні. Mortgage Professional America навела один приклад із висвітлення: чат-бот повідомив іпотечному позичальнику, що відпустка не вплине на його кредитний рейтинг. Може — і для домогосподарства, яке приймає важливе фінансове рішення щодо цієї відповіді, ця різниця коштує дорого.
До цього тижня ця історія потрапила в мейнстрім. InvestmentNews повідомляв під заголовком «Чат-боти штучного інтелекту найчастіше дають неправильні фінансові відповіді, результати дослідження», а Tom's Guide попередив читачів, що ШІ може коштувати їм грошей, виходячи з результатів дослідження.
Зразок, а не викид
Висновки, отримані у Великій Британії, перевершують низку досліджень із подібними висновками. Попередній аналіз, який широко висвітлювався в березні, показав, що ChatGPT давав неправильні відповіді на питання про гроші приблизно в 35% випадків. У серпні дослідники Стенфордського університету та Массачусетського технологічного інституту виявили, що штучний інтелект надає гірші інвестиційні поради жінкам, ніж чоловікам. Сама Financial Times повідомила в серпні, що майже половина молодих британців помилково вірять, що фінансові консультації штучного інтелекту регулюються — прогалина у сприйнятті робить неточні відповіді не менш небезпечними.
І використання продовжує зростати незалежно від цього. Звіт NerdWallet за середину року показав, що американці вже використовують чат-ботів для фінансових консультацій у значній кількості, саме тому результати точності привертають увагу захисників прав споживачів, а не залишаються в архіві як академічні дрібниці.
Чому фінансові питання руйнують роботу чат-ботів
Фінансові поради знаходяться на перетині всього, що найважче знайти великим мовним моделям. Правильні відповіді залежать від чинних правил юрисдикції — податкових порогів, механізмів кредитного рейтингу, пенсійного законодавства — які змінюються та відрізняються залежно від країни. Моделі також мають тенденцію захищатися загальними словами, що звучать впевнено, і користувачі часто не надають особистий контекст (дохід, наявні борги, цілі), який визначає, чи загальні вказівки застосовуються до них.
Існує також проблема асиметрії, унікальна для грошей: неправильна відповідь про вірш викликає збентеження, але неправильна відповідь про вплив відпустки на кредит може призвести до реальної фінансової шкоди, яка буде виявлена через кілька місяців.
Що з цього мають взяти регулятори та користувачі
Регулятори Великої Британії попереджають споживачів про нерегульовані фінансові рекомендації щодо штучного інтелекту принаймні з кінця 2025 року, коли The Guardian опублікувала офіційні попередження щодо чат-ботів, які надають неточні фінансові поради. Нове дослідження дає цим попередженням конкретний рівень невдач. Розумне читання полягає не в тому, що штучний інтелект марний для особистих фінансів — моделі можуть добре пояснювати концепції, — а в тому, що межа між освітою та порадами залишається розмитою для користувачів і чіткою лише в збірниках правил регуляторів.
Поки точність чат-ботів щодо фінансових питань, пов’язаних із доменом, різко не покращиться, практичні рекомендації з охоплення дослідження є простими: сприймайте відповіді на гроші AI як відправну точку для дослідження, а не як саме рішення, і перевіряйте все, що випливає – кредитні наслідки, податковий режим, пенсійні правила – з регульованими джерелами, перш ніж діяти.
Будьте попереду ШІ
Щоб постійно висвітлювати найважливіші події індустрії штучного інтелекту, додайте закладку AI Buzz Wire і ніколи не пропускайте актуальну історію.
Читати більше новин AI