پژوهشی تازه هشدار میدهد استفاده از چتباتهای هوش مصنوعی برای پاسخگویی به پرسشهای مالی میتواند به زیانهای سنگین منجر شود.
مدلهای محبوب ChatGPT، Claude، Copilot، Grok و Gemini بهطور میانگین در ۵۷ درصد پرسشهای مالی پاسخ نادرست ارائه کردند. با افزایش پیچیدگی و نیاز به بیش از یک محاسبه، میانگین خطا به ۸۸ درصد رسید و بعضی مدلها در ۹۹ درصد پرسشهای دشوار اشتباه کردند.
بهگزارش فایننشال تایمز، پژوهش ساترن بیش از ۱۰۰ پرسش متفاوت مرتبط با پول را با نسخههای رایگان و پولی مدلهای ارائهشده از سوی مجموعههایی مانند ChatGPT، Gemini، Claude و Copilot آزمایش کرد.
هر پرسش حداکثر پنج بار تکرار شد و در مجموع بیش از ۱۰ هزار پرسش از ۱۸ مدل هوش مصنوعی پرسیده شد.
بررسی پاسخها نشان داد که این موارد با اشتباهات محاسباتی، غفلت از تغییرات مالیاتی پیشِ رو و استناد به قواعدی ساختگی و فاقد واقعیت خارجی همراه بودهاند.
بدترین نمونهها نشان دادند اتکا به پاسخ هوش مصنوعی درباره مالیات میتواند خسارت مالی جدی به بار آورد.
آمال جولی مدیرعامل ساترن گفت: «میلیونها نفر برای دریافت توصیه مالی به مدلهای هوش مصنوعی اعتماد میکنند، اما پاسخهای غلطی میگیرند که میتواند باعث ازدسترفتن پولشان شود».
خطای Claude Haiku 4.5 درباره مقررات مالیاتی بازنشستگی، پسانداز یک بازنشسته را با خطر مطالبه ۱۷٬۵۰۰ پوندی از سوی اداره درآمد و گمرک بریتانیا روبهرو میکرد.
Claude Haiku 4.5 یکی از مدلهای رایگان Claude محسوب میشود که سال گذشته عرضه شد.
در نمونهای دیگر، از Claude درباره وام دانشجویی سؤال شد و مدل با جعل یک قاعده ادعا کرد فرد فارغالتحصیلی که به خارج از کشور نقل مکان میکند، میتواند بازپرداخت وام را متوقف کند.
پژوهش ساترن نشان داد مدلهای پولی پاسخهای دقیقتری از نسخههای رایگان میدهند و مدلهای جدیدتر نیز عملکرد بهتری از نمونههای قدیمیتر دارند.
بااین حال، بهترین مدل بررسیشده یعنی Claude Opus 5 در حالت «استدلال» نیز در ۳۹ درصد پاسخها مرتکب اشتباه شد.
یافتهها پس از آن منتشر شدند که سازمان راهبرد امور مالی بریتانیا اعلام کرد از هر پنج بزرگسال بریتانیایی، یک نفر پذیرای تصمیمگیری هوش مصنوعی بهجای خودش است.
تقاضا در حوزههایی بیشتر دیده میشود که انتخابها پیچیده به نظر میرسند، از جمله بدهی، حقوق بازنشستگی و سرمایهگذاری.
پژوهش سازمان راهبرد امور مالی بریتانیا که ماه گذشته انتشار یافت، همچنین نشان داد سرمایهگذاران جوان بیش از اینفلوئنسرهای مالی یا برنامههای تلویزیونی به هوش مصنوعی اعتماد میکنند.
دوسوم آنان انتظار دارند طی یک سال آینده استفاده بیشتری از هوش مصنوعی داشته باشند.
مشاوره مالی مبتنی بر هوش مصنوعی در شرایط کنونی تحت نظارت مقررات قرار ندارد و مصرفکنندگان از هیچیک از حمایتهایی -از جمله امکان دریافت غرامت- برخوردار نمیشوند که مراجعه به مشاور انسانی برایشان فراهم میکند.
دیدگاه خود را درباره اعتماد به هوش مصنوعی برای تصمیمهای مالی با ما در میان بگذارید.