Yapay Zekanın Finansal Danışmanlığı Sınıfta Kaldı: Hatalı Bilgiler Maddi Kayıp Riski Taşıyor
Son zamanlarda finansal konularda bilgi almak ve yatırım tavsiyeleri edinmek için yapay zeka sohbet robotlarına yönelenlerin sayısı artıyor. Ancak, teknoloji firması Saturn tarafından gerçekleştirilen kapsamlı bir araştırma, bu popüler yapay zeka modellerinin finansal sorular karşısındaki performansının endişe verici düzeyde düşük olduğunu ortaya koydu. Yapılan incelemeler, önde gelen yapay zeka araçlarının finansal konularda verdiği bilgilerin doğruluğunun ortalama yüzde 57 civarında kaldığını gösteriyor. Özellikle birden fazla adımı içeren daha karmaşık finansal işlemlerle ilgili sorularda ise hata oranının yüzde 88'e kadar yükseldiği, hatta bazı modellerin bu tür sorularda yüzde 99 oranında başarısız olduğu belirlendi. Bu durum, yapay zekanın finansal danışmanlık alanındaki yetkinliği hakkında ciddi soru işaretleri oluşturuyor.
Araştırmada, küresel çapta tanınan ve milyonlarca kullanıcı tarafından aktif olarak kullanılan ChatGPT, Gemini, Claude ve Copilot gibi yapay zeka modellerinin hem ücretsiz hem de ücretli sürümleri mercek altına alındı. Toplamda 18 farklı yapay zeka modeline, finansal konuları kapsayan 100'den fazla soru yöneltildi ve bu sorular beşer kez tekrarlanarak 10 binin üzerinde sorgulama gerçekleştirildi. Analizler sonucunda, yapay zeka tarafından üretilen yanıtların önemli hesaplama hataları içerdiği, güncel vergi değişikliklerini dikkate almadığı veya tamamen uydurma kurallar sunduğu tespit edildi. En endişe verici bulgulardan biri ise, özellikle vergi konularında verilen yanlış bilgilerin, bireylerin ciddi maddi kayıplarla karşı karşıya kalmasına neden olabilecek nitelikte olmasıdır. Bu sonuçlar, yapay zekaya finansal konularda güvenmeden önce iki kez düşünmek gerektiğini açıkça ortaya koyuyor.
Saturn'un Üst Yöneticisi Amal Jolly, araştırmanın bulgularına ilişkin yaptığı değerlendirmede, finansal tavsiye almak için yapay zeka modellerine güvenen milyonlarca insanın, aslında paralarını kaybetmelerine yol açabilecek yanlış bilgilerle karşılaştığını vurguladı. Jolly, “Yapay zeka finansal danışmanlığı şu anda etkin bir şekilde denetlenmiyor. Bu durum, tüketicilerin bir insan danışmandan alabilecekleri tazminat da dahil olmak üzere hiçbir güvenceden yoksun kalmasına neden oluyor,” dedi. Jolly, İngiltere Finansal Davranış Otoritesi'nin (FCA) bu konuda acil adımlar atması gerektiğini belirterek, insanları koruyacak düzenlemelerin hızla hayata geçirilmesinin önemine işaret etti. Öte yandan, araştırmada bazı modellerin geçmiş yıllara ait bilgileri güncelmiş gibi sunduğu veya tamamen yanlış bilgilerle kurallar uydurduğu örnekler de dikkat çekti. Örneğin, bir yapay zeka modelinin emeklilik vergi kurallarıyla ilgili verdiği hatalı bilginin, bir vatandaşı yaklaşık 17 bin 500 sterlinlik bir ceza riskiyle karşı karşıya bırakabileceği ortaya çıktı.
Araştırmada ayrıca, ücretli sürümlerin ve daha yeni modellerin, ücretsiz sürümlere ve eski versiyonlara kıyasla daha doğru yanıtlar verme eğiliminde olduğu gözlemlendi. Mantık yürütme yeteneğiyle öne çıkan Claude Opus 5 modelinin, yüzde 39'luk bir hata oranına sahip olmasına rağmen, genel olarak incelenen modeller arasında en iyi performansı sergilediği belirtildi. Ancak, bu durum bile yapay zekanın finansal konularda güvenilir bir kaynak olarak kabul edilmesi için yeterli görülmüyor. Yatırım platformu AJ Bell'in kişisel finans başkanı Sarah Coles, yapay zekanın sunduğu kafa karıştırıcı tavsiyeler nedeniyle danışmanlara başvuran müşteri örnekleri olduğunu belirterek, “Bu durum, desteğe ihtiyacı olan kişilerin yapay zekaya güvenmek yerine neden gerçek danışmanlığa ihtiyaç duyduğunun iyi bir örneğidir,” dedi. Coles, yapay zekanın bütçeleme ve gelir-gider analizi gibi konularda faydalı olabileceğini kabul etmekle birlikte, yatırım kararları gibi kritik finansal konularda insan uzmanlığına olan ihtiyacın altını çizdi. İngiltere Finansal Davranış Otoritesi'nin (FCA) geçtiğimiz ay yayımladığı bir araştırmanın da, genç yatırımcıların finansal bilgiler için sosyal medya fenomenleri veya televizyon programları yerine giderek daha fazla yapay zekaya güvendiğini ortaya koyması, bu konudaki riskleri daha da artırıyor.