پدیده «هالوسینیشن» یا توهم در هوش مصنوعی، به موقعیتی اطلاق میشود که مدلهای زبان بزرگ اطلاعاتی را بهعنوان واقعیت ارائه میدهند، در حالی که آن اطلاعات کاملاً نادرست یا بیپایه است. این موضوع در سال 2025 همچنان یکی از چالشهای اساسی صنعت هوش مصنوعی محسوب میشود و نگرانیهای جدی را برای کاربران حرفهای و کسبوکارها به همراه دارد.
محققان دانشگاه کلمبیا برای سنجش نرخ هالوسینیشن، مدلهای هوش مصنوعی را با گزیدههایی از مقالات خبری آزمایش کردند. نتایج این بررسی نشان داد که تفاوت چشمگیری بین عملکرد مدلهای مختلف وجود دارد. بهطور مثال، Grok-2 (نسخه رایگان) با 77 درصد خطا، Gemini با 76 درصد، DeepSeek با 68 درصد و ChatGPT Search با 67 درصد در رتبههای بعدی قرار گرفتند.
جالب است که در بررسیهای اخیر دیگری که در دسامبر 2025 توسط شرکت Relum انجام شد، Grok نسخه جدیدتر با تنها 8 درصد نرخ هالوسینیشن، یکی از قابلاعتمادترین چتباتهای هوش مصنوعی شناخته شد. این تناقض آشکار میان نتایج مطالعات مختلف نشان میدهد که نسخههای مختلف یک مدل میتوانند عملکردهای کاملاً متفاوتی داشته باشند. مجله تخصصی هوش مصنوعی آرتین در این گزارش تلاش میکند تا تصویری واقعبینانه از وضعیت فعلی مدلهای هوش مصنوعی ارائه دهد.
یکی از نکات مهم این مطالعات این است که مدلهای پولی لزوماً دقیقتر از نسخههای رایگان نیستند. آزمایشها نشان داد که هر دو مدل Perplexity Pro و Grok 3 در مقایسه با نسخههای رایگان خود، نرخ خطای بالاتری داشتند. این تناقض عمدتاً ناشی از تمایل این مدلها به ارائه پاسخهای قاطع اما نادرست است، بهجای اینکه عدم قطعیت خود را اعلام کنند. بیشتر مدلها با اطمینان کامل پاسخ میدهند، حتی وقتی که اشتباه میکنند.
دلیل اصلی هالوسینیشن این است که سیستمهای آموزشی استاندارد، حدس زدن را نسبت به نشان دادن عدم قطعیت پاداش میدهند. بهعبارت دیگر، مدلهای هوش مصنوعی طوری آموزش دیدهاند که ترجیح میدهند پاسخی بدهند، حتی اگر مطمئن نباشند. این مسئله بهویژه برای حوزههایی مانند روزنامهنگاری، پزشکی، حقوق و تحلیل دادهها میتواند خطرناک باشد که در آنها دقت اطلاعات بسیار حیاتی است.
نکته دیگر اینکه این مطالعه همچنین نشان داد Grok 3 در 154 مورد از کاربران خواست که به صفحات خطای 404 مراجعه کنند و بیشترین لینک جعلی را نسبت به سایر مدلها ارائه کرد. این بهمعنای آن است که این مدل نهتنها اطلاعات نادرست میدهد، بلکه منابع خیالی نیز ایجاد میکند. چنین رفتاری میتواند اعتماد کاربران به هوش مصنوعی را بهشدت کاهش دهد و مخاطرات جدی برای استفاده حرفهای از این ابزارها ایجاد کند.
آیا باید نگران باشیم؟ پاسخ این است: بله، اما با آگاهی. هوش مصنوعی ابزاری قدرتمند است، اما نباید آن را جایگزین قضاوت انسانی کرد. کاربران حرفهای باید همیشه اطلاعات ارائهشده توسط مدلهای هوش مصنوعی را با منابع معتبر تأیید کنند و بهخصوص برای تصمیمگیریهای مهم، روی آنها تکیه نکنند. صنعت هوش مصنوعی در حال پیشرفت است و انتظار میرود که این مشکلات در آینده بهبود یابد، اما تا آن زمان، هوشیاری لازم است.
مجله تخصصی هوش مصنوعی آرتین
🔗 بیشتر بخوانید: آخرین اخبار و تحلیلهای دنیای هوش مصنوعی
📌 اگر این مطلب برای شما مفید بود، آن را با دوستان خود به اشتراک بگذارید. نظرات و پیشنهادات خود را در بخش دیدگاهها با ما در میان بگذارید و با لایک کردن از ما حمایت کنید!
🔔 برای دریافت آخرین اخبار و مقالات تخصصی هوش مصنوعی، عضو کانال @ArtinMag مجله آرتین شوید.



