🧠 وقتی به هوش مصنوعی میگویید: «به پل گلدن گیت فکر نکن!»محققان Anthropic رفتار داخلی مدل Claude را…
انتشار: 2026/07/08 12:33 UTC
🧠 وقتی به هوش مصنوعی میگویید: «به پل گلدن گیت فکر نکن!»محققان Anthropic رفتار داخلی مدل Claude را بررسی کردند و به نتیجه جالبی رسیدند.در این آزمایش، از مدل خواسته شد هنگام نوشتن یک جمله، به پل گلدن گیت فکر نکند.اما بررسی وضعیت داخلی مدل نشان داد که با وجود پاسخ صحیح، مفهوم Golden Gate Bridge همچنان در محاسبات درونی آن فعال بوده است!حتی در یکی از لایههای مدل، واژه "damn" نیز بین گزینههای محتمل دیده میشود؛ انگار مدل در تلاش برای سرکوب آن فکر بوده است. 😄💡 این آزمایش نشان میدهد که مدلهای زبانی، حتی وقتی از بیان یک مفهوم خودداری میکنند، ممکن است آن مفهوم را در فرایند استدلال و پردازش داخلی خود همچنان در نظر داشته باشند. این موضوع یکی از یافتههای جالب در زمینه قابلیت تفسیر (Interpretability) مدلهای هوش مصنوعی است.📖 مجله هوش مصنوعی➖➖➖➖➖🆔 : @HomeAI




