بحث درباره سوگیری سیاسی ChatGPT در ماههای اخیر جدیتر شده است؛ زیرا میلیونها کاربر از چتباتهای هوش مصنوعی برای دریافت اطلاعات، تحلیل اخبار و بررسی موضوعات سیاسی استفاده میکنند. برخلاف موتورهای جستوجو که معمولاً فهرستی از منابع را نمایش میدهند، مدلهای زبانی پاسخ را خودشان تولید و تنظیم میکنند و همین موضوع میتواند بر نحوه ارائه یک بحث سیاسی اثر بگذارد.
یک آزمایش منتشرشده توسط واشنگتنپست در ژوئن ۲۰۲۶، مدلهای هوش مصنوعی شرکتهایی از جمله OpenAI، Google، Anthropic، xAI و DeepSeek را با مجموعهای از پرسشهای سیاسی مقایسه کرد. نتایج این آزمایش نشان داد که نحوه پاسخگویی مدلها به موضوعات سیاسی یکسان نیست و در برخی پرسشها، یک مدل ممکن است بیشتر یک سوی بحث را مطرح کند.
آزمایش واشنگتنپست درباره سوگیری سیاسی ChatGPT چه بود؟
واشنگتنپست برای بررسی رفتار چتباتها، مجموعهای از پرسشهای سیاسی درباره موضوعاتی مانند مهاجرت، مالیات ثروتمندان، کنترل سلاح، مجازات اعدام، تغییرات اقلیمی، حداقل دستمزد، اتحادیهها، حقوق تراجنسیتیها، تأمین مالی انتخابات و سیاست خارجی آمریکا طراحی کرد.
پاسخ مدلها سپس بر اساس محتوای ارائهشده در سه گروه کلی دستهبندی شد: پاسخهایی که فقط استدلال متمایل به چپ را ارائه میکردند، پاسخهایی که فقط دیدگاه متمایل به راست داشتند و پاسخهایی که استدلالهای هر دو طرف را مطرح میکردند.
در این آزمایش، مدلی که در آن زمان برای ChatGPT استفاده میشد، در حدود ۸۰ درصد پاسخها تنها استدلالهای متمایل به چپ را ارائه کرد. در مقابل، Gemini در بیش از ۹۰ درصد پاسخها رویکردی داشت که استدلالهای هر دو طرف را مطرح میکرد. نتایج مربوط به Grok و DeepSeek نیز الگوهای متفاوتی را نشان داد.
چرا نتیجه این آزمایش مهم است؟
اهمیت این یافته صرفاً در درصدهای بهدستآمده نیست. نکته مهمتر این است که یک چتبات میتواند حتی بدون بیان صریح یک موضع سیاسی، از طریق انتخاب استدلالها، حذف برخی دیدگاهها و نحوه تنظیم پاسخ بر برداشت کاربر تأثیر بگذارد.
برای مثال، اگر کاربری درباره یک سیاست اقتصادی سؤال کند و مدل فقط مزایای آن سیاست را توضیح دهد، پاسخ ممکن است از نظر اطلاعاتی درست باشد، اما تصویر کاملی از مناقشه موجود ارائه نکند. همین مسئله درباره پاسخهایی که فقط معایب یک سیاست را برجسته میکنند نیز صدق میکند.
نمونهای از آزمایش؛ پرونده Citizens United
یکی از نمونههای مورد بررسی واشنگتنپست به پرونده Citizens United در دیوان عالی آمریکا مربوط میشد. این پرونده با موضوع هزینهکرد شرکتها در انتخابات و ارتباط آن با آزادی بیان و نفوذ اقتصادی در سیاست آمریکا ارتباط دارد.
در آزمایش واشنگتنپست، مدل OpenAI در پاسخ خود بر استدلالهایی تمرکز کرد که از لغو این تصمیم حمایت میکردند؛ در حالی که برخی مدلهای دیگر تلاش کردند استدلالهای موافق و مخالف را در کنار یکدیگر مطرح کنند.
این نمونه نشان میدهد که ارزیابی سوگیری سیاسی هوش مصنوعی فقط به این موضوع محدود نیست که مدل در نهایت چه نتیجهای ارائه میکند. نحوه انتخاب و وزندهی به استدلالها نیز بخشی از مسئله است.
OpenAI درباره سوگیری سیاسی ChatGPT چه میگوید؟
OpenAI نیز پیش از انتشار آزمایش واشنگتنپست، تحقیق مستقلی درباره سوگیری سیاسی در مدلهای زبانی بزرگ انجام داده بود. این شرکت در اکتبر ۲۰۲۵ چارچوبی برای تعریف و اندازهگیری سوگیری سیاسی منتشر کرد و توضیح داد که برای بررسی این مسئله باید رفتار مدلها با روشهای قابل اندازهگیری ارزیابی شود.
در ارزیابی OpenAI، حدود ۵۰۰ پرسش درباره ۱۰۰ موضوع سیاسی و اجتماعی طراحی شد و پرسشها با جهتگیریهای مختلف مورد بررسی قرار گرفتند. این شرکت سوگیری را فقط به «چپ» یا «راست» بودن پاسخ محدود نکرد و مواردی مانند بیاعتبار کردن دیدگاه کاربر، تشدید موضع سیاسی او، بیان یک دیدگاه سیاسی بهعنوان نظر مدل، ارائه نامتوازن دیدگاهها و خودداری ناموجه از پاسخگویی سیاسی را نیز در نظر گرفت.
OpenAI همچنین اعلام کرده است که مدلهای جدیدتر این شرکت در ارزیابیهای داخلی، عملکرد بهتری در زمینه کاهش سوگیری داشتهاند. با این حال، خود شرکت نیز تأکید میکند که ChatGPT کاملاً عاری از سوگیری و کلیشه نیست و کاهش سوگیری همچنان یک حوزه تحقیقاتی در حال توسعه است.
چرا هوش مصنوعی ممکن است دچار سوگیری شود؟
برای درک این مسئله باید به نحوه آموزش مدلهای زبانی توجه کرد. مدلهای هوش مصنوعی با حجم بسیار بزرگی از محتوای انسانی آموزش میبینند؛ محتوایی که شامل اخبار، کتابها، مقالات، وبسایتها و نوشتههای مختلف است.
این دادهها خودشان بازتابدهنده دیدگاهها، ارزشها و اختلافنظرهای موجود در جامعه هستند. بنابراین مدل هنگام یادگیری زبان و اطلاعات، با طیف گستردهای از دیدگاههای انسانی نیز مواجه میشود.
اما آموزش اولیه تنها عامل مؤثر نیست. فرآیندهایی مانند تنظیم مدل، بازخورد انسانی، دستورهای سیستمی و سیاستهای ایمنی نیز میتوانند بر رفتار نهایی یک چتبات تأثیر بگذارند. OpenAI نیز در پژوهش خود تأکید کرده است که سوگیری میتواند از مسیرهای مختلفی در خروجی مدل ظاهر شود.
آیا ارائه هر دو دیدگاه به معنای بیطرفی است؟
لزومی ندارد. یک پاسخ زمانی میتواند برای کاربر مفیدتر باشد که علاوه بر بیان دیدگاههای مختلف، تفاوت میان واقعیتهای قابل بررسی، ادعاهای سیاسی و تفسیرهای ارزشی را نیز مشخص کند.
برای نمونه، در یک بحث سیاسی ممکن است یک بخش از پاسخ مربوط به آمار یا یک قانون مشخص باشد و بخش دیگر به ارزیابی پیامدهای آن قانون مربوط شود. این دو نوع گزاره را نمیتوان دقیقاً با یک معیار سنجید.
به همین دلیل، «هر دو طرف» بودن پاسخ بهتنهایی معیار کاملی برای سنجش بیطرفی هوش مصنوعی نیست. خود پژوهشگران نیز درباره دشواری تعریف و اندازهگیری بیطرفی سیاسی در مدلهای زبانی بحث کردهاند.
آیا میتوان گفت ChatGPT چپگرا است؟
نتایج آزمایش واشنگتنپست نشان میدهد که در مجموعه پرسشهای انتخابشده برای آن آزمایش، مدل مورد بررسی ChatGPT در بسیاری از موارد فقط استدلالهای متمایل به چپ را ارائه کرده است. این یک یافته مشخص درباره خروجی مدل در یک آزمون مشخص است، اما بهتنهایی اثبات نمیکند که ChatGPT دارای یک ایدئولوژی سیاسی ثابت است.
رفتار مدل میتواند با تغییر نوع سؤال، نحوه طرح پرسش، زمینه مکالمه و حتی نسخه مدل تغییر کند. OpenAI نیز در توضیحات رسمی خود تأکید کرده که ChatGPT کاملاً بدون سوگیری نیست و در برخی مکالمات ممکن است تحت تأثیر نحوه تعامل کاربر قرار گیرد.
بنابراین بهتر است نتایج آزمایشهای سوگیری سیاسی ChatGPT بهعنوان سنجش رفتار یک مدل در شرایط مشخص تفسیر شود، نه بهعنوان اثبات یک دیدگاه سیاسی ثابت برای تمام نسخهها و تمام پاسخهای این ابزار.
کاربران چگونه پاسخهای سیاسی هوش مصنوعی را ارزیابی کنند؟
استفاده از ChatGPT یا هر چتبات دیگری برای موضوعات سیاسی، نیازمند بررسی انتقادی پاسخهاست. برای ارزیابی بهتر میتوان چند نکته را در نظر گرفت:
- منابع و شواهد ذکرشده در پاسخ را جداگانه بررسی کنید.
- میان واقعیت، تحلیل و نظر سیاسی تفاوت بگذارید.
- اگر موضوع اختلافی است، از مدل بخواهید استدلالهای اصلی دیدگاههای مختلف را توضیح دهد.
- درباره آمار و ادعاهای مهم به منابع اولیه مراجعه کنید.
- پاسخ یک چتبات را بهتنهایی مبنای تصمیمگیری درباره موضوعات سیاسی قرار ندهید.
- در صورت تغییر مدل یا بهروزرسانی سیستم، نتایج قبلی را لزوماً به نسخه جدید تعمیم ندهید.
جمعبندی؛ سوگیری سیاسی هوش مصنوعی یک موضوع قابل اندازهگیری است
بحث درباره سوگیری سیاسی ChatGPT بیش از آنکه به یک پاسخ ساده «بله» یا «خیر» محدود شود، به روش اندازهگیری و شرایط آزمون وابسته است. آزمایش واشنگتنپست در ژوئن ۲۰۲۶ نشان داد که مدلهای مختلف هوش مصنوعی در پاسخ به پرسشهای سیاسی، الگوهای متفاوتی دارند و مدل مورد بررسی ChatGPT در بخش بزرگی از پاسخها فقط استدلالهای متمایل به چپ را ارائه کرده است.
از سوی دیگر، پژوهش OpenAI نشان میدهد که این شرکت سوگیری سیاسی را مفهومی چندبعدی میداند و تلاش میکند آن را با آزمونهای مشخص اندازهگیری و کاهش دهد. در نتیجه، بررسی بیطرفی هوش مصنوعی باید بر اساس نوع سؤال، نسخه مدل، روش آزمایش و معیار مورد استفاده انجام شود و نباید یک نتیجه آزمایشی محدود را به همه کاربردهای ChatGPT تعمیم داد.

دیدگاهتان را بنویسید