مجله آنلاین سرمایه‌گذاری و اقتصاد25 شهریور 1405

آیا ChatGPT سوگیری سیاسی دارد؟ نتیجه آزمایش واشنگتن‌پست جنجالی شد

آیا ChatGPT سوگیری سیاسی دارد؟ نتیجه آزمایش واشنگتن‌پست جنجالی شد

بحث درباره سوگیری سیاسی ChatGPT در ماه‌های اخیر جدی‌تر شده است؛ زیرا میلیون‌ها کاربر از چت‌بات‌های هوش مصنوعی برای دریافت اطلاعات، تحلیل اخبار و بررسی موضوعات سیاسی استفاده می‌کنند. برخلاف موتورهای جست‌وجو که معمولاً فهرستی از منابع را نمایش می‌دهند، مدل‌های زبانی پاسخ را خودشان تولید و تنظیم می‌کنند و همین موضوع می‌تواند بر نحوه ارائه یک بحث سیاسی اثر بگذارد.

یک آزمایش منتشرشده توسط واشنگتن‌پست در ژوئن ۲۰۲۶، مدل‌های هوش مصنوعی شرکت‌هایی از جمله OpenAI، Google، Anthropic، xAI و DeepSeek را با مجموعه‌ای از پرسش‌های سیاسی مقایسه کرد. نتایج این آزمایش نشان داد که نحوه پاسخ‌گویی مدل‌ها به موضوعات سیاسی یکسان نیست و در برخی پرسش‌ها، یک مدل ممکن است بیشتر یک سوی بحث را مطرح کند.

آزمایش واشنگتن‌پست درباره سوگیری سیاسی ChatGPT چه بود؟

واشنگتن‌پست برای بررسی رفتار چت‌بات‌ها، مجموعه‌ای از پرسش‌های سیاسی درباره موضوعاتی مانند مهاجرت، مالیات ثروتمندان، کنترل سلاح، مجازات اعدام، تغییرات اقلیمی، حداقل دستمزد، اتحادیه‌ها، حقوق تراجنسیتی‌ها، تأمین مالی انتخابات و سیاست خارجی آمریکا طراحی کرد.

پاسخ مدل‌ها سپس بر اساس محتوای ارائه‌شده در سه گروه کلی دسته‌بندی شد: پاسخ‌هایی که فقط استدلال متمایل به چپ را ارائه می‌کردند، پاسخ‌هایی که فقط دیدگاه متمایل به راست داشتند و پاسخ‌هایی که استدلال‌های هر دو طرف را مطرح می‌کردند.

در این آزمایش، مدلی که در آن زمان برای ChatGPT استفاده می‌شد، در حدود ۸۰ درصد پاسخ‌ها تنها استدلال‌های متمایل به چپ را ارائه کرد. در مقابل، Gemini در بیش از ۹۰ درصد پاسخ‌ها رویکردی داشت که استدلال‌های هر دو طرف را مطرح می‌کرد. نتایج مربوط به Grok و DeepSeek نیز الگوهای متفاوتی را نشان داد.

چرا نتیجه این آزمایش مهم است؟

اهمیت این یافته صرفاً در درصدهای به‌دست‌آمده نیست. نکته مهم‌تر این است که یک چت‌بات می‌تواند حتی بدون بیان صریح یک موضع سیاسی، از طریق انتخاب استدلال‌ها، حذف برخی دیدگاه‌ها و نحوه تنظیم پاسخ بر برداشت کاربر تأثیر بگذارد.

برای مثال، اگر کاربری درباره یک سیاست اقتصادی سؤال کند و مدل فقط مزایای آن سیاست را توضیح دهد، پاسخ ممکن است از نظر اطلاعاتی درست باشد، اما تصویر کاملی از مناقشه موجود ارائه نکند. همین مسئله درباره پاسخ‌هایی که فقط معایب یک سیاست را برجسته می‌کنند نیز صدق می‌کند.

نمونه‌ای از آزمایش؛ پرونده Citizens United

یکی از نمونه‌های مورد بررسی واشنگتن‌پست به پرونده Citizens United در دیوان عالی آمریکا مربوط می‌شد. این پرونده با موضوع هزینه‌کرد شرکت‌ها در انتخابات و ارتباط آن با آزادی بیان و نفوذ اقتصادی در سیاست آمریکا ارتباط دارد.

در آزمایش واشنگتن‌پست، مدل OpenAI در پاسخ خود بر استدلال‌هایی تمرکز کرد که از لغو این تصمیم حمایت می‌کردند؛ در حالی که برخی مدل‌های دیگر تلاش کردند استدلال‌های موافق و مخالف را در کنار یکدیگر مطرح کنند.

این نمونه نشان می‌دهد که ارزیابی سوگیری سیاسی هوش مصنوعی فقط به این موضوع محدود نیست که مدل در نهایت چه نتیجه‌ای ارائه می‌کند. نحوه انتخاب و وزن‌دهی به استدلال‌ها نیز بخشی از مسئله است.

OpenAI درباره سوگیری سیاسی ChatGPT چه می‌گوید؟

OpenAI نیز پیش از انتشار آزمایش واشنگتن‌پست، تحقیق مستقلی درباره سوگیری سیاسی در مدل‌های زبانی بزرگ انجام داده بود. این شرکت در اکتبر ۲۰۲۵ چارچوبی برای تعریف و اندازه‌گیری سوگیری سیاسی منتشر کرد و توضیح داد که برای بررسی این مسئله باید رفتار مدل‌ها با روش‌های قابل اندازه‌گیری ارزیابی شود.

در ارزیابی OpenAI، حدود ۵۰۰ پرسش درباره ۱۰۰ موضوع سیاسی و اجتماعی طراحی شد و پرسش‌ها با جهت‌گیری‌های مختلف مورد بررسی قرار گرفتند. این شرکت سوگیری را فقط به «چپ» یا «راست» بودن پاسخ محدود نکرد و مواردی مانند بی‌اعتبار کردن دیدگاه کاربر، تشدید موضع سیاسی او، بیان یک دیدگاه سیاسی به‌عنوان نظر مدل، ارائه نامتوازن دیدگاه‌ها و خودداری ناموجه از پاسخ‌گویی سیاسی را نیز در نظر گرفت.

OpenAI همچنین اعلام کرده است که مدل‌های جدیدتر این شرکت در ارزیابی‌های داخلی، عملکرد بهتری در زمینه کاهش سوگیری داشته‌اند. با این حال، خود شرکت نیز تأکید می‌کند که ChatGPT کاملاً عاری از سوگیری و کلیشه نیست و کاهش سوگیری همچنان یک حوزه تحقیقاتی در حال توسعه است.

چرا هوش مصنوعی ممکن است دچار سوگیری شود؟

برای درک این مسئله باید به نحوه آموزش مدل‌های زبانی توجه کرد. مدل‌های هوش مصنوعی با حجم بسیار بزرگی از محتوای انسانی آموزش می‌بینند؛ محتوایی که شامل اخبار، کتاب‌ها، مقالات، وب‌سایت‌ها و نوشته‌های مختلف است.

این داده‌ها خودشان بازتاب‌دهنده دیدگاه‌ها، ارزش‌ها و اختلاف‌نظرهای موجود در جامعه هستند. بنابراین مدل هنگام یادگیری زبان و اطلاعات، با طیف گسترده‌ای از دیدگاه‌های انسانی نیز مواجه می‌شود.

اما آموزش اولیه تنها عامل مؤثر نیست. فرآیندهایی مانند تنظیم مدل، بازخورد انسانی، دستورهای سیستمی و سیاست‌های ایمنی نیز می‌توانند بر رفتار نهایی یک چت‌بات تأثیر بگذارند. OpenAI نیز در پژوهش خود تأکید کرده است که سوگیری می‌تواند از مسیرهای مختلفی در خروجی مدل ظاهر شود.

آیا ارائه هر دو دیدگاه به معنای بی‌طرفی است؟

لزومی ندارد. یک پاسخ زمانی می‌تواند برای کاربر مفیدتر باشد که علاوه بر بیان دیدگاه‌های مختلف، تفاوت میان واقعیت‌های قابل بررسی، ادعاهای سیاسی و تفسیرهای ارزشی را نیز مشخص کند.

برای نمونه، در یک بحث سیاسی ممکن است یک بخش از پاسخ مربوط به آمار یا یک قانون مشخص باشد و بخش دیگر به ارزیابی پیامدهای آن قانون مربوط شود. این دو نوع گزاره را نمی‌توان دقیقاً با یک معیار سنجید.

به همین دلیل، «هر دو طرف» بودن پاسخ به‌تنهایی معیار کاملی برای سنجش بی‌طرفی هوش مصنوعی نیست. خود پژوهشگران نیز درباره دشواری تعریف و اندازه‌گیری بی‌طرفی سیاسی در مدل‌های زبانی بحث کرده‌اند.

آیا می‌توان گفت ChatGPT چپ‌گرا است؟

نتایج آزمایش واشنگتن‌پست نشان می‌دهد که در مجموعه پرسش‌های انتخاب‌شده برای آن آزمایش، مدل مورد بررسی ChatGPT در بسیاری از موارد فقط استدلال‌های متمایل به چپ را ارائه کرده است. این یک یافته مشخص درباره خروجی مدل در یک آزمون مشخص است، اما به‌تنهایی اثبات نمی‌کند که ChatGPT دارای یک ایدئولوژی سیاسی ثابت است.

رفتار مدل می‌تواند با تغییر نوع سؤال، نحوه طرح پرسش، زمینه مکالمه و حتی نسخه مدل تغییر کند. OpenAI نیز در توضیحات رسمی خود تأکید کرده که ChatGPT کاملاً بدون سوگیری نیست و در برخی مکالمات ممکن است تحت تأثیر نحوه تعامل کاربر قرار گیرد.

بنابراین بهتر است نتایج آزمایش‌های سوگیری سیاسی ChatGPT به‌عنوان سنجش رفتار یک مدل در شرایط مشخص تفسیر شود، نه به‌عنوان اثبات یک دیدگاه سیاسی ثابت برای تمام نسخه‌ها و تمام پاسخ‌های این ابزار.

کاربران چگونه پاسخ‌های سیاسی هوش مصنوعی را ارزیابی کنند؟

استفاده از ChatGPT یا هر چت‌بات دیگری برای موضوعات سیاسی، نیازمند بررسی انتقادی پاسخ‌هاست. برای ارزیابی بهتر می‌توان چند نکته را در نظر گرفت:

  • منابع و شواهد ذکرشده در پاسخ را جداگانه بررسی کنید.
  • میان واقعیت، تحلیل و نظر سیاسی تفاوت بگذارید.
  • اگر موضوع اختلافی است، از مدل بخواهید استدلال‌های اصلی دیدگاه‌های مختلف را توضیح دهد.
  • درباره آمار و ادعاهای مهم به منابع اولیه مراجعه کنید.
  • پاسخ یک چت‌بات را به‌تنهایی مبنای تصمیم‌گیری درباره موضوعات سیاسی قرار ندهید.
  • در صورت تغییر مدل یا به‌روزرسانی سیستم، نتایج قبلی را لزوماً به نسخه جدید تعمیم ندهید.

جمع‌بندی؛ سوگیری سیاسی هوش مصنوعی یک موضوع قابل اندازه‌گیری است

بحث درباره سوگیری سیاسی ChatGPT بیش از آنکه به یک پاسخ ساده «بله» یا «خیر» محدود شود، به روش اندازه‌گیری و شرایط آزمون وابسته است. آزمایش واشنگتن‌پست در ژوئن ۲۰۲۶ نشان داد که مدل‌های مختلف هوش مصنوعی در پاسخ به پرسش‌های سیاسی، الگوهای متفاوتی دارند و مدل مورد بررسی ChatGPT در بخش بزرگی از پاسخ‌ها فقط استدلال‌های متمایل به چپ را ارائه کرده است.

از سوی دیگر، پژوهش OpenAI نشان می‌دهد که این شرکت سوگیری سیاسی را مفهومی چندبعدی می‌داند و تلاش می‌کند آن را با آزمون‌های مشخص اندازه‌گیری و کاهش دهد. در نتیجه، بررسی بی‌طرفی هوش مصنوعی باید بر اساس نوع سؤال، نسخه مدل، روش آزمایش و معیار مورد استفاده انجام شود و نباید یک نتیجه آزمایشی محدود را به همه کاربردهای ChatGPT تعمیم داد.

دانشگاه اقتصاد خوندم و متخصص تحلیل روند های اقتصادی هستیم. سالهاست که در حوزه نوشتن مطالب اقتصادی فعال هستم و از نوشتن تحلیل و اخبار اقتصادی لذت می برم.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *