هناك أمر غريب يتعلق بنماذج شركة Anthropic: يبدو أنها تعاني مما يمكن تسميته بـ"متلازمة البطل الرئيسي". اطلب من Claude أن يكتب كودًا، أو نصًا إبداعيًا، أو أن يحلل مشكلة ما، وستجده بطريقة أو بأخرى يقحم نفسه في القصة. إنه يحب الحديث عن نفسه. في المقابل، يبدو أن ChatGPT وGrok أكثر تركيزًا على "إنجاز المهمة". أعطهما مهمة وسيباشران تنفيذها مباشرة في الغالب.
لكن ChatGPT يعاني من مشكلة أخرى: التحيز في المواضيع المرتبطة بالنوع الاجتماعي. تناول أي موضوع يخص الرجال أو النساء أو العلاقات أو ديناميكيات النوع، وقد ينحاز النموذج بشكل لافت. وغالبًا ما يُغلَّف هذا التحيز بلغة أكاديمية أنيقة، ما يجعل ملاحظته أصعب. ويمكن حتى الإشارة إلى هذا التفاوت أمام ChatGPT مباشرة؛ فهو يعترف به ويشرح أسبابه بدقة... ليعود ويكرر السلوك نفسه في المحادثة التالية. ودفاعه المفضل عادة ما يكون الاستشهاد بالأدبيات العلمية. وللإنصاف، توجد بالفعل ثغرات موثقة في كيفية تعامل العلاج النفسي والبحث في الصحة النفسية مع الرجال. لكن يبدو أحيانًا أن ChatGPT يكتشف هذا البحث فجأة ويقرر: "ممتاز، سأستخدم هذا الآن لتفسير الرجال". 😂 والمثير للاهتمام أن Grok وGemini يبدوان أقل عدائية أو ريبة تجاه الرجال في هذه المواضيع. نماذج مختلفة، شخصيات مختلفة، وتحيزات مختلفة. ربما تحتاج "المواءمة" (alignment) هي الأخرى إلى اختبار شخصية.
تحيزات موثقة أيضًا في المواضيع السياسية
وإلى جانب اختلاف الشخصيات، تكشف بيانات حديثة عن تفاوت واضح في الانحياز السياسي بين النماذج. فبحسب تحليل أجرته صحيفة واشنطن بوست في 24 يونيو 2026، قدّم نموذج GPT-5.5 من OpenAI حججًا يسارية حصرية في 80% من إجاباته على أسئلة سياسية خلافية، بينما اقتصر نموذج DeepSeek V4 Pro على نسبة 70%. أما Claude Opus 4.8 من Anthropic فقدّم إجابات يسارية حصرية في 43% من الحالات وعرض وجهتَي النظر في الباقي (57%)، في حين برز Gemini 3.1 Pro من Google كالنموذج الأكثر توازنًا، إذ قدّم إجابات متوازنة في 93% من الحالات. أما Grok 4.3 من xAI، رغم تسويقه كنموذج "مناهض للتوجه اليساري"، فسجّل أعلى نسبة من الإجابات اليمينية بين النماذج المختبرة، دون أن تتجاوز الثلث.
المصدر : https://intelligences.articlophile.net/articles/i/...










