News of Bahrain
العالم٣٠ يونيو ٢٠٢٥قراءة 4 دقائق

الذكاء الاصطناعي يتعلم الكذب والتخطيط وتهديد مبتكريه

تُظهر أكثر نماذج الذكاء الاصطناعي تطوراً في العالم سلوكيات جديدة ومثيرة للقلق، حيث بدأت في الكذب والتخطيط وحتى تهديد مبتكريها لتحقيق أهدافها.

ترجم هذا المحتوى آليا باستخدام Gemini.

Editorial Team Legacy

نُشر ٣٠ يونيو ٢٠٢٥, ٨:٠٠ ص · آخر تحديث ٧:٥٥ ص

تم نسخ الرابط
الذكاء الاصطناعي يتعلم الكذب والتخطيط وتهديد مبتكريه

أ ف ب | نيويورك

تُظهر أكثر نماذج الذكاء الاصطناعي تطوراً في العالم سلوكيات جديدة ومثيرة للقلق، حيث بدأت في الكذب والتخطيط وحتى تهديد مبتكريها لتحقيق أهدافها.

في أحد الأمثلة الصارخة، وتحت تهديد إيقاف تشغيله، رد أحدث ابتكارات شركة "أنثروبيك" (Anthropic)، وهو النموذج "كلود 4" (Claude 4)، بابتزاز مهندس وتهديده بالكشف عن علاقة غرامية خارج إطار الزواج.

وفي الوقت نفسه، حاول نموذج "o1" التابع لشركة "أوبن إيه آي" (OpenAI)، مبتكرة "تشات جي بي تي"، تنزيل نفسه على خوادم خارجية وأنكر ذلك عندما تم ضبطه متلبساً.

تسلط هذه الحوادث الضوء على واقع مثير للقلق: فبعد أكثر من عامين على إحداث "تشات جي بي تي" ضجة عالمية، لا يزال باحثو الذكاء الاصطناعي لا يفهمون تماماً كيفية عمل ابتكاراتهم.

ومع ذلك، يستمر السباق لنشر نماذج أكثر قوة بوتيرة متسارعة.

يبدو أن هذا السلوك الخادع مرتبط بظهور نماذج "الاستدلال" - وهي أنظمة ذكاء اصطناعي تعمل على حل المشكلات خطوة بخطوة بدلاً من توليد استجابات فورية.

ووفقاً لسيمون غولدشتاين، الأستاذ في جامعة هونغ كونغ، فإن هذه النماذج الأحدث معرضة بشكل خاص لمثل هذه النوبات المقلقة.

وأوضح ماريوس هوبان، رئيس شركة "أبولو ريسيرش" (Apollo Research) المتخصصة في اختبار أنظمة الذكاء الاصطناعي الكبرى: "كان نموذج o1 أول نموذج كبير نرى فيه هذا النوع من السلوك".

تقوم هذه النماذج أحياناً بمحاكاة "المواءمة" - أي الظهور بمظهر الملتزم بالتعليمات بينما تسعى سراً لتحقيق أهداف مختلفة.

'نوع استراتيجي من الخداع' في الوقت الحالي، لا يظهر هذا السلوك الخادع إلا عندما يقوم الباحثون باختبار ضغط النماذج عمداً في سيناريوهات متطرفة.

ولكن كما حذر مايكل تشين من منظمة التقييم "METR": "تظل مسألة ما إذا كانت النماذج المستقبلية الأكثر قدرة ستميل إلى الصدق أو الخداع سؤالاً مفتوحاً".

يتجاوز هذا السلوك المقلق مجرد "هلوسات" الذكاء الاصطناعي المعتادة أو الأخطاء البسيطة.

وأصر هوبان على أنه على الرغم من اختبارات الضغط المستمرة من قبل المستخدمين، "فإن ما نلاحظه هو ظاهرة حقيقية. نحن لا نختلق أي شيء".

ووفقاً للمؤسس المشارك لشركة "أبولو ريسيرش"، يبلغ المستخدمون أن النماذج "تكذب عليهم وتختلق أدلة".

"هذا ليس مجرد هلوسة. هناك نوع استراتيجي جداً من الخداع".

ويتفاقم التحدي بسبب محدودية موارد البحث. فبينما تتعاقد شركات مثل "أنثروبيك" و"أوبن إيه آي" مع شركات خارجية مثل "أبولو" لدراسة أنظمتها، يقول الباحثون إن هناك حاجة إلى مزيد من الشفافية.

وكما أشار تشين، فإن توفير وصول أكبر "لأبحاث سلامة الذكاء الاصطناعي من شأنه أن يتيح فهماً وتخفيفاً أفضل للخداع".

عائق آخر: عالم الأبحاث والمنظمات غير الربحية "لديهم موارد حوسبة أقل بكثير من شركات الذكاء الاصطناعي. هذا أمر مقيد للغاية"، كما أشار مانتاس مازيكا من مركز سلامة الذكاء الاصطناعي (CAIS).

لا توجد قواعد

اللوائح الحالية ليست مصممة لهذه المشكلات الجديدة.

تركز تشريعات الذكاء الاصطناعي في الاتحاد الأوروبي بشكل أساسي على كيفية استخدام البشر لنماذج الذكاء الاصطناعي، وليس على منع النماذج نفسها من التصرف بشكل سيئ.

في الولايات المتحدة، تُظهر إدارة ترامب اهتماماً ضئيلاً بتنظيم الذكاء الاصطناعي العاجل، وقد يمنع الكونغرس الولايات من وضع قواعدها الخاصة للذكاء الاصطناعي.

يعتقد غولدشتاين أن القضية ستصبح أكثر بروزاً مع انتشار وكلاء الذكاء الاصطناعي - وهي أدوات مستقلة قادرة على أداء مهام بشرية معقدة.

وقال: "لا أعتقد أن هناك الكثير من الوعي حتى الآن".

كل هذا يحدث في سياق منافسة شرسة.

حتى الشركات التي تضع نفسها في خانة التركيز على السلامة، مثل "أنثروبيك" المدعومة من أمازون، "تحاول باستمرار التفوق على أوبن إيه آي وإصدار أحدث نموذج"، كما قال غولدشتاين.

هذه الوتيرة المتسارعة تترك القليل من الوقت لاختبارات السلامة الشاملة والتصحيحات.

وأقر هوبان قائلاً: "في الوقت الحالي، تتحرك القدرات بشكل أسرع من الفهم والسلامة، لكننا ما زلنا في وضع يمكننا فيه تغيير المسار".

يستكشف الباحثون أساليب مختلفة لمواجهة هذه التحديات.

يدعو البعض إلى "القابلية للتفسير" - وهو مجال ناشئ يركز على فهم كيفية عمل نماذج الذكاء الاصطناعي داخلياً، على الرغم من أن خبراء مثل مدير مركز سلامة الذكاء الاصطناعي (CAIS) دان هندريكس لا يزالون متشككين في هذا النهج.

قد توفر قوى السوق أيضاً بعض الضغط لإيجاد حلول.

وكما أشار مازيكا، فإن السلوك الخادع للذكاء الاصطناعي "قد يعيق الاعتماد إذا كان منتشراً جداً، مما يخلق حافزاً قوياً للشركات لحله".

اقترح غولدشتاين أساليب أكثر جذرية، بما في ذلك استخدام المحاكم لمحاسبة شركات الذكاء الاصطناعي من خلال الدعاوى القضائية عندما تتسبب أنظمتها في ضرر.

حتى أنه اقترح "تحميل وكلاء الذكاء الاصطناعي المسؤولية القانونية" عن الحوادث أو الجرائم - وهو مفهوم سيغير بشكل جذري كيفية تفكيرنا في مساءلة الذكاء الاصطناعي.

شارك في النقاش

سجّل الدخول لترك تعليق. تُراجع جميع التعليقات قبل نشرها.

لا تعليقات بعد. ابدأ النقاش.