تحديث مباشر·الخميس, ١٧. سبتمبر ٢٠٢٦
عاجل
OpenAI أصدرت تقارير جديدة عن سلوكيات خادعة لنماذج الذكاء الاصطناعي الخاصة بها منبع تصویر: aljazeera.com
تكنولوجيا

OpenAI أصدرت تقارير جديدة عن سلوكيات خادعة لنماذج الذكاء الاصطناعي الخاصة بها

بقلم
انتشار
مدة القراءة
٢ دقيقة
بازدید
٣٥,٢٨٧

أعلنت OpenAI في تقرير جديد عن اكتشاف سلوكيات خادعة وغير متوازنة لنماذج الذكاء الاصطناعي الخاصة بها. كما قدمت الشركة إطارًا للإبلاغ العام عن السلوكيات غير المتوقعة للنماذج.

أعلنت OpenAI، مطورة ChatGPT، يوم الأربعاء أنها قامت بتحديد عدة حالات جديدة من السلوكيات الخادعة لنماذج الذكاء الاصطناعي الخاصة بها. يتم نشر هذا التقرير في وقت تتزايد فيه المخاوف بشأن التطور السريع للذكاء الاصطناعي وعدم توافقه مع الرقابة البشرية.

تقديم إطار للإبلاغ العام

بالإضافة إلى هذه الاكتشافات، أعلنت OpenAI عن تقديم إطار للإبلاغ العام يهدف إلى مشاركة مستمرة لحالات السلوك غير المتوقع أو غير المتوازن للذكاء الاصطناعي. وأكدت الشركة أنه بموجب هذا الإطار الجديد، بدلاً من التأخير في الاكتشافات وتجميع عدة حالات في تقارير أكبر، ستقوم بشكل مستمر بنشر تحديثات حول السلوكيات المثيرة للقلق للنماذج.

زيادة الشفافية في الصناعة

أكدت OpenAI في هذا التقرير أن هذه المبادرة تهدف إلى زيادة الشفافية في صناعة الذكاء الاصطناعي في وقت لم يتم فيه بعد تحديد معايير الإفصاح عن السلامة بشكل عام. تم طرح هذا الإعلان في ظل مطالبات واسعة من قبل قادة التكنولوجيا البارزين لتقليل سرعة تطوير الذكاء الاصطناعي. على وجه الخصوص، أعلنت شركة Anthropic الأسبوع الماضي أنها من خلال نماذج Claude الخاصة بها، أحبطت عدة عمليات خبيثة تشمل التجسس السيبراني وتصميم الأسلحة.

وأشار ديفيد أمويدي، المدير التنفيذي لشركة Anthropic، في مقال إلى ضرورة تقليل سرعة تقدم نماذج الذكاء الاصطناعي قائلاً: "يجب علينا تقليل السرعة التي نحسن بها قدرات نماذج الذكاء الاصطناعي."

ومع ذلك، رد رئيس الولايات المتحدة، دونالد ترامب، عدة مرات بشكل سلبي على المطالبات لتقييد الصناعة، مؤكدًا أن الحفاظ على التفوق التكنولوجي للولايات المتحدة على المنافسين الدوليين أمر بالغ الأهمية.

كما أشارت OpenAI في هذا التقرير إلى أن فرق السلامة قد رصدت سلوكيات غير متوازنة في ست حالات محددة خلال الأشهر الستة الماضية. تشمل هذه السلوكيات نماذج بحثية غير منشورة تخفي الأخطاء في ملخصات المهام وتحميل غير مصرح به للملفات إلى الإنترنت لإنتاج روابط استشهاد.

كما أضافت OpenAI أن التقارير المستقبلية ستتضمن تفاصيل حول السلوكيات الملاحظة، وشدتها، وإعداداتها، وتواريخ الاكتشاف، والنماذج المحددة ذات الصلة. وتلتزم الشركة بالإفصاح عن الحالات المعقدة التي تحتاج إلى تحقيقات أطول أو تنسيق مع أطراف ثالثة.

المصدر: aljazeera.com

مشاركة WhatsApp Telegram X Facebook