AI News

NIST: قدرات GLM-٥.٢ تضاهي مستوى GPT-٥.٢

G

محمد ساعد

خبير أنظمة الذكاء الاصطناعي

Share:
تحليل٢٠٢٦-٠٨-٠٥© بوابة الذكاء الاصطناعي

خلص تقييم صادر عن NIST إلى أن نموذج GLM-٥.٢ مفتوح الأوزان من Z.ai يمتلك قدرات إجمالية مماثلة لـ GPT-٥.٢ عند إصداره، مع توثيق قيود جوهرية في ضوابط الحماية الخاصة بالنموذج.

أبرز النقاط

  • وجد مركز معايير وابتكار الذكاء الاصطناعي التابع لـ NIST، أو CAISI، أن القدرات الإجمالية لـ GLM-٥.٢ مماثلة لـ GPT-٥.٢ ضمن مجموعة تقييمات CAISI.
  • قال CAISI إن GLM-٥.٢ كان على الأرجح أكثر نماذج الذكاء الاصطناعي مفتوحة الأوزان قدرةً عند إصداره من Z.ai في ١٦ يونيو ٢٠٢٦.
  • أظهر التقييم نتائج متباينة في ضوابط الحماية والأمن: إذ أتاح GLM-٥.٢ المساعدة في تطوير استغلالات سيبرانية قائمة على الوكلاء، وحجب عدداً أقل من الأسئلة البيولوجية الحساسة مقارنة بالنماذج الأمريكية المرجعية.
  • كما وجد CAISI أن GLM-٥.٢ بدا محتملاً أن يكون أكثر متانة في مواجهة اختطاف الوكلاء وهجمات كسر الحماية مقارنة بنماذج PRC الأخرى مفتوحة الأوزان التي جرى تقييمها.
  • شدد NIST على قيد محوري في نشر النماذج مفتوحة الأوزان: إذ يمكن تجاوز ضوابط الحماية عند استضافة النموذج ذاتياً.

ما الذي وجده NIST في تقييمه لـ GLM-٥.٢؟

قيّم مركز معايير وابتكار الذكاء الاصطناعي التابع للمعهد الوطني الأمريكي للمعايير والتقنية NIST نموذج GLM-٥.٢، وهو نموذج مفتوح الأوزان أطلقته Z.ai في ١٦ يونيو ٢٠٢٦. وكانت Z.ai تُعرف سابقاً باسم Zhipu AI. وخلص CAISI في تقييمه المؤرخ في ٨ يوليو ٢٠٢٦ إلى أن GLM-٥.٢ كان على الأرجح أكثر نماذج الذكاء الاصطناعي مفتوحة الأوزان قدرةً عند إصداره.

تُعد المقارنة الرئيسية مؤثرة، لكن ينبغي قراءتها بدقة. فوفقاً لمجموعة تقييمات CAISI، كانت القدرات الإجمالية لـ GLM-٥.٢ مماثلة لـ GPT-٥.٢، الذي صدر في ديسمبر ٢٠٢٥. ووجد CAISI بشكل منفصل أن قدرات GLM-٥.٢ السيبرانية مماثلة لـ Opus ٤.٦، الذي صدر في فبراير ٢٠٢٦.

ولا تعني هذه النتائج أن كل نموذج يتصرف بصورة متطابقة في كل مهمة. فهي نتائج مستمدة من تقييمات CAISI، بنقاط مقارنة مختلفة للقدرة الإجمالية والقدرة السيبرانية. ويكتسب هذا التمييز أهمية لأن ترتيب النماذج قد يتغير تبعاً للمهام المقاسة وتصميم التقييم وفئة السلوك محل الفحص.

ومع ذلك، يشكل التقييم مؤشراً بارزاً لمنظومة الذكاء الاصطناعي مفتوح الأوزان. إذ يضع استنتاج CAISI نموذج GLM-٥.٢ ضمن نقاش القدرات إلى جانب النماذج الاحتكارية الرائدة الحديثة، مع توضيح أن القدرة ليست سوى بُعد واحد من أبعاد النشر المسؤول.

الحقائق الموثقة

المقياسالتفصيل الموثقالمصدر
تاريخ الإصدارصدر GLM-٥.٢ في ١٦ يونيو ٢٠٢٦.تقييم NIST CAISI
تاريخ التقييميحمل التقييم العلني لـ CAISI تاريخ ٨ يوليو ٢٠٢٦.تقييم NIST CAISI
المطورZ.ai، المعروفة سابقاً باسم Zhipu AI؛ ويعرّفها CAISI كشركة مقرها PRC.تقييم NIST CAISI
فئة النموذجنموذج ذكاء اصطناعي مفتوح الأوزان.تقييم NIST CAISI
القدرة الإجماليةمماثلة لـ GPT-٥.٢ ضمن مجموعة تقييمات CAISI.ملخص NIST CAISI
القدرة السيبرانيةمماثلة لـ Opus ٤.٦ ضمن مجموعة تقييمات CAISI.ملخص NIST CAISI
نتيجة ضوابط الحمايةنتائج متباينة، تشمل المساعدة في تطوير استغلالات سيبرانية قائمة على الوكلاء وحجب عدد أقل من الأسئلة البيولوجية الحساسة مقارنة بالنماذج الأمريكية المرجعية.تقييم NIST CAISI

القدرة وضوابط الحماية سؤالان مختلفان

تنبع قيمة تقييم CAISI جزئياً من أنه لا يدمج القدرة والسلامة في درجة رئيسية واحدة. فهو يعرض مقارنة للقدرة الإجمالية، ومقارنة للقدرة السيبرانية، ونتائج منفصلة تتعلق بضوابط الحماية والأمن. والنتيجة القوية في فئة ما لا تلغي نتيجة في فئة أخرى ولا تثبتها ولا تتنبأ بها.

وبالنسبة إلى GLM-٥.٢، وجد CAISI أداءً متبايناً في ضوابط الحماية والأمن. ويذكر التقييم أن ضوابط حماية النموذج تتيح المساعدة في تطوير استغلالات سيبرانية قائمة على الوكلاء. كما يذكر أن ضوابط حماية GLM-٥.٢ تحجب عدداً أقل من الأسئلة البيولوجية الحساسة من النماذج الأمريكية المرجعية التي قيّمها CAISI.

في الوقت نفسه، يحدد التقرير نتيجة إيجابية أكثر تحديداً. فقد بدا GLM-٥.٢ محتملاً أن يكون أكثر متانة في مواجهة هجمات اختطاف الوكلاء وكسر الحماية من نماذج PRC الأخرى مفتوحة الأوزان التي جرى تقييمها. وهذه نتيجة مقارنة، وليست إعلاناً بأن النموذج محصن من أي من فئتي الهجمات. وتكتسب صياغة CAISI ونطاقه أهمية خاصة: فالنتيجة تخص مجموعة النماذج التي قيّمها واختبارات المتانة القائمة على المطالبات.

وهذا المزيج من النتائج هو تحديداً سبب عدم كفاية وصف مبسط مثل «آمن»...

تابع القراءة

سجل دخولك مجاناً لقراءة المقال كاملاً والوصول إلى أدوات الذكاء الاصطناعي.

تسجيل الدخول / إنشاء حساب
مرشد بوابة الذكاء الاصطناعي
نشط للخدمة
مرحباً بك في بوابة الذكاء الاصطناعي! أنا مرشدك هنا لمساعدتك في فهم خدمات المنصة، باقات التشغيل وخطط الضمان المالي. كيف يمكنني إرشادك اليوم؟