تحسينات الذكاء الاصطناعي بين السرعة والأمان المعقد
شركة Anthropic تطلق نموذج Opus 5.5 أسرع وأرخص مع تحسينات في الأداء وتجربة المستخدم، لكن مع قيود أمان جديدة في البيولوجيا والأمن السيبراني تعكس توجه الشركة نحو تطوير آمن ومسؤول في عالم الذكاء الاصطناعي وورلد برس عربي.

هل تستحقّ ترقية نموذج ذكاء اصطناعي فقط لأنّه أرخص وأسرع من سابقه؟ هذا هو السؤال الذي يطرحه إعلان شركة Anthropic عن نموذجها الجديد Opus 5.5 يوم الثلاثاء، لكنّ الإجابة هذه المرّة أكثر تعقيداً من مقارنة الأسعار وحدها؛ فالشركة نفسها ربطت هذا الإصدار بقيودٍ أمنية جديدة تتعلّق بقدراتٍ حسّاسة في البيولوجيا والأمن السيبراني، وهو ما يستحقّ وقفةً قبل أيّ حديثٍ عن السرعة أو التكلفة.
ما الذي تغيّر فعلياً في Opus 5.5؟
وصفت Anthropic نموذجها الجديد بأنّه الأحدث في مجالَي البرمجة والأعمال المعرفية، وهو تصنيفٌ متوقّع من شركةٍ تُطلق منتجاً جديداً، لكنّ الأرقام المرفقة تستحقّ التمحيص. فبحسب إعلان الشركة، تفوّق Opus 5.5 على نموذج Fable الأكبر حجماً في العديد من اختبارات الأداء القياسية، بل أنجز مهامّ غير رسمية فشل Fable في إتمامها. الأهم عملياً بالنسبة لأيّ مطوّر يستخدم Claude يومياً: انخفض سعر المخرجات من 20 دولاراً لكل مليون رمز (توكن)، مقابل 25 دولاراً في النسخة السابقة، مع تراجع مؤشّرات تسعير أخرى أيضاً. النموذج أسرع أيضاً، بعد أن خفّضت Anthropic متطلّبات الحوسبة اللازمة لتشغيله. تحسينات أصغر لكن ملموسة في الاستخدام اليومي: لغة أقلّ اعتماداً على المصطلحات التقنية، ووضع المعلومات المهمّة في بداية الرسائل بدلاً من إخفائها في النهاية.
هذه كلّها تحسيناتٌ حقيقية، لكنّها ليست ثورية، وهي تندرج ضمن النمط المعتاد لتحديثات النماذج اللغوية: أداء أفضل بتكلفةٍ أقلّ، مع تحسينات تجربة استخدام هامشية.
أين يقف الإصدار الجديد ضمن تشكيلة Claude؟
تنقسم تشكيلة Claude إلى ثلاث فئات: Opus في القمّة كأقوى وأغلى نموذج، Sonnet في الفئة الوسطى، وHaiku كأسرع وأرخص خيار. جاء Opus 5 في 24 يوليو، وOpus 5.5 بعده بشهرين فقط، وهي وتيرة إصدار سريعة نسبياً. تخطّط Anthropic لإطلاق Sonnet 5.5 وHaiku 5.5 "في الأسابيع القادمة"، مع توقّعات بتحسيناتٍ مماثلة في الأداء لكلا النموذجين.
الثمن الخفي: قيود على البيولوجيا والأمن السيبراني
هنا يكمن الجزء الذي لا يظهر عادةً في الإعلانات التسويقية اللامعة. تقول Anthropic إنّ Opus 5.5 يُضاهي نموذج Mythos في قدراته المتعلّقة بالبيولوجيا والأمن السيبراني، وهذا التقارب في القدرات هو ما دفع الشركة إلى إخضاعه لنفس الضمانات المفروضة سابقاً على Fable، والتي ذكرتها في منشورٍ سابق حول ضمانات Fable البيولوجية. عملياً، تُقيّد هذه الضمانات قدرة النموذج على اكتشاف الثغرات الأمنية في البرامج المُصرّفة (compiled programs)، وتمنعه من المساعدة في تطوير أسلحة بيولوجية يمكن التعرّف عليها. بمعنى آخر: كلّما اقتربت النماذج من قدراتٍ مزدوجة الاستخدام، ازدادت القيود المفروضة عليها، بصرف النظر عن حجمها أو مكانتها في التشكيلة.
تباطؤ متعمّد بدلاً من سباقٍ أعمى
يمثّل Opus 5.5 أوّل إصدارٍ لـAnthropic منذ أن نشر الرئيس التنفيذي داريو أموداي في وقتٍ سابق من هذا الشهر مقالاً يدعو فيه إلى تبنّي وتيرةٍ أبطأ في تطوير النماذج المتقدّمة (frontier models). كتب أموداي في منشوره: "لقد أصبحتُ مقتنعاً بأنّ معالجة المخاطر معالجةً كاملة تتطلّب حذراً أكبر حتى"، مضيفاً أنّ المطلوب ليس "فقط الاستثمار في الوقاية من المخاطر، بل أيضاً ضبط وتيرة تقدّم القدرات كي يتسنّى للوقاية من المخاطر مواكبتها". هذا الموقف يفسّر لماذا حرصت الشركة على التأكيد أنّ تدريب Opus 5.5 على السلامة شابه إلى حدٍّ كبير تدريب النماذج السابقة، وأنّه خضع لتقييماتٍ خارجية قبل إطلاقه من جهتَي METR وFrontier Design، إضافةً إلى اختبارات المواءمة (alignment testing) الداخلية المعتادة.
لكنّ Anthropic لا تكتفي بما هو قائم؛ إذ تُعلن أنّها تُعدّ أنظمة تدريبٍ وتقييمٍ أكثر تطوّراً، تشمل قدراتٍ محسّنة في الأمان والمراقبة. وفي منشورها الرسمي، ربطت الشركة هذا التوجّه بمسؤوليةٍ أوسع تقع على عاتق السياسات العامة: "مع تزايد قدرات الذكاء الاصطناعي، ينبغي للسياسات العامة أن تؤدي دوراً أكبر في ضمان سلامة الأنظمة التي يعتمد عليها الناس. وبناء هذه القدرة يتطلّب وقتاً، وقد بدأنا في وضع البنية التحتية اللازمة لدعمها".
هذا خطاب يستحقّ الحذر المعتاد تجاه أيّ إعلانٍ من شركةٍ تُصرّح بأنّها تحدّ من قدرات منتجها بنفسها؛ فمن الصعب التحقّق مستقلاً من مدى صرامة هذه الضمانات أو فعاليتها الفعلية. ما هو مؤكّد أنّ الشركة لم تُقدّم تفاصيل تقنية كاملة بعد عن أنظمة الأمان والمراقبة الجديدة، مكتفيةً بالقول: "نتوقّع أن نُشارك مزيداً من التفاصيل حول هذه الجهود قريباً". إلى أن يحين ذلك، يبقى السؤال الأهمّ للمستخدمين والمطوّرين على حدٍّ سواء ليس فقط كم توفّر عليهم هذه الترقية من الدولارات لكل مليون رمز، بل ما إذا كانت وعود "ضبط الوتيرة" هذه ستتحوّل فعلاً إلى آلياتٍ قابلة للتدقيق، أم تبقى مجرّد التزامٍ لفظيّ يسبق كل إصدارٍ جديد.
أخبار ذات صلة

استعد ذكريات أول رحلة مدارية لمركبة ستارشيب (Starship)

هل GPT-6 Astra فعلاً ذكاء عام؟ OpenAI تؤكد دخولنا العصر الجديد

إطلاق ستارشيب من فلوريدا: SpaceX تستعدّ للمحاولة الأولى من منصّة 39A
