أطلقت أنثروبيك وOpenAI نماذج جديدة للذكاء الاصطناعي تجمع بين رفع مستوى الأداء وتقليل تكلفة الاستخدام، في وقت يتزايد فيه النقاش داخل قطاع الذكاء الاصطناعي حول سرعة تطوير النماذج المتقدمة والحاجة إلى التعامل معها بمزيد من الحذر.
وكشفت أنثروبيك عن نموذج Opus 5.5، الذي تصفه الشركة بأنه أكثر قدرة على التعامل مع المهام المعقدة، إلى جانب اكتشاف المشكلات البرمجية وإصلاحها، وتحليل البيانات المالية وتنفيذ مجموعة من مهام الأعمال التي تستهدف بشكل مباشر احتياجات الشركات والمستخدمين المحترفين.
وبحسب اختبارات أنثروبيك، تمكن Opus 5.5 من التفوق على GPT-6 Astra في مهام البرمجة الوكيلة ضمن اختباري Terminal-Bench 4.0 وFrontierCode v1.1 Main، وهو ما قد يزيد من الاعتماد عليه في المهام البرمجية التي تتطلب من النموذج تنفيذ خطوات متعددة بصورة مستقلة.
ولم تركز التحسينات على الأداء فقط، إذ تقول أنثروبيك إن Opus 5.5 أصبح قادرا على إنتاج نصوص أكثر وضوحا، كما انخفض ميله إلى محاولة تجاوز الحدود والضوابط بنسبة 85% مقارنة بالنماذج السابقة.
وفي الوقت نفسه، خفضت الشركة تكلفة تشغيل النموذج، حيث أصبح سعر مليون رمز إدخال 4 دولارات، بينما تبلغ تكلفة مليون رمز إخراج 20 دولارا، مقارنة بـ5 دولارات للإدخال و25 دولارا للإخراج في نموذج Opus 5، وهو ما يجعل استخدام النموذج أقل تكلفة في بعض المهام.
ومن جانبها، أطلقت OpenAI نموذجي GPT-6 Sol وGPT-6 Luna، مع تركيز واضح على تحسين الكفاءة وتقليل تكلفة الاستخدام، إلى جانب تطوير الأداء في مهام العمل الاحترافي والبرمجة واستخدام الحاسوب.
وتقول OpenAI إن النموذجين الجديدين دُرّبا باستخدام أساليب مشابهة لتلك التي اعتمدت عليها في GPT-6 Astra، مع إدخال تحسينات تستهدف المهام العملية، بينما تصل نسبة خفض التكلفة إلى 50% مقارنة بالأسعار الترويجية لنماذج GPT-5.6.
ويبلغ سعر مليون رمز إدخال في GPT-6 Sol نحو دولارين، مقابل 10 دولارات لمليون رمز إخراج، بينما ينخفض السعر في GPT-6 Luna إلى 10 سنتات لمليون رمز إدخال و50 سنتا لمليون رمز إخراج.
وتشير OpenAI أيضا إلى تحسن دقة النموذجين في التعامل مع المعلومات، موضحة أن GPT-6 Sol يرتكب نحو نصف عدد الأخطاء التي كان يرتكبها النموذج السابق، وهو تحسن يستهدف تقليل الأخطاء أثناء تنفيذ المهام التي تعتمد على النموذج.
وفي مجال البرمجة، تقول OpenAI إن GPT-6 Sol قادر على الوصول إلى مستوى أداء مماثل لنموذج Fable 5.1 مع تكلفة أقل، إلى جانب تحسينات في وضوح التواصل والاستفادة من تقنية تخزين سياق الأوامر مؤقتا، والتي تسمح بإعادة استخدام قدر أكبر من السياق وتسريع الاستجابات.
وامتدت التحسينات كذلك إلى جانب السلامة والالتزام بالضوابط، إذ تشير OpenAI إلى أن نماذج GPT-6 أصبحت أكثر التزاما بإجراءات السلامة وفقا لاختبارات الشركة الداخلية، مع انخفاض ميلها إلى تقديم معلومات غير صحيحة حول نتائج مهام البرمجة التي نفذتها، وارتفاع معدل رفض محاولات تجاوز إجراءات الحماية عند تلقي أوامر غير آمنة.
وتعمل أنثروبيك وOpenAI في الوقت نفسه على تطوير معايير يمكن لجهات التقييم الخارجية استخدامها عند قياس تطور نماذج الذكاء الاصطناعي ومستويات السلامة فيها، إلا أن مدى تحول هذه المقترحات إلى معيار موحد بين شركات تطوير الذكاء الاصطناعي لا يزال غير واضح.
وأصبح نموذج Opus 5.5 متاحا للمطورين عبر Claude، إضافة إلى Amazon Web Services وGoogle Cloud وMicrosoft Azure، ما يتيح استخدامه ضمن عدد من المنصات والخدمات الموجهة للمطورين والشركات.
أما GPT-6 Sol وGPT-6 Luna، فأصبحا متاحين عبر ChatGPT Work وCodex لعملاء خطط Plus وPro وBusiness وEnterprise، بينما يحصل مستخدمو الخطة المجانية ومشتركو Go على GPT-6 Luna فقط عبر تطبيق الشركة للحاسوب.
وتعكس هذه الإصدارات تركيزا متزايدا من أنثروبيك وOpenAI على تقديم نماذج قادرة على تنفيذ مهام أكثر تعقيدا، مع محاولة تقليل تكلفة تشغيلها وتحسين دقتها والتزامها بضوابط السلامة، في وقت تتجه فيه المنافسة بين شركات الذكاء الاصطناعي إلى الجمع بين القوة والكفاءة بدل الاعتماد على زيادة القدرات فقط.

إرسال تعليق