جيل جديد من نماذج Claude: من الإجابة إلى إنجاز المهام
أعلنت شركة Anthropic عن نموذجها الجديد Claude Fable 5 بوصفه قفزة كبيرة في سلسلة نماذجها اللغوية، ليس فقط من حيث القوة الحسابية أو الدقة، بل من حيث طبيعة الدور الذي يلعبه النموذج في سير العمل اليومي للمطورين والشركات. الفكرة الأساسية التي تروّج لها الشركة هي الانتقال من نموذج يجيب عن الأسئلة إلى نموذج يمكنه تولي مهمة معقّدة والعمل عليها لوقت طويل، مع قدر أعلى من الاستقلالية في التخطيط والتنفيذ.
بحسب Anthropic، يُعد Fable 5 أقوى نموذج طرحته للاستخدام العام حتى الآن، وأول نموذج بمستوى ما تسميه الشركة داخليًا بمستوى “Mythos” يُتاح للجمهور. هذا التصنيف الداخلي لا يتوفر عنه الكثير من التفاصيل العلنية، لكن الشركة تشير إلى أنه يمثل فئة أعلى من نماذج Claude المتاحة سابقًا من حيث القدرة على التعامل مع مهام معقّدة وطويلة الأمد.
من روبوت محادثة إلى طبقة عمل كاملة
التحوّل الأساسي الذي تسعى Anthropic إلى ترسيخه مع Fable 5 هو تغيير الصورة الذهنية للنموذج من كونه “مساعد محادثة ذكي” إلى كونه طبقة عمل يمكن أن تتولى أجزاء كاملة من دورة الإنتاج أو التطوير.
تقول الشركة إن النموذج قادر على:
- تجزئة المهام الكبيرة إلى خطوات فرعية وتشغيل عمليات داخلية متعددة.
- اختبار مخرجاته ذاتيًا وتحسينها على عدة دورات.
- الاستمرار في العمل على مشروع واحد لفترات أطول ضمن حدود الجلسة وسياق المحادثة.
هذا التوجه ليس معزولًا عن المشهد العالمي؛ فمنذ إطلاق OpenAI لنموذج GPT-4 وأدوات Assistants، وكذلك دخول Google بمشروع Gemini، أصبح التركيز منصبًا على تحويل النماذج من أدوات للإجابة إلى “وكلاء” Agents يمكنهم تنفيذ سلسلة من الخطوات للوصول إلى نتيجة ملموسة.
أداء طويل النفس في البرمجة والبحث وتحليل الوثائق
Anthropic تقدّم Fable 5 بوصفه نموذجًا مخصصًا للمساعدة في مجالات محددة ذات طبيعة عمل كثيفة:
- البرمجة: مراجعة قواعد شيفرة ضخمة، refactoring، اقتراح بنية أنظمة جديدة، ومساعدة الفرق في ترحيل الأنظمة من لغة إلى أخرى.
- البحث: تلخيص أوراق علمية طويلة، مقارنة نتائج دراسات مختلفة، وبناء مسودات أولية لتقارير أو مقترحات بحثية.
- تحليل المستندات: قراءة عقود أو وثائق قانونية أو تقارير مالية واستخراج النقاط الحرجة والمخاطر والفرص.
- رؤية الحاسوب: التعامل مع مستندات مصوّرة، جداول، رسوم بيانية، وربطها بمحتوى نصي ضمن نفس سياق المهمة.
الشركة تؤكد أن الفارق بين Fable 5 وبين نماذج Claude السابقة يتضاعف كلما زادت مدة المهمة وتعقّد السياق. بمعنى آخر، من الممكن ألا يظهر الفرق بشكل كبير في سؤال واحد قصير، لكن عند تكليف النموذج بمشروع يستمر لساعات من العمل التراكمي، تبدأ الفجوة في الأداء بالاتساع.
حالة Stripe: شهران من العمل في يوم واحد؟
من بين الأمثلة التي نشرتها Anthropic لإثبات قدرات Fable 5، تجربة لشركة المدفوعات الرقمية Stripe. وفق ما نشرته الشركة في مدونتها الرسمية، استطاع النموذج تولي جزء كبير من عملية ترحيل قاعدة بيانات ضخمة مكتوبة بلغة Ruby، وهي عملية معقّدة كان من المفترض أن تستغرق من فريق كامل أكثر من شهرين.
تفاصيل التنفيذ الدقيقة غير متاحة بالكامل، كما أن المعلومات المنشورة تأتي بالدرجة الأولى عبر رواية الشركة نفسها، لذا من الصعب التحقق المستقل من جميع الأرقام. مع ذلك، يتماشى هذا النوع من الأمثلة مع الاتجاه العام الذي ترصده تقارير تقنية، مثل تغطية موقع The Information وTechCrunch لتجارب الشركات مع النماذج التوليدية في أعمال البرمجة.
بحسب Anthropic، لم يقتصر دور Fable 5 على كتابة شيفرة جديدة، بل شمل أيضًا:
- تحليل البنية الحالية لقاعدة البيانات.
- اقتراح خطة ترحيل تشمل مراحل واختبارات.
- إجراء تعديلات متكررة استنادًا إلى نتائج الاختبار.
هذا النوع من المهام يقترب من وظيفة “مهندس برمجيات مساعد” أكثر منه وظيفة “مساعد محادثة”، وهو ما تحاول الشركة تثبيته كقيمة مضافة للنموذج.
السياق العالمي: سباق نحو النماذج الوكيلية
المشهد العالمي في الذكاء الاصطناعي يشهد تنافسًا حادًا على تطوير ما يُعرف بالـAI Agents أو الوكلاء الذكيين القادرين على تنفيذ مهام متسلسلة عبر الزمن. تقارير من Financial Times وWall Street Journal تشير إلى أن شركات التقنية الكبرى تسعى إلى تحويل النماذج اللغوية إلى منصات يمكنها تشغيل “عمال رقميين” يقومون بجزء معتبر من الأعمال المكتبية والبرمجية.
في هذا السياق، يمثل Fable 5 خطوة Anthropic في نفس الاتجاه الذي تسير فيه OpenAI مع نماذجها الأحدث، وGoogle مع Gemini، وMeta مع جهودها في نماذج المصدر المفتوح. الفارق الأساسي يكمن في كيفية بناء أدوات التحكم وسير العمل حول النموذج، وليس فقط في حجم البيانات أو عدد المعاملات.
آراء وملاحظات من مجتمع التقنية
التجارب المبكرة مع النماذج المتقدمة غالبًا ما تنتقل بسرعة إلى منصات مثل GitHub وReddit وHacker News. في حالات مشابهة مع إصدارات سابقة من Claude وGPT، رصدت تقارير لمواقع مثل The Verge وWired مزيجًا من الانبهار والحذر لدى المطورين:
- انبهار بقدرة النماذج على التعامل مع قواعد شيفرة لمشروعات قديمة معقدة.
- حذر من الاعتماد الكامل على النموذج في تغييرات بنيوية دون مراجعة بشرية دقيقة.
من المنطقي توقّع رد فعل مشابه مع Fable 5: حماس لتجربة قدراته في المهام الكبيرة، مع وعي بأن الأرقام التي تذكرها الشركات حول “شهرين من العمل في يوم واحد” تحتاج دائمًا إلى قراءة في سياقها، وأن دور الخبرة البشرية في مراجعة النتائج لا يمكن الاستغناء عنه، خاصة في الأنظمة الحساسة.
نقلة في طريقة استخدام النماذج لا في معرفتها فقط
النقطة التي تحاول Anthropic تأكيدها هي أن الابتكار في Fable 5 لا يقتصر على كونه أكثر معرفة أو أعلى في درجات الاختبار القياسية، بل في طريقة إدارته لسير عمل طويل. القدرة على الاحتفاظ بسياق مشروع واحد، وتشغيل “عمليات داخلية”، واختبار النتائج وإعادة المحاولة، كلها عناصر تجعل النموذج أقرب إلى شريك عمل رقمي منه إلى مساعد أسئلة وأجوبة.
إذا ثبتت قدرة النموذج على تقديم منتجات شبه مكتملة في مهام مثل ترحيل قواعد البيانات أو تصميم بنية أنظمة جديدة، فقد تغيّر هذه الفئة من النماذج شكل العلاقة بين المطورين وأدوات الذكاء الاصطناعي خلال السنوات المقبلة. أما في المنطقة العربية، فسيعتمد أثر هذه النماذج على سرعة توفير دعم عربي قوي، وظهور حلول محلية قادرة على الاستفادة منها ضمن الأطر التنظيمية والخصوصية السارية.
أكتب رأيك في التعليقات