أعلنت Anthropic عن Claude Fable 5، وهو نموذج الذكاء الاصطناعي الرائد الجديد المتوفر بشكل عام. تقول الشركة إن Fable 5 هو النموذج الأكثر قدرة الذي يمكن الوصول إليه للعامة حتى الآن، وهو مصمم للتعامل مع مهام أطول وأكثر تعقيدًا من نماذج Claude السابقة. سلطت Anthropic الضوء على التحسينات في البرمجة وتطوير الموقع، والعمل المعرفي والبحث، ومهام الرؤية والسياق الطويل، وحدود الأمان الجديدة التي تؤثر على كيفية التعامل مع بعض الطلبات، والتوفر عبر منصة Claude وواجهة برمجة التطبيقات.
الترميز وتطوير الموقع
قام جيمي مارسلاند من Automattic بتجربة Fable 5 ولاحظ أن Fable 5 هو “المستوى التالي” بعد استخدامه لإنشاء قالب WordPress قابل للتحرير بالكامل.
غرد مارسلاند:
“الاختبار الأول: هل يمكن لـ Fable 5 إنشاء سمة كتلة WordPress؟
طلقة واحدة. قابلة للتحرير بالكامل. أنماط ووردبريس الأصلية.
نعم… هذا يبدو المستوى التالي.
لقطة شاشة لموقع الاختبار الذي تم إنشاؤه باستخدام Fable 5
تقول Anthropic إن Fable 5 تقدم بعضًا من أقوى مكاسبها في هندسة البرمجيات، موضحة أن النموذج الجديد يمكن أن يعمل بشكل مستقل لفترات أطول ويؤدي مهام ترميز معقدة مع إشراف بشري أقل من نماذج Claude السابقة.
على سبيل المثال، استشهد Anthropic بالاختبار الذي أجراه Stripe، والذي أفاد أن Fable 5 أكملت ترحيلًا على مستوى قاعدة التعليمات البرمجية في قاعدة بيانات روبي مكونة من 50 مليون سطر في يوم واحد. وقالت أنثروبيك إن نفس المهمة كانت ستتطلب فريق عمل لأكثر من شهرين.
وسلطت الشركة الضوء أيضًا على الأداء القياسي، مشيرة إلى أن Fable 5 حقق أعلى الدرجات بين النماذج الرائدة في تقييم FrontierCode الخاص بـ Cognition، والذي يقيس الأداء في مهام البرمجة الصعبة في قواعد التعليمات البرمجية لأسلوب الإنتاج.
تقول Anthropic أن Fable 5 يمكنه إعادة بناء الكود المصدري لتطبيق ويب من لقطات الشاشة، وهي قدرة تجمع بين هندسة البرمجيات والفهم البصري.
وبالنظر إلى ما شاركه مارسلاند حول قدرات Fable 5 في عرض “لقطة واحدة”، قد يمثل نموذج Anthropic الجديد تقدمًا كبيرًا لمشاريع تطوير الويب في العالم الحقيقي. بالنسبة للمواقع التي تم إنشاؤها باستخدام WordPress وAstro وأطر العمل الحديثة الأخرى، فقد يعني ذلك المساعدة في السمات والكتل والقوالب والمكونات واتصالات API وعمليات الترحيل وتصحيح الأخطاء. لا يقتصر الأمر على أن Fable 5 يمكنه إنشاء تعليمات برمجية فحسب، بل يبدو أنه قادر على العمل عبر مشروع بأكمله وإجراء تغييرات تعتمد على فهم كيفية تناسب الأجزاء معًا.
العمل المعرفي والبحث
تضع الأنثروبيك أيضًا Fable 5 كنموذج للمهام التحليلية والمعرفية المعقدة.
تقول الشركة إن Fable 5 حقق أعلى الدرجات في معيار Hebbia’s Finance Benchmark للاستدلال على مستوى رفيع وأظهر تحسينات في الاستدلال المستند إلى المستندات وتفسير الرسوم البيانية وحل المشكلات والتحليل. أبلغت IMC عن أداء قوي عبر البحث عن الحقائق والتفكير المفاهيمي وتحليل السبب الجذري وتحليل القيمة المتوقعة.
هذه القدرات ذات صلة بالعمل الذي يتطلب تحليل كميات كبيرة من المعلومات، وتجميع النتائج من المستندات، وتفسير البيانات، وتنفيذ مهام بحثية متعددة الخطوات.
بالنسبة إلى مُحسّنات محرّكات البحث والناشرين ومالكي المواقع، فإن هذا النوع من العمل يعين مهام مثل تحليل بيانات أداء البحث، ومراجعة قوائم جرد المحتوى الكبيرة، ومقارنة المستندات، وإيجاد الأنماط عبر التقارير، وتحويل المعلومات الفوضوية إلى بيانات جاهزة لاتخاذ القرار.
الرؤية والمهام طويلة السياق
تصف الأنثروبيك Fable 5 بأنها أقوى نموذج رؤية حتى الآن. وتقول الشركة إنها تستطيع استخلاص معلومات دقيقة من الشخصيات العلمية المعقدة وتنفيذ المهام البصرية التي كانت تتطلب في السابق أدوات إضافية أو أنظمة دعم.
تلقى النموذج أيضًا ترقيات في الذاكرة وأداء السياق الطويل. تقول Anthropic أن Fable 5 يمكن أن تظل مركزة عبر ملايين الرموز المميزة وتحسن عملها من خلال الإشارة إلى الملاحظات التي أنشأتها أثناء المهام طويلة الأمد.
بالنسبة للمستخدمين الذين يعملون مع مجموعات كبيرة من المستندات، والمشاريع الطويلة، ولقطات الشاشة، والصور، وسير العمل المعقد، يجب أن تكون مكاسب Fable 5 ذات السياق الطويل مفيدة لإدارة المشاريع المعقدة للغاية بحيث لا يمكن إجراء تبادل بسيط للإجابة السريعة.
حدود السلامة
تقول Anthropic إن قدرات Fable 5 تتطلب ضمانات جديدة قبل إصدارها على نطاق واسع.
قدمت الشركة مصنفات تكتشف فئات معينة من الطلبات وتوجهها إلى Claude Opus 4.8 بدلاً من السماح لـ Fable 5 بالرد مباشرة. وفقًا لـ Anthropic، تشمل الفئات المتضررة الأمن السيبراني، وعلم الأحياء، والكيمياء، ومحاولات استخراج القدرات النموذجية من خلال التقطير.
تقول Anthropic إن الإجراءات الوقائية تم تكوينها بشكل متحفظ عن عمد لتسريع النشر مع تقليل مخاطر سوء الاستخدام. واعترفت الشركة بأن النظام قد يلتقط بعض الطلبات غير الضارة، لكنها قالت إن الإجراءات الوقائية يتم تفعيلها في أقل من 5% من الجلسات في المتوسط.
وأوضحت الشركة:
“بدون ضمانات، يمكن إساءة استخدام قدرات Fable 5 في مجالات مثل الأمن السيبراني لإحداث أضرار جسيمة.”
يقول Anthropic إنه سيتم إعلام المستخدمين عندما يتم توجيه الطلب إلى Opus 4.8.
التوفر والتسعير
Claude Fable 5 متاحة حاليًا على جميع الخطط المدفوعة بدءًا من اليوم وحتى 22 يونيو، وبعد ذلك ستكون متاحة بناءً على أرصدة الاستخدام. والقصد من ذلك هو إتاحتها في النهاية للخطط المدفوعة في المستقبل.
وأوضح الأنثروبي:
“إذا سمحت السعة، فسنوسع النافذة المضمنة. بعد هذه النقطة – عندما تسمح لنا السعة الكافية بالقيام بذلك – نهدف إلى استعادة Fable 5 كجزء قياسي من خطط الاشتراك. ونعتزم القيام بذلك بأسرع ما يمكن.
طوال هذه الفترة، سنقوم بالإبلاغ عن أي تغييرات مسبقًا حتى يعرف المستخدمون أين وصلت الأمور.
بالنسبة للمطورين الذين ينشئون تطبيقات باستخدام Claude، قامت Anthropic بتسعير Fable 5 بسعر 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج من خلال واجهة برمجة تطبيقات Claude. رموز الإدخال هي النص والصور والمحتويات الأخرى المرسلة إلى النموذج، في حين أن رموز الإخراج هي الاستجابات التي تم إنشاؤها للنموذج.
الوجبات الجاهزة
تكمن أهمية Fable 5 للمطورين ومالكي المواقع ومُحسنات محركات البحث في قدرتها على العمل عبر مشاريع أكبر. تقدم Anthropic النموذج كأداة للتشفير والبحث والتحليل والمهام طويلة الأمد التي تتجاوز التفاعلات السريعة والاستجابة البسيطة المرتبطة بأنظمة الذكاء الاصطناعي السابقة.
اكتشاف المزيد من قمم التجارية للأعمال
اشترك للحصول على أحدث التدوينات المرسلة إلى بريدك الإلكتروني.
