كلاود Sonnet 4.6 رسميًا.. هل تغيّر الذكاء الاصطناعي فعلًا هذه المرة؟

عزوز عماد
0

شعار كلود Sonnet 4.6 الجديد من شركة Anthropic مع عبارة This is Sonnet 4.6
كلود Sonnet 4.6 رسميًا: أداء الفئة العليا بسعر الفئة المتوسطة


كل أسبوعين تقريبًا تُطلق إحدى شركات الذكاء الاصطناعي الكبرى نموذجًا جديدًا مع إعلان يصفه بأنّه "الأقوى على الإطلاق". في معظم الأحيان تفتحه، تجربه دقيقتين، وتعود لما كنت تفعله. لكن Sonnet 4.6 الذي أعلنت عنه Anthropic في السابع عشر من فبراير 2026 يستحق أن تتوقف عنده قليلًا، ليس لأنّ الإعلان برّاق، بل لأن الأرقام والشهادات خلفه غير معتادة.




الرقم الذي فاجأ الجميع


المطورون الذين جربوا النموذج في مرحلة الوصول المبكر فضّلوه على Sonnet 4.5 في 70% من الحالات. هذا وحده ليس مفاجئًا، التحديثات عادةً تكون أفضل من سابقاتها. المفاجأة الحقيقية أنّ 59% منهم فضّلوه حتى على Claude Opus 4.5، النموذج الأغلى والأقوى الذي أطلقته Anthropic في نوفمبر 2025.



بمعنى آخر، نموذج بسعر متوسط يتفوّق في الاختبارات الفعلية على نموذج من الفئة العليا. هذا تحوّل حقيقي في المعادلة، وليس مجرد تسويق.



السبب الذي ذكره المطورون أنفسهم، أنّ النموذج أقل "كسلًا"، يقرأ السياق بعمق قبل أن يعدّل أيّ كود، لا يكرر المنطق المشترك، ولا يدّعي إنجاز المهمة حين لم ينجزها فعلًا. هذه التفاصيل الصغيرة هي الفرق بين نموذج تستخدمه وآخر تتركه.




استخدام الحاسوب: من التجربة إلى الواقع


في أكتوبر 2024 أطلقت Anthropic أول نموذج ذكاء اصطناعي قادر على استخدام الحاسوب بشكل عام، ووصفته هي نفسها بأنّه "تجريبي وغير مكتمل في أحيان كثيرة". الصورة اليوم مختلفة.



على معيار OSWorld، المرجع الأكثر شيوعًا لاختبار قدرة الذكاء الاصطناعي على التعامل مع برامج حقيقية كـ Chrome و VS Code و LibreOffice، حقق Sonnet 4.6 تقدمًا ملموسًا قياسًا بكل نماذج Sonnet السابقة. لكن الأهم من الأرقام هو ما أفاد به المستخدمون الأوائل. النموذج بات يملأ نماذج متعددة الخطوات عبر تبويبات مختلفة، يتنقل داخل جداول بيانات معقدة، ويُنجز مهام كانت تستلزم يدًا بشرية حتى وقت قريب.



شركة Pace المتخصّصة في التأمين اختبرته على مهام استخدام الحاسوب وأعلنت أنه حقق دقة 94%، واصفةً إياه بأنه الأعلى أداءً من بين كل ما اختبرته. هذا النوع من الأرقام في قطاع التأمين ليس مجرد إحصاء، بل قرار تشغيلي حقيقي.




مليون رمز.. والأهم أنه يفهمها


نافذة السياق في Sonnet 4.6 تبلغ مليون رمز في مرحلة تجريبية. الرقم كبير، لكن الأرقام الكبيرة في الذكاء الاصطناعي أصبحت معتادة. ما يستحق الإشارة هنا أن النموذج لا يكتفي بـ"رؤية" هذا الحجم من النص، بل يستدل منه ويخطط عبره بفاعلية.



الدليل جاء من اختبار Vending-Bench Arena، وهو محاكاة تنافسية يدير فيها نماذج ذكاء اصطناعي مختلفة نشاطًا تجاريًا افتراضيًا لفترة محددة. Sonnet 4.6 لم يتبع الاستراتيجية المتوقعة، بدل السعي الفوري للأرباح، أنفق بكثافة على بناء الطاقة الإنتاجية في الأشهر العشرة الأولى، ثم حوّل مساره بشكل حاد نحو الربحية في المرحلة الأخيرة. التوقيت وحده جعله يتصدر المنافسة. لم يُبرمج أحد هذه الاستراتيجية له، استنبطها بنفسه.




التصميم.. مفاجأة لم يتوقعها أحد


هذا الجانب لم يكن في صلب ما أعلنته Anthropic، لكنه برز بشكل لافت في شهادات العملاء. شركات متعددة وصفت بشكل مستقل عن بعضها أن الواجهات المرئية والتقارير التي ينتجها Sonnet 4.6 تبدو أكثر صقلًا ونضجًا مقارنةً بأي نموذج سبقه. Triple Whale قال صراحةً إنه يمتلك "ذوقًا تصميميًا" يحتاج توجيهًا أقل بكثير للوصول إلى نتائج جاهزة للنشر.



هذا مثير للاهتمام لأن التصميم يُعدّ تقليديًا من أصعب المهام على الذكاء الاصطناعي، إذ يحتاج حسًا جماليًا يصعب برمجته. يبدو أن شيئًا ما تغيّر.




السعر لم يتغير.. وهذا هو الخبر الحقيقي


رغم كل ما سبق، يحتفظ Sonnet 4.6 بنفس تسعيرة Sonnet 4.5، ثلاثة دولارات لكل مليون رمز في المدخلات وخمسة عشر للمخرجات. أداء يقترب من الفئة العليا بسعر الفئة المتوسطة، هذه هي المعادلة التي تجعل هذا الإصدار مختلفًا فعلًا عن موجة الإعلانات المعتادة.



النموذج متاح الآن على جميع خطط Claude بما فيها المجانية، وأصبح النموذج الافتراضي على claude.ai. المطورون يصلون إليه عبر المعرف claude-sonnet-4-6 في واجهة برمجة التطبيقات.



شركات من حجم GitHub و Zapier و Databricks و Replit أعلنت تبنّيه بشكل رسمي. حين تتفق شركات بهذا التنوع على توصيف متقارب لنموذج واحد، فهذا مؤشر يصعب تجاهله.


المصدر

إرسال تعليق

0تعليقات

إرسال تعليق (0)