Loading blog posts...
Loading blog posts...
جاري التحميل...

السعر المعلن لـ Claude Sonnet 5 أقل بنحو 33% حتى نهاية أغسطس، لكن المحتوى نفسه قد يستهلك رموزاً (tokens) أكثر بنسبة تصل إلى 35%. ويشير الإطلاق المرحلي غير المعتاد لـ GPT-5.6 إلى تحول أوسع في منافسة الذكاء الاصطناعي للمؤسسات: التفوق في الاختبارات مهم، لكن النشر المنضبط، وقابلية التدقيق، واستمرارية الأعمال مهمة أيضاً.
دخل GPT-5.6 Sol مرحلة المعاينة في 26 يونيو 2026، لأن OpenAI رأت أن قدراته في الأمن السيبراني قوية بما يكفي لتتطلب اختبارات إضافية. وخلال المرحلة المقيّدة، استخدمت الشركة مستويات وصول مختلفة، وفحوصاً فورية للمحتوى الناتج، ومراقبة للحسابات، وضوابط للتنفيذ (معاينة OpenAI لنموذج GPT-5.6 Sol).
لم تتحول الفترة المقيّدة إلى معاينة خاصة طويلة. ففي 9 يوليو، أطلقت OpenAI نماذج Sol وTerra وLuna عبر ChatGPT وCodex وAPI، ثم وسّعت الإتاحة عالمياً خلال نحو 24 ساعة (إطلاق OpenAI لنماذج GPT-5.6).
هذه الخطوات أهم من التأخير القصير نفسه. فقد تعاملت OpenAI مع نطاق الإطلاق باعتباره أحد ضوابط السلامة التي يمكن تعديلها بعد الاختبار، بدلاً من النظر إلى الإتاحة كقرار ثنائي: إطلاق أو عدم إطلاق.
قد يصبح هذا الأسلوب هو النمط المعتاد للنماذج التي تمتلك قدرات متقدمة في الأمن السيبراني، أو استخدام الكمبيوتر، أو الأدوات المستقلة. ومن المرجح أن تخضع الميزات عالية المخاطر لقواعد وصول منفصلة، حتى عندما يكون النموذج الأساسي متاحاً بشكل عام.
Note
الإطلاق المرحلي ليس هو نفسه الإصدار التجريبي المحدود. على فرق المشتريات تسجيل التاريخ الذي يصبح فيه كل نموذج وميزة ومنطقة وواجهة جاهزاً للاستخدام الفعلي.
أما القراءة المخالفة للسائد، فهي أن تأخير الوصول قد يقوّي عرض المنتج للمؤسسات. فقد يكون اعتماد مزوّد يقيّد ميزة خطرة أسهل من اعتماد مزوّد يعد بوصول فوري وشامل للجميع.
لماذا يهم ذلك: أصبح على المشترين في المؤسسات تقييم عملية الإطلاق نفسها، وليس النموذج الذي يجري إطلاقه فقط.
حددت OpenAI أسعار GPT-5.6 بوصفه عائلة من النماذج، لا منتجاً رئيسياً واحداً. لكل مليون رمز، تبلغ تكلفة الإدخال في Sol نحو $5 والإخراج $30، بينما تبلغ في Terra نحو $2.50 و$15، وفي Luna نحو $1 و$6 (إطلاق OpenAI لنماذج GPT-5.6).
| النموذج | تكلفة الإدخال لكل مليون رمز | تكلفة الإخراج لكل مليون رمز | الدور المرجح في أعباء العمل |
|---|---|---|---|
| GPT-5.6 Sol | $5 | $30 | الأمن السيبراني، واستخدام الكمبيوتر، والاستدلال المعقد |
| GPT-5.6 Terra | $2.50 | $15 | سير العمل متعدد الخطوات في المؤسسات |
| GPT-5.6 Luna | $1 | $6 | التصنيف، والاستخراج، وإنشاء المحتوى الروتيني |
| Claude Sonnet 5، السعر الترويجي | $2 | $10 | البرمجة، والمهام متعددة الوسائط، وعمل الوكلاء |
| Claude Sonnet 5، السعر القياسي | $3 | $15 | أعباء العمل نفسها بعد 31 أغسطس |
تكلفة إخراج استجابة واحدة من Sol تساوي خمسة أضعاف تكلفة Luna، حتى قبل احتساب استدعاءات الأدوات أو إعادة المحاولة أو تكاليف الاستدلال الإضافية. لذلك، فإن إرسال كل طلب إلى Sol سيلغي معظم الوفورات التي توفرها المستويات الأقل تكلفة.
أما التصميم الأكثر فائدة، فيوزّع العمل حسب درجة المخاطر والتعقيد. يمكن لـ Luna معالجة التلخيص أو الاستخراج، بينما يتولى Terra التحليلات متعددة المراحل، ويُخصّص Sol للحالات التي تتطلب استدلالاً أعمق أو استخداماً منضبطاً للكمبيوتر.
يحتاج التوجيه أيضاً إلى قواعد واضحة للتصعيد. ينبغي للنموذج منخفض التكلفة أن يحوّل المهمة إلى نموذج آخر عندما تنخفض ثقته، أو تصبح الأدوات المطلوبة حساسة، أو قد يؤدي الناتج إلى قرار تجاري مهم.
خلال الربعين المقبلين، يُرجّح أن يتحول توجيه النماذج من مشروع لتحسين الكفاءة إلى وظيفة أساسية في المنصة. ولن يكون المؤشر الأهم هو متوسط سعر الرمز، بل تكلفة كل مهمة مقبولة بعد إعادة المحاولة والمراجعة.
لماذا يهم ذلك: يكافئ هيكل أسعار GPT-5.6 المؤسسات التي تصنّف أعباء العمل قبل اختيار النماذج.

تبلغ تكلفة Claude Sonnet 5 نحو $2 لكل مليون رمز إدخال و$10 لكل مليون رمز إخراج حتى 31 أغسطس 2026 فقط. وفي 1 سبتمبر، يعود السعر القياسي إلى $3 و$15، ما يجعل العرض التمهيدي أرخص بنحو 33% من السعر اللاحق المعلن (إعلان Anthropic عن Claude Sonnet 5).
قد يفشل مشروع تجريبي اعتُمدت ميزانيته بناءً على فواتير أغسطس في تحقيق هدف التكلفة لشهر سبتمبر، حتى من دون أي تغير في حجم الاستخدام. لذلك، ينبغي أن تعتمد النماذج المالية السعر القياسي كأساس، وأن تتعامل مع العرض الترويجي باعتباره وفراً مؤقتاً.
ويضيف نظام تقسيم النص إلى رموز (tokenizer) تعقيداً آخر. تقول Anthropic إن المحتوى نفسه قد يحتاج إلى عدد رموز يتراوح بين 1.0 و1.35 ضعفاً، لذلك لا يضمن انخفاض سعر الرمز أن تكون المهمة المكتملة أقل تكلفة (إعلان Anthropic عن Claude Sonnet 5).
يجب أن تقيس المقارنة العادلة العمل المكتمل، لا عملية الاستدلال وحدها. ويشمل ذلك الإدخال، والإخراج، والسياق المخزّن مؤقتاً، واستدعاءات الأدوات، وإعادة المحاولة، وزمن الاستجابة، وعمليات التشغيل الفاشلة، والمراجعة البشرية.
| عنصر التكلفة | ما ينبغي للمشتريات قياسه | نقطة غائبة شائعة |
|---|---|---|
| استخدام الرموز | عدد الرموز لكل مهمة ناجحة | مقارنة الأسعار المعلنة فقط |
| تنفيذ الوكيل | استدعاءات الأدوات وحلقات التخطيط المتكررة | تجاهل الإجراءات غير الناجحة |
| زمن الاستجابة | الوقت اللازم للوصول إلى ناتج معتمد | اعتبار العمل البطيء مجانياً |
| الموثوقية | معدل إكمال المهام من دون تدخل | استبعاد عمليات إعادة المحاولة |
| المراجعة البشرية | الدقائق المستغرقة في الفحص أو التصحيح | افتراض أن الاستقلالية تلغي العمل البشري |
| التخزين المؤقت | السياق المعاد استخدامه وأسعار التخزين المؤقت | اختبار الطلبات الباردة فقط |
ومع ذلك، يظل العرض الترويجي مفيداً. فهو يمنح الفرق نافذة تمتد لشهرين لاختبار أعباء العمل، لكن يجب أن تظل العقود ودراسات الجدوى قابلة للاستمرار بعد ارتفاع السعر في سبتمبر.
لماذا يهم ذلك: قد يكون Claude Sonnet 5 اقتصادياً، لكن قياسات تكلفة المهمة الكاملة هي وحدها التي تثبت ذلك.
يتصدر GPT-5.6 Sol عدة اختبارات ركزت عليها OpenAI، منها 92.2% في BrowseComp، و62.6% في OSWorld 2.0، و88.8% في Terminal-Bench 2.1 (إطلاق OpenAI لنماذج GPT-5.6). وتشير هذه النتائج إلى قوة في استرجاع المعلومات، والتفاعل مع الكمبيوتر، والعمل عبر الطرفية.
تُظهر مواد المقارنة التي نشرتها OpenAI أيضاً تفوق نماذج تحمل اسم Claude في اختبارات محددة للبرمجة والأمن السيبراني. لكن المواد المقدمة تتنقل بين Sonnet 5 وFable 5 وMythos 5، لذلك يجب التحقق من هويات هذه النماذج وإعداداتها عبر المصادر الأصلية قبل نشر مقارنات مباشرة.
يعكس هذا التضارب مشكلة أوسع في المشتريات. يصعب تفسير نتيجة أي اختبار إذا اختلف إصدار النموذج، أو ميزانية الاستدلال، أو إعداد الأدوات، أو بنية الموجهات، أو طريقة احتساب الدرجات.
تظل اختبارات المزوّدين مفيدة لإعداد قائمة أولية بالنماذج. لكنها لا تغني عن اختبار مهام تمثل الاستخدام الفعلي، مع صلاحيات بيئة الإنتاج، وحدود زمن الاستجابة، ومعايير المراجعة.
ينبغي أن تتضمن مجموعة التقييم العملية مهام ناجحة، وطلبات غامضة، وحالات فشل في الصلاحيات، ومحاولات لحقن الموجهات، وأدوات غير متاحة، وطلبات يجب على الوكيل رفضها. قياس الدقة في الحالات المثالية فقط يعطي صورة مبالغاً فيها عن الجاهزية للإنتاج.
من غير المرجح أن يفرز السوق فائزاً واحداً في جميع المجالات خلال النصف الثاني من 2026. ستظل البرمجة، والبحث، واستخدام المتصفح، والتحليل السيبراني، ومعالجة الوسائط المتعددة، والمهام اللغوية الروتينية تنتج متصدرين مختلفين.
Warning
لا تتعامل مع إصدارات النماذج المتشابهة في الاسم باعتبارها متطابقة. سجّل معرّف النموذج الدقيق، وتاريخ الوصول، والمنطقة، والإعدادات، ومنظومة التقييم لكل نتيجة.
لماذا يهم ذلك: الفائز الحقيقي هو النموذج الذي ينجز عبء عمل محدداً بأمان وبشكل متكرر.
أقوى حجة تقدمها OpenAI للمؤسسات هي قدرتها التشغيلية على نطاق واسع. تفيد الشركة بأن لديها أكثر من مليون عميل من قطاع الأعمال، وأكثر من 7 ملايين مقعد عمل، ونمواً سنوياً بنحو 9 أضعاف في عدد مقاعد ChatGPT Enterprise (تقرير OpenAI عن حالة الذكاء الاصطناعي في المؤسسات لعام 2025).
كما تفيد OpenAI بأن أكثر من 9,000 مؤسسة عالجت أكثر من 10 مليارات رمز، بينما تجاوزت قرابة 200 مؤسسة حاجز تريليون رمز. هذه أرقام استخدام أعلنتها الشركة، وليست قياسات مستقلة وموثقة للحصة السوقية.
عند هذا الحجم، تصبح ثقة المؤسسات مسألة تشغيلية. يحتاج المشترون إلى تحديد مكان إقامة البيانات، وخيارات تشفير يديرها العميل، وسجلات تدقيق، وضوابط للاحتفاظ بالبيانات، والتزامات تعاقدية بالخصوصية، وسير عمل متوافق مع عدم الاحتفاظ بالبيانات (خصوصية المؤسسات لدى OpenAI).
تسلك Anthropic مساراً مختلفاً. تربط Compliance API نشاط Claude بأكثر من 60 مزوّداً لحلول الأمن والامتثال في مجالات الهوية، ومنع فقدان البيانات، وSIEM، والوصول الآمن، والاكتشاف الإلكتروني، وقابلية المراقبة، وإدارة أمن الذكاء الاصطناعي (تكاملات Anthropic الأمنية).
قد تكون طبقة التكامل هذه أهم من إضافة لوحة تحكم خاصة أخرى. فالمؤسسات الكبيرة تحقق بالفعل في الحوادث من خلال منصات الهوية، وأدوات العمليات الأمنية، وإجراءات حفظ الأدلة المعتمدة لديها.
تشير Anthropic أيضاً إلى سياسة التوسع المسؤول، واختبارات الفريق الأحمر، وأبحاث حقن الموجهات، وضوابط سلسلة التوريد، وبرنامج التحقق السيبراني، وشهادة إدارة الذكاء الاصطناعي ISO/IEC 42001 (مركز الشفافية لدى Anthropic).
تقدم OpenAI نطاقاً واسعاً من الاستخدام والضوابط المخصصة للمؤسسات. أما Anthropic، فتركز على الحوكمة والتكامل العميق مع أنظمة الأمن الحالية. لكن أياً من الميزتين لا يلغي حاجة العميل إلى إجراء اختباراته الخاصة.
لماذا يهم ذلك: تعتمد ثقة المؤسسات الآن على إمكانية مراقبة نشاط الذكاء الاصطناعي، والتحقيق فيه، وتقييده، وتدقيقه.

يُعد استدعاء الأدوات برمجياً وتنسيق عدة وكلاء في النسخة التجريبية من القدرات الأساسية في GPT-5.6، وليسا ميزتين ثانويتين (إطلاق OpenAI لنماذج GPT-5.6). وبالمثل، يركز Claude Sonnet 5 على البرمجة القائمة على الوكلاء وسير العمل متعدد الوسائط (إعلان Anthropic عن Claude Sonnet 5).
يمكن لهذه الأنظمة تصفح الويب، وتشغيل الأدوات، وتعديل الملفات، واستدعاء الخدمات الداخلية، وتمرير المعلومات بين الوكلاء. لذلك، تشمل الحدود الأمنية كل بيانات اعتماد، وموصل، وصفحة خارجية، ومخزن ذاكرة، وخطوة موافقة تشارك في التنفيذ.
يصبح حقن الموجهات خطراً بشكل خاص عندما يستطيع محتوى غير موثوق التأثير في وكيل يمتلك صلاحيات كتابة. فقد تعيد صفحة ويب ضارة أو تعليمات داخل مستودع توجيه النموذج، من دون استغلال كود التطبيق بالطريقة التقليدية.
الاستجابة المعتادة هي تطبيق مبدأ الحد الأدنى من الصلاحيات. يجب فصل صلاحية القراءة عن الكتابة، وأن تكون بيانات الاعتماد قصيرة العمر، وأن تتطلب الإجراءات عالية التأثير فحوصاً حتمية للسياسات أو موافقة بشرية.
إيقاف الوكيل مهم بقدر أهمية تشغيله. تحتاج الفرق إلى حدود للتنفيذ، وميزانيات لاستدعاء الأدوات، وضوابط لإلغاء الصلاحيات، وسجلات تتبع كاملة، وطريقة لإنهاء عمليات التشغيل النشطة من دون انتظار تعاون النموذج.
للمزيد حول تفوق وتيرة تطور أدوات الوكلاء على تحسينات النماذج الأساسية، راجع اتجاهات تطوير الذكاء الاصطناعي: أدوات الوكلاء تتفوق على النماذج.
بحلول أواخر 2026، سيصبح تصميم صلاحيات الوكلاء على الأرجح جزءاً من المراجعات القياسية لإدارة الهوية والوصول. وسيُعامل النموذج كمشغّل غير بشري، لا كواجهة محادثة.
لماذا يهم ذلك: تتحدد المخاطر الفعلية للوكيل حسب صلاحياته وأدواته، لا حسب نتيجته في الاختبارات.
تضمن إطلاق GPT-5.6 اختبارات إضافية ومناقشات، وفقاً للتقارير، مع مسؤولين في الحكومة الأمريكية بسبب قدرات النموذج السيبرانية (Axios). أما الادعاءات الأوسع بشأن الحظر أو استعادة الوصول، فلا ينبغي اعتبارها حقائق مؤكدة من دون وثائق أصلية أقوى.
ومع ذلك، يظل القلق الأساسي للمؤسسات مشروعاً. فقد تتغير شروط الوصول، وسياسات السلامة، والأسعار، والإتاحة الإقليمية، والعلاقات التنظيمية بسرعة تتجاوز دورة المشتريات المعتادة.
يحوّل التصميم المعتمد على مزوّد واحد هذه التغيرات إلى حوادث تمس استمرارية الأعمال. أما نهج تعدد المزوّدين، فيقلل المخاطر عبر إبقاء الموجهات، والتقييمات، وطبقات الاسترجاع، وسياسات الموافقة قابلة للنقل.
لا تعني قابلية النقل إرسال كل طلب إلى عدة مزوّدين. بل تعني إمكانية نقل سير عمل أساسي من دون إعادة بناء نموذج البيانات، وسياسة الأمن، ومجموعة الاختبارات، ونظام المراقبة من الصفر.
| ضابط الاستمرارية | الأدلة الواجب الاحتفاظ بها | وتيرة المراجعة |
|---|---|---|
| قائمة النماذج | الإصدارات والمناطق والمالكون بدقة | شهرياً |
| مجموعة تقييم قابلة للنقل | مهام ممثلة للاستخدام وحدود القبول | مع كل إصدار |
| خطة الخروج | المزوّد البديل وتسلسل الترحيل | كل ربع سنة |
| إجراء تصدير البيانات | السجلات، والموجهات، ومسارات التتبع، والمخرجات المحفوظة | كل ربع سنة |
| سيناريوهات الأسعار | التكاليف القياسية والترويجية وتكاليف الاستخدام الكبير | شهرياً |
| وضع التشغيل المحدود | بديل يدوي أو أقل قدرة | تمرين مرتين سنوياً |
يغيّر هذا أيضاً طريقة مراجعة العقود. فإشعارات إيقاف النماذج وتغيير الأسعار، وشروط تصدير البيانات، والتواصل عند وقوع الحوادث، والتزامات مستوى الخدمة، تستحق الآن الاهتمام نفسه الذي تحظى به أسعار الرموز.
يمكن للفرق التي تتابع تغيرات الإصدارات المتكررة استخدام عملية داخلية مشابهة لما يوضحه دليل رادار أخبار الذكاء الاصطناعي. والخطوة الأهم هي ربط مراقبة الإصدارات بالمسؤولين، والاختبارات، وقرارات إدارة التغيير.
لماذا يهم ذلك: تشمل الثقة في المزوّد القدرة على مواصلة العمل عندما يغيّر المزوّد مساره.

ابدأ من هنا
اختر سير عمل واحداً للذكاء الاصطناعي في بيئة الإنتاج، وسجّل تكلفته الحالية لكل مهمة مقبولة، بما يشمل الرموز، وإعادة المحاولة، واستدعاءات الأدوات، وزمن الاستجابة، والمراجعة البشرية.
خطوات سريعة
$3 للإدخال و$15 للإخراج لكل مليون رمز.تعمّق أكثر
المنافسة بين OpenAI وAnthropic في يوليو 2026 ليست مجرد مواجهة بين GPT-5.6 وClaude Sonnet 5. تجمع OpenAI بين نماذج مقسّمة حسب المستوى وانتشار مثبت على نطاق واسع، بينما تنافس Anthropic عبر الأسعار، والحوكمة، والتكامل مع منظومة الأمن.
القرار الفوري ليس تحديد المزوّد الأفضل عموماً. بل تحديد النموذج الذي ينجز كل عبء عمل بتكلفة مقبولة، وبصلاحيات قابلة للتنفيذ، مع أدلة كافية للتحقيق في حالات الفشل.
خلال الأشهر الستة المقبلة، من المتوقع أن تصبح الإصدارات المرحلية للقدرات، والأسعار المؤقتة، وتوجيه النماذج، وضوابط هوية الوكلاء، والتقييمات القابلة للنقل متطلبات معتادة لدى المؤسسات. وستتكيف الشركات التي تقيس الثقة بالأدلة التشغيلية أسرع من تلك التي تتعامل معها كوعد من المزوّد.