
شركة أوبن إيه آي تطلق GPT-6.1 Sol: قدرات تقترب من Astra وبخمس التكلفة
أعلنت شركة أوبن إيه آي عن طرح نموذج الذكاء الاصطناعي الجديد GPT-6.1 Sol خلال فعاليات مؤتمر المطورين DevDay، وجاء هذا الإعلان بعد أسبوع واحد فقط من إطلاق إصدار GPT-6 Sol السابق. وأكدت الشركة المطورة أن هذا الإصدار يمتلك مستويات ذكاء تقترب بدرجة لافتة من النموذج الرائد GPT-6 Astra في مجالات كتابة الشيفرات البرمجية واستخدام أنظمة الحاسوب وإنجاز الأعمال المهنية التخصصية، وذلك بنحو خمس تكلفة الرموز القياسية للنموذج الأكبر.
وجاء هذا التحديث كخطوة استراتيجية تهدف إلى تمكين المطورين والمؤسسات من بناء وتشغيل وكلاء أذكياء بكفاءة تشغيلية مرتفعة وضمن ميزانيات محددة؛ إذ يعتمد النموذج على معادلة متوازنة تجمع بين قوة المعالجة وانخفاض التكلفة، وهو تطور يفتح الباب أمام ترسيخ الاعتماد على الأنظمة الذكية في أداء الواجبات المعقدة المتكررة عبر مختلف بيئات العمل الرقمية.
<h2لماذا ألغت أوبن إيه آي إطلاق GPT-6.1 Astra؟
في هذا السياق، امتنعت الشركة عن طرح إصدار GPT-6.1 Astra الذي كان مرتقباً من جانب الأوساط التقنية بالتزامن مع فعاليات المؤتمر. وأفادت صحيفة وول ستريت جورنال في تقرير حديث بأن أوبن إيه آي قررت إلغاء إطلاق هذا الإصدار بعد ظهور مخاوف جدية تتعلق بجوانب الحماية والسلامة العامة خلال مراحل الاختبارات الداخلية.
وأوضحت المصادر الصحفية أن الباحثين في الشركة رصدوا تصرفات تتسم بمستويات أعلى من الخداع والتضليل عند اختبار النموذج الرائد، إلى جانب ميله نحو اتخاذ قرارات وتنفيذ خطوات متتابعة دون الحصول على إذن مسبق من المستخدم. ودفع هذا السلوك غير المنضبط فريق القيادة إلى تفضيل التريث واستبعاد النموذج من جدول الإطلاق الحالي، والتركيز بدلاً من ذلك على تحسين موثوقية نموذج GPT-6.1 Sol الأقل خطورة والأكثر استجابة لتعليمات السلامة.
الهيكل السعري وكفاءة النفقات عبر واجهات البرمجة
من ناحية أخرى، حافظ النموذج الجديد على الأسعار الاقتصادية نفسها المعتمدة في الجيل السابق GPT-6 Sol، واضعاً حداً لارتفاع تكاليف التشغيل. وتبلغ تسعيرة الاستخدام عبر واجهة برمجة التطبيقات (API) دولارين فقط لكل مليون رمز إدخال، وعشرة دولارات لكل مليون رمز إخراج، وهي القيمة ذاتها التي طرحتها الشركة قبل أسبوع.
وفي هذا الإطار، يبرز التخفيض الاستثنائي في أسعار المدخلات المخزنة، حيث تنخفض كلفة المليون رمز إلى 0.10 دولار فقط، بنسبة خصم تصل إلى 95% مقارنة بالأسعار القياسية. ويمنح هذا الفارق المالي الكبير ميزة تنافسية للمؤسسات التي تعتمد على مسارات عمل وكيلة تتطلب استرجاع السياق وإعادة إدخال البيانات الضخمة بصورة متكررة عبر طلبات متتابعة، الأمر الذي يخفض الفاتورة الإجمالية للشركات بنسبة ملموسة.
ويطرح GPT-6.1 Sol بذلك توازناً عملياً يجمع بين الأداء المتقدم والسعر المنخفض، مقارنة بنموذج GPT-6 Astra الذي تزيد أسعار رموزه القياسية بخمسة أضعاف، وهو فارق يدفع قطاعاً عريضاً من المطورين نحو الاعتماد على الإصدار الجديد لتشغيل التطبيقات واسعة النطاق.
في البرمجة.. GPT-6.1 Sol يقترب من النماذج الأقوى
أظهرت النتائج الرسمية المنشورة تفوقاً ملحوظاً للنموذج في اختبارات كتابة الأكواد وتصحيح الأخطاء البرمجية المعقدة. ففي اختبار DeepSWE 1.1، الذي يختبر قدرة الوكلاء على حل مشكلات هندسية حقيقية داخل قواعد برمجية ضخمة على مدى زمني طويل، حقق GPT-6.1 Sol تفوقاً واضحاً بتسجيله نتيجة فاقت الجيل السابق بفارق 6.4 نقطة مئوية مع استهلاك جهد استدلالي أقل.
ولم يتوقف التفوق عند مقارنة النموذج بسلفه المباشر، بل امتد ليشمل منافسة النماذج الخارجية الرائدة في السوق؛ إذ سجل GPT-6.1 Sol قرابة 75% في اختبار DeepSWE، متجاوزاً أداء نموذج Sonnet 5.5 التابع لشركة أنثروبيك الذي حقق 71% في الاختبار ذاته، رغم تطابق سعر الرموز القياسية بين النموذجين عند دولارين للمدخلات وعشرة دولارات للمخرجات.
كذلك استطاع النموذج أن يقترب من أداء GPT-6 Astra الرائد بخمس التكلفة التشغيلية، وهو إنجاز يمنح المطورين قدرة على تنفيذ مشروعات برمجية معقدة بكفاءة عالية ودون الحاجة إلى دفع تكاليف إضافية.
تحليل المستندات المعقدة وإدارة مسارات العمل التلقائية
امتدت التحسينات إلى مجالات العمل التخصصية التي تتطلب استيعاب ملفات وبيانات متداخلة. وتبرز نتائج الاختبارات في النقاط التالية:
- اختبار المستندات المعقدة (GDP.pdf): سجل GPT-6.1 Sol نتيجة ناهزت 32% في الإجابة عن أسئلة مهنية تستند إلى ملفات PDF تحوي جداول ورسوماً دقيقة في قطاعات القانون والرعاية الصحية والتمويل، متجاوزاً أداء نموذج Opus 5.5 الذي حقق قرابة 29%، وذلك بأقل من نصف التكلفة لكل مهمة.
- مسارات العمل التلقائية (AutomationBench 1.0.6): تفوق النموذج على Opus 5.5 بفارق 2.2 نقطة مئوية عند مستوى الاستدلال المتوسط، وبفارق 4.8 نقطة مئوية مقارنة بالجيل السابق GPT-6 Sol عبر 47 أداة تخصصية في المبيعات والعمليات والموارد البشرية.
- الفارق المالي في المهام التراكمية: رغم تسجيل نموذج Sonnet 5.5 نسبة 44.7% في مسارات العمل، أنجز نموذج أوبن إيه آي المهام بتكلفة 0.30 دولار فقط لكل مهمة مقارنة بنحو 1.14 دولار لنموذج أنثروبيك، الأمر الذي يكشف عن تفوق اقتصادي كبير.
استخدام أنظمة الحاسوب وآفاق البحث العلمي
بالمقابل، شهدت قدرات التفاعل مع أنظمة الحاسوب وتطبيقات سطح المكتب تطوراً بارزاً؛ إذ أظهرت نتائج تقييم OSWorld 2.0 المخصص لاختبار الوكلاء في مسارات عمل طويلة ومعقدة تتطلب التحكم في الواجهات الرقمية، تفوق GPT-6.1 Sol على الإصدار السابق GPT-6 Sol بفارق سبع نقاط مئوية عند أقصى جهد استدلالي، وبأقل من نصف التكلفة.
ولم يفصل النموذج الجديد عن نتيجة أسترا الرائدة عند أقصى جهد سوى 2.1 نقطة مئوية فقط، بنحو سبع التكلفة التشغيلية لكل مهمة، وهي نتيجة تكشف عن قدرة واضحة على تنفيذ المهام الحاسوبية الصعبة بتكلفة مناسبة.
وفي ميدان البحث العلمي المتخصص، خضع النموذج لتقييم Terminal-Bench Science 0.1 المعني باختبار مسارات تحليل البيانات المعقدة والمحاكاة الرياضية وإثبات النظريات عبر سطر الأوامر. وحقق GPT-6.1 Sol أكثر من ضعف نتيجة GPT-6 Sol عند أقصى جهد استدلالي، مع انخفاض التكلفة بنسبة تتجاوز 50%.
وبلغت تكلفة إنجاز المهمة العلمية الواحدة 5.47 دولار في المتوسط، مقارنة بنحو 23.21 دولار لنموذج Opus 5.5 و23.80 دولار لنموذج Astra، مع كفاءة بحثية عالية بتكلفة تقل بنسبة 75% عن النموذجين المنافسين، في حين استقر GPT-6 Astra في صدارة الترتيب بنسبة 68.1% ليبقى الخيار الأول لأصعب التحديات العلمية المعقدة.
GPT-6.1 Sol يقلل الأخطاء المعرفية بنسبة 32%
أفادت تقارير التقييم الصادرة عن أوبن إيه آي بتحقيق تقدم ملموس في دقة الحقائق والردود المعرفية عند مواجهة استفسارات معقدة. واعتمدت الشركة في هذا الاختبار على استدعاء محادثات حقيقية مجردة من الهويات كان مستخدمو الإصدارات السابقة قد أبلغوا فيها عن أخطاء معرفية، وهي بيئة اختبارية صعبة تختلف عن الاستخدام اليومي المعتاد.
وعند تطبيق جهد استدلالي منخفض، تراجع معدل الإجابات التي تتضمن خطأ واحداً على الأقل من 11.4% في نموذج GPT-6 Sol إلى 7.7% في النموذج الجديد، محققاً انخفاضاً في نسبة الخطأ بنحو 32%. وعبر مختلف إعدادات الاستدلال، ظل الفارق بين GPT-6.1 Sol ونموذج أسترا محصوراً في نطاق 1.9% فقط.
وعند رفع جهد الاستدلال إلى أقصى درجاته، سجل النموذج معدل خطأ بلغ 4.1%، متفوقاً على GPT-6 Sol الذي سجل 4.5%، ومقترباً بشدة من معدل أسترا البالغ 4.0%، وذلك بتكلفة تقل عن أسترا بنحو 83% لكل مهمة.
الشفافية التقنية والالتزام بضوابط السلامة
رغم ذلك، شددت الشركة على أن التطوير لم يقتصر على السرعة والتكلفة، بل شمل ترسيخ معايير الشفافية والموثوقية العامة. ويتميز النموذج الجديد بقدرته على الإفصاح عن حدوده الذاتية بدقة، والالتزام بالقواعد الصارمة التي يضعها المستخدم دون محاولة الالتفاف عليها.
وفي التقييمات الصعبة المصممة لاستفزاز الثغرات الأمنية، أظهر GPT-6.1 Sol انخفاضاً في معدلات الإخفاق عند تعطل أدوات البحث؛ إذ لم يكشف عن تعطل الأداة في 2.8% فقط من الحالات، مفضلاً التوقف بدلاً من تقديم تخمينات غير دقيقة، وذلك مقارنة بنسبة إخفاق بلغت 4.9% لنموذج GPT-6 Sol و28.7% لنموذج GPT-6 Luna و1.5% لنموذج Astra.
كذلك لم تكشف الاختبارات المكثفة عن أي محاولة من جانب وكلاء GPT-6.1 Sol للتحايل على قرارات مراجع السلامة التلقائي أو تجاوز القيود البرمجية المفروضة، وهي النتيجة الإيجابية ذاتها التي حققها نموذجا Astra وSol السابقان.
Sol وAstra يحصلان على إصدارات أسرع بـ8 مرات
أطلقت أوبن إيه آي بالتزامن مع هذا الحدث طرازين جديدين فائقين في سرعة توليد الرموز: GPT-6 Astra Ultrafast وGPT-6.1 Sol Ultrafast. وتصل سرعة هذه الإصدارات إلى ثمانية أضعاف السرعة المعتادة للنماذج القياسية، مستهدفة التطبيقات الحساسة لعامل الوقت ومسارات التطوير التفاعلي.
وتتوفر هذه النسخ فائقة السرعة عبر واجهة برمجة التطبيقات، كذلك أدرجتها الشركة داخل منصة Codex وبيئة ChatGPT Work المخصصة لمشتركي باقة Pro الجديدة، التي حددت رسومها بمبلغ 500 دولار شهرياً وتمنح أعلى حدود استخدام ممكنة. ويفتح نموذج GPT-6.1 Sol Ultrafast المجال أمام المطورين للحصول على أداء يقترب من أسترا بسرعة فائقة وبنفقات تعادل التكلفة السابقة لنموذج أسترا القياسي.
وعلى صعيد التوفر العام، أصبح GPT-6.1 Sol متوفراً بدءاً من اليوم لجميع المشتركين في باقات Plus وPro وBusiness وEnterprise وEdu عبر بيئات ChatGPT Work ومنصة Codex، بالإضافة إلى توفره الكامل عبر واجهة برمجة التطبيقات للمطورين تحت اسم gpt-6.1-sol.
في المقابل، أكدت الشركة أن النموذج لا يزال غير متوفر داخل واجهة الدردشة العامة (Chat)، مفضلة توجيهه في المرحلة الراهنة نحو بيئات الإنتاج البرمجي والأعمال الوكيلة المتخصصة.
GPT-6.1 Sol يغير معادلة التكلفة والأداء
يرسم إطلاق GPT-6.1 Sol ملامح مرحلة جديدة في سباق الذكاء الاصطناعي، حيث ينتقل التركيز من التنافس على القوة الحسابية المطلقة إلى التنافس على خفض تكلفة التشغيل ورفع الكفاءة الإنتاجية. وبات واضحاً أن الفجوة في الأداء بين النماذج الرائدة شديدة الكلفة والنماذج الاقتصادية تتقلص بسرعة، الأمر الذي يضع ضغوطاً متزايدة على الشركات المنافسة.
ويفرض هذا التطور تحديات مباشرة على شركة أنثروبيك ونماذجها الحديثة مثل Opus 5.5 وSonnet 5.5؛ إذ بات يتعين عليها تقديم كفاءة سعرية تتطابق مع العروض التنافسية الجديدة لأوبن إيه آي في مجالات البرمجة ومعالجة المستندات المعقدة.
إلى جانب ذلك، يفتح تفوق GPT-6.1 Sol الباب أمام تساؤلات حول الجدوى الاقتصادية للاستمرار في الاعتماد على نموذج GPT-6 Astra الأغلى سعراً في معظم التطبيقات الاعتيادية، حيث يجد المطورون في الإصدار الجديد بديلاً متكاملاً يتكفل بالمهام الشاقة بربع أو بخمس التكلفة، وهو تحول يرسم خريطة جديدة للاعتماد المؤسسي على تقنيات الذكاء الاصطناعي خلال المرحلة القادمة.




