في 23 أبريل 2026، أطلقت OpenAI رسميًا GPT-5.5، وقدّمته بوصفه نموذجها في الذكاء الاصطناعي الأذكى والأكثر بداهة حتى اليوم.
ولا يقف GPT-5.5 عند حدود تطوّر تقني بسيط، بل يجسّد فئة جديدة من الذكاء: ذكاء اصطناعي صُمّم من أجل تنفيذ عمل حقيقي، وإدارة المهام المعقّدة، والعمل بصفته وكيلًا مستقلًا على الحاسوب.
ذكاء يركّز على القصد والتنفيذ
يُحدث GPT-5.5 قطيعة واضحة مع النماذج الحوارية التقليدية. وتؤكد OpenAI أن النموذج يفهم قصد المستخدم بسرعة أكبر ويستطيع «تولّي جزء أكبر من العمل بنفسه».
عمليًا، يستطيع GPT-5.5:
- تفسير التعليمات الغامضة أو الناقصة،
- وضع استراتيجية للتنفيذ،
- استخدام الأدوات (تصفّح الويب، الشيفرة البرمجية، البرمجيات، المستندات)،
- التحقق من نتائجه،
- متابعة المهمة حتى إنجازها كاملة.
تضع هذه القدرة GPT-5.5 في صميم الذكاء الاصطناعي الوكيلي (Agentic AI)، حيث لا يكتفي الذكاء الاصطناعي بالإجابة، بل ينفّذ ويواصل العمل على مدى زمني طويل.
تقدّم حاسم حيث يكون الاستدلال الطويل ضروريًا
توضح OpenAI أن أبرز ما حققه GPT-5.5 من تقدّم يتركّز في مجالات يتوقف النجاح فيها على الاستدلال عبر السياق والزمن:
- البرمجة الوكيلية (Codex)،
- الاستخدام المستقل للحاسوب،
- العمل المعرفي (التحليل، التلخيص، إعداد التقارير)،
- البحث العلمي الاستكشافي.
تتطلب هذه المجالات أكثر من مجرد إجابات صحيحة: تتطلب المثابرة والاتساق والقدرة على اتخاذ قرارات متتالية ومترابطة.
مقارنة الأداء مع النماذج المرجعية الأخرى
يعرض الجدول التالي أهم الاختبارات المعيارية (benchmarks) التي نشرتها OpenAI، على منوال المقارنة الرسمية.
مقارنة GPT-5.5 مع GPT-5.4 وClaude Opus 4.7 وGemini 3.1 Pro
| الاختبار المعياري / القدرة | GPT-5.5 | GPT-5.4 | Claude Opus 4.7 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Terminal-Bench 2.0 مسارات عمل معقّدة ومتعددة الأدوات | 82.7% | 75.1% | 69.4% | 68.5% |
| GDPval (44 مهنة) حالات الفوز أو التعادل | 84.9% | 83.0% | 80.3% | 67.3% |
| OSWorld-Verified الاستخدام المستقل لبيئة تشغيل | 78.7% | 75.0% | 78.0% | — |
| Toolathlon تنسيق الأدوات | 55.6% | 54.6% | — | 48.8% |
| BrowseComp تصفّح الويب وفهم محتواه | 84.4% | 82.7% | 79.3% | 85.9% |
| FrontierMath (المستويات من 1 إلى 3) | 51.7% | 47.6% | 43.8% | 36.9% |
| FrontierMath (المستوى 4) | 35.4% | 27.1% | 22.9% | 16.7% |
| CyberGym الأمن السيبراني | 81.8% | 79.0% | 73.1% | — |
الخلاصة الأساسية
في Terminal-Bench 2.0، وهو الاختبار المعياري الأبرز للعمل الوكيلي، يتفوّق GPT-5.5 على Claude Opus 4.7 بأكثر من 12 نقطة، ما يؤكد تقدّمه الواضح في المهام المعقّدة ومتعددة المراحل والمعتمدة على الأدوات. أداء أعلى دون تنازل عن السرعة.
على الرغم من مستوى ذكائه الأعلى، يحافظ GPT-5.5 على زمن استجابة مماثل لزمن GPT-5.4 في بيئة الإنتاج.
ويحقق هذه النتيجة مع استخدام عدد أقل من الرموز (tokens) لإنجاز المهام نفسها، خصوصًا في البرمجة مع Codex.
بالنسبة إلى المؤسسات، يعني ذلك:
- أداءً أعلى،
- كفاءة تشغيلية أفضل،
- تكلفة نسبية أكثر انضباطًا عند العمل على نطاق واسع.
GPT-5.5 في Codex و ChatGPT: من المساعد المرافق إلى الوكيل المستقل
في Codex، يُظهر GPT-5.5 قدرة أقوى على:
- فهم البنية العامة لنظام برمجي،
- تحديد السبب الحقيقي للمشكلة،
- استباق آثار أي تغيير،
- حلّ التذاكر المعقّدة من المحاولة الأولى.
في ChatGPT، تتيح النسختان GPT-5.5 Thinking وGPT-5.5 Pro معالجة مسائل أكثر تعقيدًا بإجابات أشمل وأحسن تنظيمًا وأكثر موثوقية، خصوصًا في الاستخدامات التجارية والقانونية والتعليمية والعلمية.
لبنة مركزية في بنية الذكاء الاصطناعي المستقبلية
تقدّم OpenAI نموذج GPT-5.5 بوصفه مرحلة مفصلية نحو بنية تحتية عالمية للذكاء الاصطناعي الوكيلي، قادرة على مضاعفة الإنتاجية البشرية بشكل جذري.
والطموح واضح: تمكين الأفراد والمؤسسات من العمل بسرعة جديدة كليًا، عبر تفويض أجزاء كاملة من العمل الذهني إلى وكلاء أذكياء.
الخلاصة: تحوّل استراتيجي وليس مجرد تحديث
لا يمثّل GPT-5.5 إصدارًا تقليديًا جديدًا.
بل يشكّل نقطة تحوّل واضحة:
من ذكاء اصطناعي يجيب عن الأسئلة
إلى ذكاء اصطناعي ينفّذ الأهداف.
في مواجهة Claude Opus 4.7 وGemini 3.1 Pro، يفرض GPT-5.5 نفسه اليوم مرجعًا في الذكاء الاصطناعي الوكيلي الموجَّه نحو العمل الحقيقي، ويمهّد الطريق لجيل جديد من الزملاء الرقميين المستقلين.




