نافذة سياق النموذج هي إجمالي عدد الرموز التي يستطيع التعامل معها في طلب واحد: تعليماتك، والمحادثة كلها حتى الآن، وأي مستندات ترفقها، والرد الذي يكتبه. وعندما تمتلئ، يجب حذف الرسائل الأقدم أو تلخيصها. تجمع هذه الحاسبة كل جزء، وتبيّن مدى قربك من الحد، وتحسب تكلفة الطلب، لأن كل رمز في النافذة يُحاسَب مرة أخرى في كل استدعاء.
روجعت الأرقام في بواسطة Muhammad Ahmad بالاستناد إلى أسعار واجهة OpenAI API، أسعار واجهة Claude API و أسعار واجهة Gemini API. الأسعار والقواعد تتغير، فتأكد من المصدر الرسمي قبل الاعتماد عليها. كيف نتحقق من الحسابات
كيف تعمل
رموز المدخل هي تعليمات النظام، مضافًا إليها المستندات بعد تحويل الكلمات إلى رموز، مضافًا إليها دورات المحادثة مضروبة في متوسط حجمها. وتُضاف فوق ذلك المساحة المحجوزة للرد، لأن المخرجات تشترك في النافذة نفسها.
نسب الكلمات إلى الرموز تقديرية. فمتوسط الإنجليزية نحو 1.33 رمز للكلمة. أما العربية والأردية فتستغرقان عادةً من 2 إلى 3 رموز للكلمة، لأن معظم أدوات التقطيع دُرّبت أساسًا على نصوص إنجليزية. وتتفاوت الشيفرة البرمجية والأرقام تفاوتًا كبيرًا.
تعيد تطبيقات المحادثة إرسال السجل كاملًا مع كل رسالة. فمحادثة بلغت 50,000 رمز تكلّف ثمن 50,000 رمز مدخل في كل دورة جديدة، ولهذا تصبح المحادثات الطويلة مكلفة وبطيئة حتى قبل بلوغ الحد.
تستخدم تكلفة الطلب سعر المدخل للنموذج المحدد لكل ما ترسله، وسعر المخرجات للرد المحجوز. وهي حد أعلى: فإذا كان الرد أقصر من المحجوز تنخفض تكلفة المخرجات. ويمكن للتخزين المؤقت للموجّه (prompt caching) أن يخفض كثيرًا تكلفة تعليمات نظام أو مستند متكرر، وتحاكي ذلك حاسبة تكلفة واجهة الذكاء الاصطناعي.
مثال محلول
مساعد دعم لديه تعليمات نظام من 2,000 رمز، ومستند معرفي إنجليزي من 30,000 كلمة (نحو 39,900 رمز)، و20 دورة محادثة بواقع 600 رمز لكل منها (12,000 رمز). فيكون المجموع 53,900 رمز مدخل. وترك 4,000 رمز للرد يستخدم 57,900 من نافذة 200K، أي 29%، مع مساحة لـ 236 دورة إضافية. وعلى Claude Sonnet 5 تكلّف كل طلبية نحو 0.1478$.
أمثلة إضافية
مستند من 150,000 كلمة لا يتسع في نافذة 200,000 رمز بالإعدادات الافتراضية: فهو يحتاج وحده إلى نحو 199,500 رمز، و213,500 مع بقية الطلب، أي 108.75% من النافذة.
أخطاء شائعة
- نسيان حجز مساحة لإجابة النموذج.
- احتساب المستند وحده دون تعليمات النظام والسجل.
- افتراض أن النافذة الطويلة تُستخدم كلها بالجودة نفسها؛ فقد يكون الاسترجاع أفضل من حشر كل شيء.
- نسيان رسوم السياق الطويل الإضافية في بعض النماذج، مثل ما يزيد على 272,000 رمز في GPT-6.
أسئلة يطرحها الناس
ما نافذة السياق في نموذج LLM؟
هي أقصى عدد من الرموز يستطيع النموذج قراءته وكتابته في طلب واحد. ويدخل في حسابها كل شيء: تعليمات النظام والرسائل السابقة والمستندات المرفقة ونتائج الأدوات والرد نفسه.
ماذا يحدث عندما تتجاوز المحادثة نافذة السياق؟
إما أن ترفض واجهة API الطلب، أو يحذف التطبيق الرسائل الأقدم دون إشعار. وفي الحالتين يفقد النموذج التفاصيل السابقة. وتلخّص معظم تطبيقات المحادثة الدورات القديمة أو تحتفظ بالأحدث فقط لتبقى ضمن الحد.
كم كلمة تتسع في نافذة سياق 128K أو 200K؟
في الإنجليزية، يتسع نحو 96,000 كلمة في 128K رمز ونحو 150,000 كلمة في 200K، قبل ترك مساحة للرد. وفي العربية أو الأردية توقّع نحو نصف هذا العدد من الكلمات، لأن كل كلمة تستهلك رموزًا أكثر.
هل تكلّف نافذة السياق الأكبر أكثر؟
حجم النافذة نفسه لا يكلّف، لكن ملأها يكلّف: فأنت تدفع عن كل رمز مدخل في كل طلب. كما تفرض بعض الجهات سعرًا أعلى متى تجاوز الموجّه طولًا معينًا، فراجع صفحة الأسعار بحثًا عن شرائح السياق الطويل.
هل أضع المستندات كاملة في الموجّه أم أستخدم RAG؟
إذا كانت المستندات تتسع بسهولة وتستعلم عنها كثيرًا، فإن التخزين المؤقت للموجّه يجعل وضعها فيه بسيطًا ومناسب التكلفة. أما إذا كانت كبيرة أو تتغير كثيرًا، فإن الاسترجاع (RAG) يرسل المقاطع ذات الصلة فقط، مما يُبقي كل طلب أصغر وأرخص.