Context Window في الذكاء الاصطناعي: ليه AI بينسى أول الكلام؟
المستوى: مبتدئ
لو فتحت شات طويل مع Claude أو ChatGPT، وبعد ساعة لقيت الموديل نسي التعليمات اللي قلتها له في الأول، المشكلة مش إن النموذج "كسلان". المشكلة في حد فيزيائي اسمه Context Window. المقال ده هيخليك تفهم بالظبط يعني إيه، ليه موجود، وإزاي تتعامل معاه بدل ما تتفاجأ بيه.
المشكلة باختصار
أي نموذج لغوي كبير (LLM) بيقدر يقرا كمية محدودة من النص في المرة الواحدة. لو بعتّله أكتر من الحد ده، الكلام القديم بيتقطع أو بيرجع رسالة خطأ. الناس اللي مش فاهمة الفكرة دي بتفتكر إن الموديل "بينسى"، والحقيقة إنه ببساطة ما شافش الجزء ده أصلاً.
تخيل سبورة مدرسية
قبل ما ندخل في التعريف العلمي، خد المثال ده. تخيل إنك مدرس عندك سبورة بتسع 50 سطر. كل ما تكتب سطر جديد، لازم السبورة تستوعبه. لما توصل للسطر رقم 51، عندك خياران: إما تمسح من الأول، أو تقول للطالب "كملنا في سبورة تانية". الموديل عنده نفس المشكلة بالظبط، بس "السبورة" بتاعته اسمها Context Window، ووحدة القياس مش سطور، وحدة القياس توكن (token).
التوكن مش بالضبط كلمة. هو قطعة صغيرة من الكلمة. كلمة "البرمجة" بالعربي بتتقسم لحوالي 3 توكنز عند Claude، لإن الـ tokenizer مدرّب أساسًا على إنجليزي. كلمة "programming" بالإنجليزي بتاخد توكن واحد بس.
التعريف العلمي بدون لف
Context Window هو الحد الأقصى لعدد التوكنز اللي ممكن النموذج يعالجها في طلب واحد. ده بيشمل ثلاث حاجات مع بعض:
- System prompt: التعليمات اللي بتقول للموديل يتصرف إزاي.
- Conversation history: كل الرسائل السابقة في نفس الشات.
- Output: الرد اللي الموديل بيولّده دلوقتي.
المجموع لازم يبقى أصغر من حد الـ context window. لو زاد، الموديل بيتجاهل الجزء الأقدم تلقائيًا، أو الـ API بيرفض الطلب كله.
ليه الحد ده موجود أصلًا؟
السبب الجذري ميكانيكي بحت. الـ Transformer architecture اللي معمول بيها كل الموديلات الحديثة بتستخدم آلية اسمها self-attention. الآلية دي بتقارن كل توكن بكل توكن تاني في النص. ده معناه إن لو عندك n توكن، لازم تعمل n × n مقارنة. الكلام ده اسمه complexity تربيعية أو O(n²).
الفرق بيبان بسرعة. لو ضاعفت عدد التوكنز من 1000 لـ 2000، التكلفة الحسابية بتبقى أربع أضعاف، مش مرتين. ولو وصلت لمليون توكن، الذاكرة المطلوبة بتقفز لمستوى السيرفر التجاري الكبير، ومينفعش يشتغل على لابتوب عادي.
أرقام موديلات 2026 الفعلية
الأرقام دي محدثة لسنة 2026 ومأخوذة من توثيق Anthropic الرسمي وOpenAI:
- Claude Opus 4.7 و Sonnet 4.6: 1,000,000 توكن (مليون). أُتيحت بشكل عام في 13 مارس 2026.
- Claude Haiku 4.5: 200,000 توكن.
- GPT-4o: 128,000 توكن.