الرئيسيةمن أناالدوراتالمدونةسوق الأوامرالمناهج والباقاتالشركاء

دورات عربية متخصصة في التقنية والبرمجة والذكاء الاصطناعي.

المنصة مبنية على الوضوح، التطبيق، والنتيجة النافعة: شرح مرتب يساعدك تفهم الأدوات، تكتب كودًا أفضل، وتستخدم الذكاء الاصطناعي بوعي داخل العمل الحقيقي.

المنصة

  • الرئيسية
  • من أنا
  • الدورات
  • المناهج والباقات
  • سوق الأوامر
  • المدونة

الدعم

  • الأسئلة الشائعة
  • تواصل معنا
  • سياسة الخصوصية
  • شروط استخدام التطبيق
  • سياسة الاسترجاع

© 2026 أحمد حايس. جميع الحقوق محفوظة.

الرئيسيةالدوراتالمناهجالمدونةالدخول

الذكاء الاصطناعي

مقالات عملية مرتبة حسب المجال والمستوى، اختر المجال المناسب واقرأ من مستوى مبتدئ إلى محترف.

المجال
كل المجالات
تكنولوجياDevOps بالعربيHow To Make ItOptimizing بالعربيأحدث أخبار التكنولوجياالأوتوميشنالبرمجة بالعربيالذكاء الاصطناعي
المستوى
كل المستوياتمبتدئمتوسطمحترف
Prompt Caching للمحترف في Claude: ازاي تقطع تكلفة الـ Input 90% وتسرّع الرد 4x
محترف8 مايو 2026

Prompt Caching للمحترف في Claude: ازاي تقطع تكلفة الـ Input 90% وتسرّع الرد 4x

لو الـ agent بتاعك بيرسل system prompt حجمه 35 KB في كل طلب، الموديل بيقراه من الصفر وبتدفع كامل التوكنز. Prompt Caching بيحفظ الجزء الثابت على سيرفر Anthropic ويعيد استخدامه بسعر 10% وزمن TTFT أقل بـ 4x. مقال للمحترف بمثال الكاشير للمبتدئ، تعريف علمي للـ KV cache، كود Python شغّال على Anthropic SDK، أرقام مقاسة من إنتاج (88% انخفاض الفاتورة)، trade-offs الـ cache invalidation، وحالات لا يستحق فيها التفعيل.

7 دقائق قراءة
KV Cache و PagedAttention للمحترف: ليه vLLM بيخدم 8x طلبات أكتر
محترف8 مايو 2026

KV Cache و PagedAttention للمحترف: ليه vLLM بيخدم 8x طلبات أكتر

لو شغّلت Llama 3 70B على A100 80GB ولقيت السيرفر بيرفض الطلب رقم 16، الموديل مش هو اللي بياكل الذاكرة. KV Cache هو، وبيهدر 60-80% منها في تجزئة. PagedAttention في vLLM بترفع الإنتاجية 8x. مقال للمحترف بشرح علمي دقيق، كود vLLM 0.7+ شغّال، أرقام من ورقة Kwon et al. SOSP 2023.

6 دقائق قراءة
Prompt Caching في Claude للمحترف: وفّر 90% من تكلفة الـ API و 6x من زمن الاستجابة
محترف8 مايو 2026

Prompt Caching في Claude للمحترف: وفّر 90% من تكلفة الـ API و 6x من زمن الاستجابة

لو تطبيقك بيبعت نفس الـ system prompt الطويل مع كل request، أنت بتدفع 100% كل مرة بلا داعي. Prompt Caching بيقطع التكلفة لـ 10% والـ time-to-first-token من 2.1 ثانية لـ 0.32. مقال للمحترف بمثال الكاشير للمبتدئ، تعريف علمي للـ KV Cache Persistence، كود Python شغّال على Anthropic SDK، أرقام مقاسة من إنتاج 18,000 طلب يومي، 4 trade-offs حقيقية، وحالات لا تستخدمه فيها أصلاً.

6 دقائق قراءة
Speculative Decoding للمحترف: ازاي تخلّي LLM يرد 3x أسرع بدون ما تخسر دقة
محترف8 مايو 2026

Speculative Decoding للمحترف: ازاي تخلّي LLM يرد 3x أسرع بدون ما تخسر دقة

لو inference الـ Llama 3 70B بياخد 8 ثواني والمستخدم بيقفل التاب، Speculative Decoding بيقطع الزمن للنص بنفس الموديل ونفس الجودة. الفكرة: موديل صغير سريع بيخمّن، موديل كبير بيتأكد بالتوازي. مقال للمحترف بمثال الكاشير للمبتدئ، التعريف العلمي الدقيق للـ acceptance probability من ورقة DeepMind 2023، كود vLLM 0.6+ شغّال، أرقام مقاسة على H100 (24 → 71 توكن/ثانية)، trade-offs الذاكرة والـ batching، وحالات لا تستخدم فيها التقنية أصلاً.

6 دقائق قراءة
Hybrid Search للمحترف: ادمج BM25 مع Dense Embeddings وارفع دقة الاسترجاع لـ 96%
محترف7 مايو 2026

Hybrid Search للمحترف: ادمج BM25 مع Dense Embeddings وارفع دقة الاسترجاع لـ 96%

لو الـ RAG بتاعك بيفشل في الأسئلة اللي فيها رقم منتج أو UUID أو اسم خطأ تقني، Dense search لوحده مش كفاية. Hybrid Search بيدمج BM25 مع Embeddings عبر Reciprocal Rank Fusion ويرفع الاسترجاع من 78% لـ 96% على BEIR. مقال للمحترف بمثال أمين المكتبة للمبتدئ، تعريف علمي للـ RRF، كود Python شغّال على rank_bm25 + sentence-transformers، أرقام مقاسة، trade-offs، وحالات لا تستخدمه فيها.

7 دقائق قراءة
Parallel Tool Use في Claude API للمحترف: نفّذ 5 أدوات في 1.2 ثانية بدل 6
محترف3 مايو 2026

Parallel Tool Use في Claude API للمحترف: نفّذ 5 أدوات في 1.2 ثانية بدل 6

لو الـ agent بتاعك بياخد 6 ثواني علشان يجيب الطقس + سعر السهم + ميعاد الميتنج + بيانات العميل + الفاتورة، المشكلة مش الموديل بطيء. المشكلة إنك بتنده الأدوات تسلسلياً بدل ما توازيها. شرح للمحترف بمثال طلب الكافيه للمبتدئ، تعريف علمي لـ disable_parallel_tool_use ودورة الـ tool_use blocks، كود Python شغّال على Anthropic SDK 0.40+، أرقام مقاسة من إنتاج، trade-offs الذاكرة والتكلفة، وحالات لازم تعطّل التوازي فيها.

5 دقائق قراءة
Quantization للمحترف: شغّل Llama 70B على 24GB VRAM بدل 140GB
محترف29 أبريل 2026

Quantization للمحترف: شغّل Llama 70B على 24GB VRAM بدل 140GB

لو موديل Llama 3.3 70B بيطلب منك 140GB VRAM وأنت عندك RTX 4090 بـ 24GB بس، Quantization بيخلّيه يشتغل على نفس الكرت بفقد جودة أقل من 1% في perplexity. مقال للمحترف بمثال JPEG للمبتدئ، تعريف علمي دقيق لـ FP16 vs INT8 vs INT4، فرق GPTQ و AWQ و GGUF بالأرقام، كود Python شغّال على bitsandbytes و llama.cpp، أرقام MMLU قبل وبعد، trade-offs، وحالات لا تستخدمه فيها.

6 دقائق قراءة
Agent Loops: ليه وكيل AI بياكل 47$ في 12 دقيقة قبل ما يقف
محترف28 أبريل 2026

Agent Loops: ليه وكيل AI بياكل 47$ في 12 دقيقة قبل ما يقف

لو وكيل AI عندك دخل في حلقة tool calls لا نهائية ونده نفس الأداة 200 مرة، الفاتورة بتوصل لـ 47$ في 12 دقيقة. مقال للمحترف بمثال للمبتدئ، تعريف علمي للـ ReAct loop، كود Python شغّال على Anthropic SDK يعيد إنتاج المشكلة، 4 طبقات دفاع عملية (max_iterations، loop detection، cost guard، state hashing)، أرقام مقاسة، trade-offs، ومتى تترك الحلقة شغّالة فعلاً.

6 دقائق قراءة
Batch API في Claude: قلّل تكلفة الطلبات الجماعية 50%
محترف28 أبريل 2026

Batch API في Claude: قلّل تكلفة الطلبات الجماعية 50%

لو فاتورة Claude API عندك بتقترب من 1000 دولار شهريًا وأغلب الطلبات offline (تلخيص، تصنيف، توليد embeddings)، Batch API بينزّل التكلفة 50% بدون تعديل سطر business logic واحد. مقال للمحترفين بمثال للمبتدئ، تعريف علمي، كود Python شغّال على Anthropic SDK، أرقام مقاسة، trade-offs، وحالات ما تستخدمهوش فيها.

5 دقائق قراءة

عرض 37 - 45 من 46 مقال

السابق
1
2
3
4
5
6
التالي