مقالات عملية مرتبة حسب المجال والمستوى، اختر المجال المناسب واقرأ من مستوى مبتدئ إلى محترف.
ضبط نموذج 7B كامل يحتاج نحو 80 جيجا ذاكرة GPU. LoRA بيجمّد أوزان النموذج ويدرّب مصفوفتين صغيرتين بس، فيوصّل الذاكرة لأقل من 10 جيجا والمخرج أقل من 20 ميجابايت. مقال للمتوسط بمثال الورقة اللاصقة، شرح علمي، كود PEFT شغّال، أرقام، trade-offs، ومتى متستخدموش، مع مصادر.
استضافة نموذج 70B غالية وبطيئة. تقطير المعرفة بينقل ذكاء المعلّم الكبير لنموذج طالب أصغر بكثير عبر soft labels ودرجة الحرارة، فتحافظ على معظم الدقة بجزء بسيط من التكلفة. مقال للمتوسط بمثال المعلّم والطالب، شرح علمي لخسارة KL، كود PyTorch شغّال، أرقام DistilBERT الحقيقية، trade-offs، ومتى لا تستخدمه، مع مصادر.
بحث المتجهات بيرجّع أول 50 نتيجة بسرعة، بس ترتيبها بيبقى مغلوط فبتوصل للنموذج مستندات مش دقيقة. الحل خطوة تانية اسمها reranking بـ cross-encoder بترفع Recall@5 من 0.61 لـ 0.89. مقال للمتوسط بمثال أمين المكتبة والخبير، شرح علمي للفرق بين bi-encoder و cross-encoder، كود Python شغّال، أرقام مقاسة، تكلفة الزمن، ومتى متستخدموش، مع مصادر.