التحول الرقمي والذكاء الاصطناعي

هندسة وتطوير النماذج اللغوية الكبيرة (LLMs)

مسار تقني في هندسة وتطوير النماذج اللغوية الكبيرة: بنية المحوّل وآلية الانتباه، وتنسيق بيانات التدريب، والمعايرة التعليمية ومواءمة التفضيلات، والضغط والتكميم، وخدمة الاستدلال وتقييم النموذج.

المدة5 أيام تدريبية
المحتوى5 محاور · 10 جلسات
بعد البرنامجشهادة حضور معتمدة

لمحة عن الدورة

يفصل بين استخدام نموذج لغوي جاهز وبين هندسة النماذج اللغوية الكبيرة (LLMs) سلسلةٌ طويلة من القرارات: كيف تُقطّع النصوص إلى رموز، وكم من الطبقات ورؤوس الانتباه، وأي مزيج من البيانات يدخل التدريب المسبق، وكيف يُوجَّه سلوك النموذج بعد ذلك ليصبح مفيداً وآمناً. يغطي هذا المسار تطوير هذه النماذج عملياً: يبدأ من بنية المحوّل وآلية الانتباه وحساب الكلفة مع طول السياق، ثم تنسيق مجموعة التدريب وتنقيتها وإزالة التكرار ومنع تسرّب بيانات التقييم. ينتقل بعدها إلى مراحل ما بعد التدريب المسبق: المعايرة التعليمية على أزواج تعليمات وإجابات، ومواءمة النموذج مع التفضيلات البشرية، والتخصيص الفعّال بالمعاملات عبر التكييف منخفض الرتبة. ويعالج البرنامج ما يحدد جدوى التشغيل فعلياً: التكميم وتقليص حجم النموذج، وذاكرة المفاتيح والقيم، والتجميع أثناء الخدمة، والمفاضلة بين زمن أول رمز والإنتاجية الكلية. ويُختم بمنهج تقييم لا يكتفي بالمقاييس الجاهزة، بل يبني مجموعة اختبار خاصة بالمجال والعربية، ويشمل الاختبار العدائي وبطاقة النموذج التي توثّق قدراته وحدوده.

الأهداف المتوقعة من الدورة

01

تفسير بنية المحوّل وآلية الانتباه وأثر طول السياق وعدد المعاملات على كلفة التدريب والاستدلال

02

تنسيق مجموعة بيانات للتدريب والمعايرة التعليمية تشمل التنقية وإزالة التكرار وعزل بيانات التقييم

03

تنفيذ تخصيص فعّال بالمعاملات للنموذج اللغوي ثم ضغطه وتكميمه مع قياس أثر ذلك على الجودة

04

بناء منظومة تقييم واختبار عدائي للنموذج وتوثيق نتائجها في بطاقة نموذج تحدد الاستخدامات والحدود

المستهدفون

01

مهندسو تعلم الآلة والعاملون على تدريب نماذج اللغة وضبطها في فرق المنتجات

02

مطورو البرمجيات المسؤولون عن خدمة الاستدلال وتحسين الكلفة وزمن الاستجابة

03

باحثو معالجة اللغة الطبيعية المهتمون بالتمثيل والتوكنة ومعالجة اللغة العربية

04

قادة الفرق التقنية الذين يقررون بين استخدام نموذج مفتوح أو مغلق أو تدريب نموذج خاص

المحاور العلمية

اضغط على أي محور لاستعراض جلساته وبنوده.

01

المحور الأول: بنية المحوّل وأسس التدريب المسبق

2 جلسات · 6 نقاط

1الجلسة الأولى: التوكنة والتمثيل وآلية الانتباه

  • بناء مفردات الترميز بأسلوب التقطيع الجزئي وقياس كفاءتها على النصوص العربية مقارنة بالإنجليزية.
  • تفكيك آلية الانتباه الذاتي والانتباه متعدد الرؤوس وأثر الترميز الموضعي على التعميم لسياقات أطول.
  • تحليل علاقة عدد المعاملات وحجم البيانات وميزانية الحوسبة عند اختيار حجم النموذج المستهدف.

2الجلسة الثانية: بناء مجموعة التدريب المسبق وتنقيتها

  • تجميع مصادر النصوص وتصفيتها من المحتوى المكرر ومنخفض الجودة قبل إدخالها في التدريب.
  • ضبط مزيج المجالات واللغات بما يضمن تمثيلاً كافياً للعربية دون إضعاف القدرات العامة.
  • عزل مجموعات التقييم عن بيانات التدريب ومراجعة التراخيص وحقوق استخدام المصادر.
02

المحور الثاني: ما بعد التدريب: المعايرة التعليمية ومواءمة التفضيلات

2 جلسات · 6 نقاط

1الجلسة الأولى: المعايرة على التعليمات وبناء بيانات الإشراف

  • إعداد أزواج تعليمات وإجابات تغطي مهام المجال المستهدف بمستويات صعوبة وصيغ طلب متنوعة.
  • وضع دليل توسيم واضح ومراجعة اتفاق الموسّمين لضمان اتساق الإشارة التعليمية.
  • قياس أثر المعايرة على المهام المستهدفة وعلى المهام العامة لكشف التراجع غير المقصود.

2الجلسة الثانية: مواءمة السلوك مع التفضيلات البشرية

  • جمع بيانات مقارنة بين إجابتين وبناء إشارة تفضيل تعكس الفائدة والصدق والسلامة.
  • المقارنة بين المواءمة عبر نموذج مكافأة والمواءمة المباشرة من التفضيلات من حيث الكلفة والاستقرار.
  • ضبط الموازنة بين الالتزام بالتعليمات والتحفّظ المفرط الذي يجعل النموذج يرفض طلبات مشروعة.
03

المحور الثالث: التخصيص الفعّال والضغط والتكميم

2 جلسات · 6 نقاط

1الجلسة الأولى: التكييف منخفض الرتبة والتخصيص بالمعاملات

  • تطبيق التكييف منخفض الرتبة على طبقات مختارة وقياس الجودة مقابل التدريب الكامل للمعاملات.
  • إدارة عدة محوّلات تخصيص لمجالات مختلفة فوق نموذج أساس واحد لتقليل كلفة التشغيل.
  • تحديد متى يكفي الاسترجاع من مصدر خارجي ومتى يكون التخصيص بالتدريب هو الحل الصحيح.

2الجلسة الثانية: تقليص الحجم وتكميم الأوزان والتقطير

  • تطبيق التكميم إلى دقة أقل وقياس التراجع في الجودة على مهام المجال قبل النشر.
  • تقطير المعرفة إلى نموذج أصغر يخدم حالة استخدام محددة بكلفة استدلال أدنى.
  • مقارنة بصمة الذاكرة وزمن الاستجابة بين النسخ المضغوطة لاختيار النسخة المناسبة للعتاد المتاح.
04

المحور الرابع: خدمة الاستدلال والأداء والكلفة

2 جلسات · 6 نقاط

1الجلسة الأولى: معمارية الخدمة وإدارة الذاكرة

  • ضبط ذاكرة المفاتيح والقيم وإعادة استخدام السياق المشترك لخفض الحساب المتكرر.
  • تطبيق التجميع المستمر للطلبات وقياس أثره على الإنتاجية وزمن أول رمز مولّد.
  • توزيع النموذج على عدة معالجات رسومية عند تجاوز حجمه سعة بطاقة واحدة.

2الجلسة الثانية: قياس الكلفة وموثوقية التشغيل

  • احتساب كلفة الرمز الواحد ومقارنة التشغيل الذاتي بالاعتماد على خدمة خارجية لكل حالة استخدام.
  • ضبط حدود المعدل والتخزين المؤقت للطلبات المتكررة وسياسة إعادة المحاولة عند الفشل.
  • مراقبة الانحراف في توزيع الطلبات الواردة وأثره على جودة المخرجات مع الوقت.
05

المحور الخامس: التقييم والاختبار العدائي وتوثيق النموذج

2 جلسات · 6 نقاط

1الجلسة الأولى: بناء منظومة تقييم خاصة بالمجال

  • تصميم مجموعة اختبار من حالات حقيقية بمعايير تصحيح محددة بدل الاكتفاء بالمقاييس العامة.
  • استخدام نموذج حَكَم مع عينة تحكيم بشري للتحقق من موثوقية الحكم الآلي.
  • تتبّع النتائج عبر الإصدارات لكشف تراجع القدرات بعد كل تعديل على التدريب أو المطالبات.

2الجلسة الثانية: الاختبار العدائي وحدود الاستخدام

  • تنفيذ اختبار عدائي يشمل محاولات تجاوز التعليمات وحقن المطالبات واستخراج بيانات التدريب.
  • قياس ميل النموذج إلى تأليف معلومات في أسئلة المجال وتوثيق أنماط الفشل المتكررة.
  • إصدار بطاقة نموذج توثّق البيانات والقدرات والقيود والاستخدامات غير الموصى بها.

ما يحصل عليه المشارك

5 محاور علمية

مخطّط علميّ متدرّج

10 جلسة تدريبية

موزَّعة على 5 أيام

30 بنداً تفصيلياً

محتوى تطبيقي مفصَّل

شهادة حضور معتمدة

بعد إتمام البرنامج

أكمل بيانات التسجيل

سنتواصل معك خلال يوم عمل لتأكيد الحجز.

جاهز للبدء؟

احجز مقعدك في البرنامج وابدأ رحلة تطوير مهاراتك.

سجّل الآن

شارك هذه الدورة