دبلومة اللسانيات الحاسوبية
للباحثين وطلاب الدراسات العليا
٢٧ محاضرة نشرح فيها المرجع العالمي فصلًا بفصل — والعربية حالةٌ دراسية في كل محاضرة.
نقتصر على ٢٠ متدربًا فقط لضمان المتابعة الفردية ومناقشة المقترحات البحثية.
حرصًا على وقتك ووضوح التزامك، نشرنا كامل تفاصيل الدبلومة أدناه: المنهج، والكتاب المرجع، وجدول المحاضرات، والجمهور المستهدف، والرسوم. ونودّ أن نوضّح بشفافية أن التسجيل هنا يُعدّ تأكيدًا لاطّلاعك عليها، إذ لن يتواصل معك ممثل خدمة العملاء لشرح تفاصيل إضافية — بل لاستكمال إجراءات السداد وإرسال روابط الحضور فحسب. وإن بقي لديك أي استفسار قبل التسجيل، فنحن سعداء بالإجابة عنه عبر الواتساب.
تم حجز مقعدك بنجاح
سجّلنا بياناتك، وسيتواصل معك فريق الالتحاق لاستكمال إجراءات السداد وإرسال روابط الحضور.
ننصح بإرسال الرسالة عبر الواتساب لضمان وصول طلبك فورًا.
ماذا سندرس؟
رحلةٌ متدرّجة من النص الخام إلى النماذج اللغوية إلى وسم البنية اللغوية — وفي كل محطة تطبيقٌ على العربية.
الأساسيات — النص كبيانات
التعبيرات النمطية، وتطبيع النص العربي، والتقطيع وBPE، ونماذج N-gram، والتصنيف ومقاييس التقييم.
المعنى والنماذج اللغوية
المتجهات وword2vec، والشبكات العصبية، والـ Transformer وآلية الانتباه، وما بعد التدريب وRLHF، وRAG.
الوسم والبنية اللغوية
الوسم الصرفي‑النحوي وNER، والإعراب البنيوي والاعتمادي، والأدوار الدلالية، وحل الإحالة، والخطاب.
ما الذي يميّزها؟
- العربية حالة دراسية مركزية في كل محاضرة، لا هامشًا في آخر الفصل.
- كتاب مرجعي واحد نمشي معه فصلًا بفصل، لا خليط مصادر.
- تطبيق عملي في Google Colab مع كل محاضرة.
- مقترح بحثي مصغّر تخرج به جاهزًا للصقل والتقديم.
- قائمة مشكلات عربية مفتوحة صالحة فورًا لموضوع رسالة.
- متابعة فردية — ولهذا نقتصر على ٢٠ مقعدًا.
Language Processing
James H. Martin
ما الكتاب الذي سنناقشه؟
نعتمد Speech and Language Processing لـ Jurafsky & Martin — المرجع الذي تُدرَّس منه برامج الماجستير حول العالم، ويُعرف اختصارًا بـ«J&M».
- منهجية المحاضرة: فصلٌ من الكتاب ← شرحٌ بالعربية ← تطبيقٌ على مشكلة عربية ← تدريب في Colab.
- نعتمد عناوين الفصول لا أرقامها، لأن الكتاب مسوّدة حيّة يُعاد ترقيمها — ونزوّدك بإصدارٍ مرجعي موحّد.
- لا تحتاج شراءه — مسوّدته الكاملة متاحة مجانًا على موقع المؤلفَين.
- مجلّده الثاني (وسم البنية اللغوية) هو الأقرب لتكوينك اللساني، ولا يُدرَّس ممنهجًا في السوق العربي.
لمن هذه الدبلومة تحديدًا؟
هذه دفعةٌ أكاديمية مغلقة. نلتزم بهذا الشرط لأن مستوى النقاش والمقترحات البحثية يُبنى على خلفية مشتركة بين المتدربين.
✔ التسجيل متاح لـ
- طلاب الماجستير والدكتوراه في اللغات والترجمة واللسانيات.
- الباحثين الذين يعدّون لمشروع بحثي أو ينوون التقديم على برنامج دراسات عليا.
- أعضاء هيئات التدريس والمعيدين والمدرسين المساعدين.
- خريجي الألسن واللغات الذين يخططون فعليًا للدراسات العليا.
✘ ليست مفتوحة لـ
- الباحثين عن دورة تعريفية عامة في الذكاء الاصطناعي.
- من يريد كورس «استخدام ChatGPT» أو هندسة الأوامر فقط.
- من لا يستطيع الالتزام بالقراءة الأسبوعية والتطبيق العملي.
- من يبحث عن شهادة دون مخرج بحثي.
٢٧ محاضرة — وماذا ندرس في كلٍّ منها
الوسم Ch يشير إلى فصل الكتاب المقابل.
| # | عنوان المحاضرة | ماذا سندرس فيها | المرجع |
|---|---|---|---|
| المحور الأول — الأساسيات: النص كبيانات | |||
| ١ | مدخل إلى الحقل | خريطة اللسانيات الحاسوبية، وموجاتها الثلاث، ولماذا تُعدّ العربية حالة خاصة حاسوبيًا. | Ch 1 |
| ٢ | التعبيرات النمطية وتطبيع النص | Regex عمليًا، ومفهوما الدقة والاستدعاء، وبناء خط تطبيع كامل للنص العربي. | Ch 2 |
| ٣ | التقطيع وBPE ويونيكود | كيف يُقطَّع النص داخل النماذج، ومسافة التحرير، و«ضريبة التوكِنز» التي تدفعها العربية. | Ch 2 |
| ٤ | نماذج N-gram اللغوية | أول إجابة رياضية عن سؤال «ما احتمال هذه الجملة؟» ومقياس الحيرة (Perplexity). | Ch 3 |
| ٥ | التصنيف والتقييم | Naive Bayes وLogistic Regression، ومقاييس Precision وRecall وF1 وقراءتها نقديًا. | Ch 4 |
| المحور الثاني — المعنى والشبكات العصبية | |||
| ٦ | الفرضية التوزيعية والمتجهات المتناثرة | «تُعرَف الكلمة بصحبتها»، ومصفوفات التواتر، وTF-IDF، والتشابه الجيبي. | Ch 5 |
| ٧ | word2vec والمتجهات الكثيفة | كيف يصير المعنى أرقامًا، مع تجربة حية على متجهات عربية وقياس التحيّز فيها. | Ch 5 |
| ٨ | الشبكات العصبية | الصندوق مفتوحًا: الطبقات ودوال التنشيط والتدريب — شرح بصري دون رياضيات مخيفة. | Ch 6 |
| ٩ | الشبكات المتكررة RNN/LSTM | كيف عولجت المتتاليات قبل الـ Transformer، ولماذا لم تكفِ للسياقات الطويلة. | Ch 13 |
| المحور الثالث — عصر النماذج اللغوية الضخمة | |||
| ١٠ | النماذج اللغوية الضخمة | آلية التوليد والمعاينة (sampling)، والـ prompting، وقوانين التوسّع (scaling laws). | Ch 7 |
| ١١ | الـ Transformer (١) — الانتباه | آلية الانتباه Attention بشرح بصري تفصيلي، وربطها بالاعتماد السياقي اللغوي. | Ch 8 |
| ١٢ | الـ Transformer (٢) — البنية | Multi-head attention، والترميز الموضعي، وتكديس الطبقات، وكيف تتجمع القطع. | Ch 8 |
| ١٣ | ما بعد التدريب | Instruction Tuning وRLHF وDPO — وكيف تصنع الأحكام اللغوية البشرية سلوك النموذج. | Ch 9 |
| ١٤ | نماذج القناع MLM | BERT وعائلته، والفرق بين encoder وdecoder، والضبط الدقيق (fine-tuning) لمهمة عربية. | Ch 10 |
| ١٥ | الاسترجاع وRAG | بناء نظام استرجاع، وتقييم دقته، ولماذا يُعدّ منجمًا لموضوعات الرسائل العربية. | Ch 11 |
| المحور الرابع — التطبيقات: الترجمة والكلام | |||
| ١٦ | الترجمة الآلية (١) | تاريخها، وبنية encoder-decoder، وكيف تعمل الترجمة العصبية من الداخل. | Ch 12 |
| ١٧ | الترجمة الآلية (٢) — التقييم | BLEU وchrF وCOMET، ومشكلات العربية، واللهجات شحيحة الموارد. | Ch 12 |
| ١٨ | الصوتيات وسمات الكلام | الصوتيات حاسوبيًا وتمثيل الإشارة — أرض اللسانيين الأصلية. | Ch 14 |
| ١٩ | التعرف على الكلام وتوليده | كيف يعمل Whisper، وتحديات التوليد الصوتي العربي (TTS) مع غياب التشكيل. | Ch 15–16 |
| المحور الخامس — المجلد الثاني: وسم البنية اللغوية | |||
| ٢٠ | الوسم الصرفي‑النحوي وNER | POS Tagging والكيانات المسمّاة، مع فتح treebank عربي حقيقي والعمل عليه. | Ch 17 |
| ٢١ | الإعراب البنيوي | Constituency Parsing وبناء الأشجار التركيبية وقراءتها. | Ch 18 |
| ٢٢ | الإعراب الاعتمادي | Dependency Parsing مع Universal Dependencies للعربية وتحدياتها. | Ch 19 |
| ٢٣ | استخراج المعلومات والأدوار الدلالية | Information Extraction وSemantic Role Labeling وتطبيقهما على نص عربي. | Ch 20–21 |
| ٢٤ | تحليل المشاعر والمعاجم العاطفية | بناء المعاجم العاطفية وقياس أثرها — مجال خصب لضعف الموارد العربية فيه. | Ch 22 |
| ٢٥ | حل الإحالة وربط الكيانات | الضمائر المتصلة العربية بوصفها من أصعب مشكلات الحقل — ومنجم موضوعات بحثية. | Ch 23 |
| ٢٦ | الخطاب والمحادثة | التماسك النصي، وبنية الحوار، وتتبّع المُشار إليه عبر الجمل. | Ch 24–25 |
| المحور السادس — من دارسٍ إلى باحث | |||
| ٢٧ | الباحث الحاسوبي والمشروع الختامي | تشريح ورقة بحثية، وخريطة البرامج والمنح، وبناء مقترحك البحثي، وعرض المشروع الختامي. | — |
رسوم الالتحاق
تشمل الرسوم المحاضرات الـ٢٧ كاملة، والتطبيقات العملية، ومتابعة المقترح البحثي.
- ٢٧ محاضرة مباشرة بصفحات تفاعلية مرافقة.
- تطبيقات Colab عملية مع كل محاضرة.
- مسرد مصطلحات ثنائي اللغة وخطة قراءة موجّهة.
- متابعة مقترحك البحثي حتى صياغته النهائية.
قرأتَ التفاصيل كاملة؟
مقعدك بانتظارك — والمقاعد محدودة بعشرين.
ارجع إلى الاستمارة أعلاه لإتمام الحجز.