Pretraining Large Language Models from Scratch
Build a foundational understanding of data curation, tokenization, and model architectures to pretrain your own custom language models from the ground up.
-
💬
مدرب ذكاء اصطناعي
اسأل عن أي درس واحصل على إجابة واضحة فورًا، في أي وقت. -
🕐
ابدأ في أي وقت
بلا جداول أو مواعيد نهائية — تعلّم بوتيرتك، وقتما يناسبك. -
🌐
بالعربية
الدروس والمهام والشهادة — كل ذلك بلغتك بالكامل.
حول هذه الدورة
Large language models are transforming technology, but understanding how they are built from the ground up remains a rare and valuable skill. This text-based course guides you through the foundational concepts and practical steps of pretraining your own language model. You will transition from a consumer of AI models to someone who understands the entire lifecycle of model creation, from raw text preparation to initial training runs. What you'll learn: 1. Learn the core mathematical and architectural concepts behind modern Transformer models. 2. Master data curation strategies, including filtering, deduplication, and quality control. 3. Configure custom tokenizers to convert raw text into model-ready numerical inputs. 4. Understand distributed training fundamentals and mixed-precision techniques to optimize performance. 5. Practice writing training loops and setting up loss monitoring using clear, step-by-step code examples. 6. Explore modern pretraining optimizations such as rotary position embeddings and RMSNorm. Starting with essential terminology and foundational definitions, this course guides you through the pipeline of data preparation, architectural setup, and computational execution. You will read detailed explanations and analyze code implementations designed to demystify the pretraining process. This course is designed for beginners and tech enthusiasts looking to understand LLM internals from scratch, with no prior machine learning experience required. Begin your journey into the core of modern artificial intelligence today.
ما الذي ستحصل عليه
-
📜
شهادة إتمام
أضفها إلى ملفك على LinkedIn -
💬
مدرّس AI شخصي
عالق في دورة؟ اسأل مدرّسك المدمج أي شيء، في أي وقت. -
🎧
النسخة الصوتية مضمَّنة
تعلَّم أثناء تنقُّلك — دون شاشة -
♾️
وصول مدى الحياة
عُد متى شئت، بلا انتهاء -
📱
الهاتف أو الكمبيوتر
يعمل في أي مكان وعلى أي جهاز -
💸
استرداد خلال 14 يومًا
دون أسئلة -
⚡
قصير ومركَّز
2 ساعة 36 دقيقة من المحتوى التطبيقي
المراجعات
لا توجد مراجعات بعد — كن أول من يشارك تجربته.
المتعلمون أخذوا أيضًا
🔥 رائج
🎓 بشهادة
أساسيات تحسين LLM: الضغط و Fine-Tuning
شهادة
تطبيق عملي
SR 190
→
🔥 رائج
🎓 بشهادة
مقدمة في ضبط LLM الدقيق باستخدام LoRA و QLoRA
شهادة
تطبيق عملي
SR 190
→
🏆 الأكثر شعبية
🎓 بشهادة
أسس نماذج اللغات الكبيرة: من المحولات إلى ضبط الدقة
شهادة
تطبيق عملي
SR 190
→
🔥 رائج
🎓 بشهادة
دليل المبتدئين لضبط نماذج اللغة الكبيرة (LLM Fine-Tuning)
شهادة
تطبيق عملي
SR 190
→
الأسئلة الشائعة
ما الذي أحتاجه لأخذ هذه الدورة؟ +
يكفي هاتف أو كمبيوتر متصل بالإنترنت. بدون تثبيتات أو أجهزة خاصة.
كيف يمكنني الدفع؟ +
بالبطاقة عبر Stripe. لا نخزن بيانات البطاقة — يتولى Stripe ذلك بأمان.
هل يمكنني استرداد المال؟ +
نعم — استرداد كامل خلال 14 يومًا، دون أسئلة.
إلى متى يستمر وصولي؟ +
إلى الأبد. بمجرد الشراء، الدورة لك تعود إليها متى شئت.
هل سأحصل على شهادة؟ +
نعم. عند الإتمام ستحصل على شهادة يمكنك إضافتها إلى ملفك في LinkedIn.
مصمَّم للعاملين في
التقنية
التصميم
المالية
التسويق
الرعاية الصحية
التعليم
الضيافة
التصنيع
×2
اشحن مرة واحدة وادفع النصف
أضف SR 380 واحصل على 200 رصيد، بحيث تكلف كل دورة حوالي SR 47.50. لا تنتهي صلاحية الأرصدة أبداً.
SR 380
200 رصيد
SR 47.50 / دورة
أفضل قيمة
SR 950
550 رصيد
SR 43.18 / دورة
SR 1,900
1200 رصيد
SR 39.58 / دورة
الرصيد يصلح لأي دورة ولا ينتهي.