Pemrograman PHP : Pemula sampai Mahir
Programmer Zaman Now
DeepSeek yöntemi ile LLM eğitimi: SFT, LoRA, DPO ve GRPO ile Uygulamalı Fine-Tuning ve Reinforcement Learning
Taught by Çağatay Demirbaş
Bu kursta, Büyük Dil Modelleri (LLM) dünyasına adım atarak hem temel hem de ileri düzey optimizasyon yöntemlerini uçtan uca öğreneceksiniz. Eğitime SFT (Supervised Fine-Tuning) yaklaşımıyla başlayıp, veriyi doğru biçimde hazırlamayı, tokenizer ve data collator kullanarak özelleştirilmiş veri setleri oluşturmayı pratik örnekler eşliğinde göreceksiniz. SFT sürecinde LoRA (Low-Rank Adaptation) ve quantization yöntemleriyle büyük modelleri daha hafif ve daha verimli hale getirmenin püf noktalarını öğrenecek, projelerin…
Programmer Zaman Now
Rodrigo Manguinho
Universidade Global
Jose Portilla