» Etiket
fine-tuning
7 yayınLoRA Speedrun: Fine-Tuning Teknikleri İçin Açık Hız Sıralaması
LoRA Speedrun, Qwen2.5-1.5B ve GSM8K üzerinde tek bir L40S GPU'da doğrulanmış, herkese açık bir LoRA fine-tuning hız sıralaması sunuyor.
Qwen2-VL'yi AMD MI300X'te İnce Ayarlamak: ROCm'in Söylemedikleri
Qwen2-VL ile blockchain grafik sınıflandırması: AMD MI300X + ROCm'de karşılaşılan gerçek ince ayar sorunları ve çözümleri.
LFM2.5 ile Tamamen Tarayıcıda Çalışan Araç Kullanan LLM Ajanı
LiquidAI LFM2.5 tabanlı, tamamen tarayıcıda çalışan araç kullanan bir LLM ajanı; sunucu yok, API anahtarı yok, sıfır bulut maliyeti.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comHer Şeyi Fine-Tune Etmeyin: Model Uyarlama Karar Çerçevesi
Fine-tuning tek seçenek değil: prompt engineering, RAG, ICL ve domain pre-training arasında doğru stratejiyi seçmek için karar çerçevesi.
nebius-actions: GitHub Actions ile Nebius GPU'larında Model İnce Ayarı
nebius-actions: Axolotl, vLLM ve Nebius Endpoint kullanarak GitHub Actions üzerinden uçtan uca model ince ayarı ve dağıtımı sağlayan açık kaynak araç seti.
Fine-Tuning Tıkandığında: Recall'u %45'ten %92'ye Taşıyan Mimari
Sağlık taleplerinde CPT/ICD kodlamasında %45 recall'da tıkanan bir LLM, deterministik NCCI doğrulama katmanıyla %92'ye ulaştı. Mimari ders burada.
FTPO ile Akıl Yürütme Modellerinde Sonsuz Döngü Sorunu Çözülüyor
Antidoom yöntemi, FTPO tekniğiyle akıl yürütme modellerindeki tekrarlayan döngü hatasını hedefli biçimde düzeltiyor; LFM2.5 ve Qwen3.5 modellerinde döngü oranı belirgin şekilde düştü.