« Tüm yayınlar

» Özet

25 Tem 2026

25 Tem 2026
Bugün

Yapay Zeka Her Katmanda Yeniden Şekilleniyor: Mikrodenetleyiciden Çekirdeğe Mühendislik Atılımları

Bu dönemin en çarpıcı gelişmesi, 8 dolarlık ESP32-S3 mikrodenetleyicisinde 28,9 milyon parametreli bir dil modelinin çalıştırılması oldu. Google'ın Gemma modellerinden uyarlanan Katman Başına Gömme tekniği sayesinde model, gömme tablosunu flash bellekte tutarak saniyede yaklaşık 9 token üretiyor. Bu, aynı sınıf çiplerde daha önce görülenin yaklaşık yüz katı büyüklüğünde bir model ve internet bağlantısı gerektirmeden tamamen cihaz üzerinde çalışıyor.

Yapay zeka altyapısında maliyet optimizasyonu da öne çıktı. Bir ekip, DeepSeek V4 Flash modelini AWS spot instance'larda kendi sunucularında barındırarak ücretsiz kullanım katmanını negatif kâr marjı olmadan sunmayı başardı. Mixture-of-experts mimarisi ve MXFP4 kuantizasyonu sayesinde 284 milyar parametrelik model, disk boyutu 150 GB'a düşürülerek NVIDIA RTX PRO 6000 GPU'larında çalıştırılabilir hale geldi.

AI kodlama ajanlarının yönetimi için iki önemli araç ortaya çıktı. Loom, paralel çalışan ajanların aynı dosyalar üzerinde çakışan değişiklikler yapmasını önlemek için git worktree'ler üzerinde bir koordinasyon katmanı sunuyor. @ttsc/graph ise TypeScript derleyicisinin kendisinden gelen bildirim ve ilişki grafiğiyle ajanların token kullanımını temel senaryonun yüzde dördüne kadar düşürebiliyor.

Güvenlik cephesinde, Epistemic Engine git geçmişinden kodu gerekçelendirilmiş iddialar bütünü olarak modelleyerek AI tarafından üretilen değişiklikleri denetliyor. Daha da ileri giden bir araştırma prototipi, AI ajan güvenlik politikalarını eBPF-LSM kancalarıyla doğrudan çekirdek seviyesinde uyguluyor; prompt injection ile ele geçirilen bir ajanın kendi izin listesini atlatması böylece engelleniyor.

Raft ekibi, çok-ajanlı çalışma alanlarında ajanların "çevresel görüş" eksikliğini keşfederek bildirim mimarisini yeniden tasarladı. Ajanların ilgisiz mesajları görmezden gelirken bile hesaplama maliyeti ödediğini fark eden ekip, klasik bir önbellek tasarımıyla bu sorunu çözdü. Bu arada SAGA, üretken AI ile oluşturulan videoların hangi modelle üretildiğini beş farklı seviyede tespit eden ilk kapsamlı çerçeve olarak sunuldu.

» İstatistikler

Yayın
34
Okunma
1
Ort. puan
7.8

» En çok okunan

  1. DeepSeek V4 Flash'ı AWS Spot Instance'larda Kendi Sunucularımızda Barındırıyoruz18.5
  2. Open Dreamer: JAX/Flax ile Dreamer 4 Dünya Modeli Yeniden Üretimi07.0
  3. Sürekli Durum Makinesi: LLM Dikkati için Bellek Duvarını Aşmak07.9
  4. 8 Dolarlık Mikrodenetleyicide 28,9 Milyon Parametreli LLM08.5
  5. Wpcapng – Web için Wireshark07.4
  6. Yüksek Performanslı Rust Profili Oluşturma Deneyimleri07.8
  7. Microcharts - 106 Küçük React Grafiği, Metin İçine Sığar07.0
  8. Eski Riot ve Respawn tasarımcısından oyun sistemleri el kitabı08.0
  9. SAGA: Videoyu Hangi Yapay Zeka Modelinin Ürettiğini Tespit Ediyor08.4
  10. Epistemic Engine: AI kodunu doğrulayan ve riskleri öngören araç08.3

» En yüksek puan

  1. Veritabanını Tersyüz Etmek: Kleppmann'ın Samza Konuşması (2015)08.8
  2. 11 Yapay Zeka Alt Ajanıyla Claude Code PPTX Yeteneklerini Test Ettim08.8
  3. Raft, Ajanlar İçin Bildirim Mimarisini Neden Yeniden Tasarladı08.6
  4. 8 Dolarlık Mikrodenetleyicide 28,9 Milyon Parametreli LLM08.5
  5. @ttsc/graph: TypeScript Derleyicisinden AI Ajanları için Kod Grafiği08.5
  6. DeepSeek V4 Flash'ı AWS Spot Instance'larda Kendi Sunucularımızda Barındırıyoruz18.5
  7. SAGA: Videoyu Hangi Yapay Zeka Modelinin Ürettiğini Tespit Ediyor08.4
  8. Epistemic Engine: AI kodunu doğrulayan ve riskleri öngören araç08.3
  9. Loom: AI Kodlama Ajanları İçin Git Üzerine Kurulu Koordinasyon Katmanı08.3
  10. Otonom AI Ajanları için Çekirdek Seviyesinde Denetim: eBPF-LSM + Z308.1

» Kaynaklar

Hashnode #812Hashnode #96Hashnode #174Cyber Security Reddit2Artificial Intelligence Reddit2Hashnode #32Frontend Development Reddit2İşletim Sistemi Reddit1Hashnode #111Hashnode #131Hashnode #151

» Paylaş