» Etiket
testing
96 yayınGitHub Actions'ta API E-posta Testleri: Sözleşme Yaklaşımı
E-posta testlerinin CI'da neden kırıldığını ve GitHub Actions'ta run-scoped inbox ile API sözleşmesini nasıl doğru test edeceğinizi anlatan pratik rehber.
LLM Hakem Testleri Neden Çalıştırmalar Arası Kararsız?
Aynı kod, aynı girdi, farklı LLM hakem skoru: CI gate'lerinde flapping sorununun kaynakları; sıcaklık, model pinleme, k-örnekleme ve kuantalama ile çözüm.
LLM Değerlendiricileriniz İçin Regresyon Testi Şart
rubric-bench v0.1, LLM tabanlı değerlendiricileri altın veri setleriyle test eden açık kaynak bir araç. CI'da regresyonları yakalayıp model sürüklenmesini önlüyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comParlel: 250+ servisi gerçek protokolle yerelde taklit ediyor
Parlel, Postgres, Redis, Stripe, S3 gibi 250'den fazla servisi gerçek ağ protokolleriyle yerelde çalıştırıyor; test ve AI ajanları için ücretsiz, hızlı bir alternatif sunuyor.
React Auth E-postalarında Test Kararlılığı için Run ID Deseni
React tabanlı auth e-posta testlerinde flakiness'in gerçek nedeni zamanlama değil, UI ile posta kutusu arasındaki korelasyon eksikliği. TypeScript tabanlı bir run id deseni çözümü sunuyor.
Geçici Test Posta Kutuları ile E-posta Entegrasyon Testleri
E-posta entegrasyon testleri için geçici test posta kutuları oluşturmanın avantajları.
React Mention E-postalarında Çift Gönderim Nasıl Önlenir
React tabanlı mention bildirimlerinin neden iki kez gönderildiğini ve tek bir eventId sözleşmesiyle bu hatanın nasıl önlenebileceğini ele alıyoruz.
Zamanlanmış İşlerde E-posta Doğrulaması İçin Gelen Kutusu Sözleşmesi
Cron işleri ve zamanlanmış otomasyonlarda e-posta hatalarını yakalamak için her çalıştırmaya özel gelen kutusu, run id ve kanıt tabanlı doğrulama modeli.
LLM-as-judge testleri neden çalıştırma başına farklı sonuç verir
CI'da faithfulness eşiğini kontrol eden LLM hakem, aynı kodda bir gün 0.79 bir gün 0.82 verebilir. Sıcaklık, model sürümü ve belirsiz rubric jitter'ın kaynağı; k-örnekleme ve gürültü bandı çözüm.
Veri Yarışları ve ThreadSanitizer'ın Sınırlamaları
Veri yarışları ve ThreadSanitizer'ın sınırlamaları hakkında bilgi edinin. C ve Go dillerindeki uygulamalar için önemli noktalar.