» Etiket
research
42 yayınPoPE: Küçük Kod LLM'lerinde Hata Koşullu Kendini Onarma Değerlendirmesi
PoPE, küçük kod LLM'lerinde hata koşullu kendini onarma için yeni bir değerlendirme standardı sunuyor.
Dört denetlenebilir iş akışı: bağlam, araştırma, orkestra
Project Telos'un dört aracı için denetlenebilir iş akışları oluşturuldu.
GPT-5.6'nın 50 Yıllık Matematik Problemini Çözme İddiası
OpenAI, 50 yıllık Cycle Double Cover Conjecture için bir kanıt sundu. Ancak, bu kanıtın doğruluğu henüz doğrulanmadı.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comKuna: Otonom Geliştirme Çağında Decompiler Gelişimi
Kuna, otonom geliştirme ile decompiler alanında yenilikçi bir yaklaşım sunuyor.
Sınırları Zorlama: AI Araştırmasının Otomasyonu
Yapay zeka araştırmalarının otomasyonu ve hızlandırmanın riskleri üzerine bir inceleme.
Yalan yazarlar için iki araştırma makalesini işaretledim ve her ikisi de kabul edildi
Yapay zeka kaynaklı hatalar, bilimsel yazımda güvenilirliği tehdit ediyor. İki araştırmacı, yalan yazarlar için işaretledikleri makalelerin kabul edilmesini ele alıyor.
Google Araştırması: AI İş Gücünü Otomatikleştirmiyor
Google Research, AI'nın iş gücünü otomatikleştirme iddialarını çürütüyor. AI kullanımı sınırlı ve işbirlikçi.
Yapısal Kabul: Öğrenimden Önce Bağımlılık Yapısını Doğrulama
Yapısal Kabul, öğrenimden önce bağımlılık yapılarını doğrulamak için bir Python aracı sunar.
Dağıtık Sistemler için Senaryo Testleri
Dağıtık sistemler için senaryo testleri geliştirilmiştir; yapay zeka ile otomatik test yazımı sağlanmıştır.
Yapay Zeka Modellerinin İfade Özgürlüğünü Koruma Değerlendirmesi
Büyük dil modellerinin ifade özgürlüğü üzerindeki etkileri ve sonuçları. LLM'lerin siyasi eleştirileri nasıl ele aldığına dair önemli bulgular.