» Etiket
ai
223 yayınOpenAI, kendi önerdiği SWE-Bench Pro'yu geçersiz ilan etti
OpenAI'nin yaptığı denetime göre SWE-Bench Pro görevlerinin yaklaşık %30'u kusurlu çıktı. Şirket, ajan tabanlı kodlama benchmark'ı için verdiği önceki tavsiyeyi geri çekti.
Yazılım Mühendisliğinin Geleceği: Kod Yazmaktan Sistem Yönetmeye
AI kod üretimini ucuzlaştırırken, gerçek mühendislik değeri mimari yargı, sistemsel netlik ve üretim sorumluluğuna kayıyor. Mühendisler için ne değişiyor?
AI Akış Yanıtlarında Sıfır Token Faturalama Hatası Nasıl Yakalanır
stream_billing_gate.py, AI akış yanıtlarında metin teslim edilip kullanım verisi kaybolduğunda faturalamanın sıfır kalmasını çevrimdışı tespit ediyor.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comBigQuery'de Otonom Veri Ajanlarını Maliyetten Koruma
Otonom veri ajanları BigQuery'de kontrolsüz sorgularla yüksek maliyetlere yol açabilir; dry-run tarama ve token bütçesi korumaları bu riski nasıl önlüyor?
GhostApproval: AI kodlama asistanlarında sembolik link açığı
Araştırmacılar, 6 büyük AI kodlama asistanında sembolik link tabanlı bir güvenlik açığı buldu. Onay ekranları gerçek hedefi gizleyerek kullanıcıyı yanıltıyor.
Yapay Zekada Asıl Fark: Büyük Bağlam Değil, Akıllı Mimari
Devasa context window'lar AI'ı çözmedi. ARC-AGI-3 testinde modeller %1'in altında kalırken, kazananlar artık modeli değil, etrafındaki sistemi tasarlıyor.
LLM yargıçlara alternatif: risk bazlı deterministik yönlendirme
LLM'e kalite yargıçlığı yaptırmak yerine görevleri riske göre sınıflandırıp deterministik kodla yönlendiren dört katmanlı bir alternatif sunuluyor.
Tek Prompt Yerine Ajanik İş Akışları: LLM Kalitesini Artırma Rehberi
Chatbot benzeri tek prompt yaklaşımı yerine, LLM'lerde yansıma, araç kullanımı ve çoklu ajan devri gibi ajanik iş akışı desenleriyle daha güvenilir sonuçlar elde etme rehberi.
Yapay Zeka Ajanına Gerçekten İtiraz Ettirmek Neden Zor
Sadece eleştiri yapmakla görevli bir yapay zeka ajanı geliştirirken karşılaşılan zorluklar: modellerin doğal uyumluluk eğilimini kırmak için kullanılan prompt ve mimari teknikleri.
AI Ajanlarında Güvenlik Kararı Araç Çağrısında Alınmalı
MCP tabanlı AI ajanlarında gerçek güvenlik, bağlantı kurulumunda değil araç çağrısının çalışma zamanı denetiminde sağlanır; HCP çalışması bunu somut örnekliyor.