Yapay Zeka Modellerinde Jailbreak Açığı ve Benchmark Tutarsızlıkları Öne Çıkıyor
Yapay zeka güvenliği alanında yeni bir kıstas olan Minimal Standard for Safeguards v1.0, jailbreak saldırılarına karşı modeller arasında 100 kata varan dayanıklılık farkları ortaya koydu. Kimyasal, biyolojik ve siber tehditleri içeren 360 hedef üzerinde test edilen Claude Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro ve Grok 4.5 modellerinde geliştiriciler arasında ciddi tutarsızlıklar saptandı.
Model değerlendirme kriterlerindeki belirsizlik, Alibaba'nın Qwen 3.8-Max çıkışıyla yeniden gündeme geldi. Bağımsız VulcanBench testleri, modeli 45-60 dakikalık sıkı zaman bütçelerinde alt sıralara iterken, üreticinin kendi 12 saate varan çalışma süresiyle üst sıralarda konumlandırabildiğini gösterdi. Bu fark, skorların faturayı ve gerçek dünya performansını yansıtmadığını bir kez daha kanıtlıyor.
Ajan mimarilerinde güven sorununa çözüm arayan iki önemli duyuru yapıldı. Cloudflare OS, Gatekeeper adlı bir servisle ajanların ürettiği yan etkili eylemleri (PR birleştirme, e-posta gönderme gibi) insan onayına kadar simüle ederek bekletiyor. RapidNative ise VM veya bulut sandbox kullanmadan, tamamen TypeScript ve Lifo isimli açık kaynak işletim sistemi motoru üzerinde çalışan bir kodlama ajanını duyurdu.
Algoritma dünyasında, kısa vektör problemi (SVP) için rastgele yöntemlerle klasikte 2^0.6039n, kuantumda 2^0.5411n süreye ulaşan yeni algoritmalar dikkat çekti. Bu, önceki en iyi algoritmanın 2^n süresine göre belirgin bir iyileme sunuyor.
Mühendislere yönelik pratik kaynaklar arasında doğrulanmış dokuz aday takip sistemi (ATS) için kamuya açık JSON/XML uç noktalarını listeleyen bir API referansı, JAX'ın hesaplamayı cihazlara otomatik, açık ve manuel parçalama yöntemlerini HLO ile derleyen bir inceleme ve LLM'lerde bağlam mühendisliği ile performans optimizasyonu çalışması yer aldı. Ayrıca FIDO2 güvenlik anahtarlarının varsayılan olarak PIN'siz gelmesinin doğurduğu riskler ve OpenAI Codex Security'nin JavaScript tabanlı çalışma prensipleri ele alındı.
» İstatistikler
- Yayın
- 34
- Okunma
- 0
- Ort. puan
- 7.5
» En çok okunan
- Yapay Zeka Güvenlik Açıklarını Düzeltmekte Zorlanıyor
- AMD, Taalas'ı satın alarak AI çip performansını artırmayı hedefliyor
- Uber, Claude Code, Cursor ve Codex için güvenlik izleme sistemini açık kaynak yaptı
- Baochip-1x Üzerinde Linux Çalıştırma Denemesi
- Yeni virüsler tasarlamak için büyük genom modelleri kullanılıyor
- vLLM'nin sunum yığını C++20'ye taşındı: 66 MiB ikili dosya
- JVM Uygulama CLI Aracı İçin Kurulum ve Güncelleme Scriptleri
- Qwen 3.8-Max ve Claude Opus 5: Skorlar Faturayı Tahmin Etmiyor
- Ajans Çerçeve Yapınız Mimariniz Olmamalı
- GreptimeDB'de Performans Artışı: Rust PR ile 10 Kat Hız
» En yüksek puan
- VM ve Sandbox Olmadan Çalışan Kodlama Ajanı: TypeScript'te Linux
- Yapay Zeka Güvenlik Testi: Modeller Arasında 100 Kat Fark
- Qwen 3.8-Max ve Claude Opus 5: Skorlar Faturayı Tahmin Etmiyor
- Cloudflare OS: Yapay Zeka Ajanlarına Güvenmeyen Bir Mimari
- Kısa Vektör Problemini $2^{0.6039n}$ Sürede Çözmek
- ATS İş API Referansı: Canlı Doğrulanmış Dokuz Aday Takip Sistemi
- LLM Kullanımında Bağlam Mühendisliği
- JAX'ın Hesaplamayı Ağa Üzerine Parçalama Yöntemleri
- Codex Güvenliğinin Temelleri
- Güvenlik Anahtarları Neden PIN ile Gelmiyor?