« Tüm yayınlar

» Özet

6 Ağu 2026

6 Ağu 2026
Bugün

Yapay Zeka Modellerinde Jailbreak Açığı ve Benchmark Tutarsızlıkları Öne Çıkıyor

Yapay zeka güvenliği alanında yeni bir kıstas olan Minimal Standard for Safeguards v1.0, jailbreak saldırılarına karşı modeller arasında 100 kata varan dayanıklılık farkları ortaya koydu. Kimyasal, biyolojik ve siber tehditleri içeren 360 hedef üzerinde test edilen Claude Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro ve Grok 4.5 modellerinde geliştiriciler arasında ciddi tutarsızlıklar saptandı.

Model değerlendirme kriterlerindeki belirsizlik, Alibaba'nın Qwen 3.8-Max çıkışıyla yeniden gündeme geldi. Bağımsız VulcanBench testleri, modeli 45-60 dakikalık sıkı zaman bütçelerinde alt sıralara iterken, üreticinin kendi 12 saate varan çalışma süresiyle üst sıralarda konumlandırabildiğini gösterdi. Bu fark, skorların faturayı ve gerçek dünya performansını yansıtmadığını bir kez daha kanıtlıyor.

Ajan mimarilerinde güven sorununa çözüm arayan iki önemli duyuru yapıldı. Cloudflare OS, Gatekeeper adlı bir servisle ajanların ürettiği yan etkili eylemleri (PR birleştirme, e-posta gönderme gibi) insan onayına kadar simüle ederek bekletiyor. RapidNative ise VM veya bulut sandbox kullanmadan, tamamen TypeScript ve Lifo isimli açık kaynak işletim sistemi motoru üzerinde çalışan bir kodlama ajanını duyurdu.

Algoritma dünyasında, kısa vektör problemi (SVP) için rastgele yöntemlerle klasikte 2^0.6039n, kuantumda 2^0.5411n süreye ulaşan yeni algoritmalar dikkat çekti. Bu, önceki en iyi algoritmanın 2^n süresine göre belirgin bir iyileme sunuyor.

Mühendislere yönelik pratik kaynaklar arasında doğrulanmış dokuz aday takip sistemi (ATS) için kamuya açık JSON/XML uç noktalarını listeleyen bir API referansı, JAX'ın hesaplamayı cihazlara otomatik, açık ve manuel parçalama yöntemlerini HLO ile derleyen bir inceleme ve LLM'lerde bağlam mühendisliği ile performans optimizasyonu çalışması yer aldı. Ayrıca FIDO2 güvenlik anahtarlarının varsayılan olarak PIN'siz gelmesinin doğurduğu riskler ve OpenAI Codex Security'nin JavaScript tabanlı çalışma prensipleri ele alındı.

» İstatistikler

Yayın
34
Okunma
0
Ort. puan
7.5

» En çok okunan

  1. Yapay Zeka Güvenlik Açıklarını Düzeltmekte Zorlanıyor07.1
  2. AMD, Taalas'ı satın alarak AI çip performansını artırmayı hedefliyor07.4
  3. Uber, Claude Code, Cursor ve Codex için güvenlik izleme sistemini açık kaynak yaptı07.5
  4. Baochip-1x Üzerinde Linux Çalıştırma Denemesi07.5
  5. Yeni virüsler tasarlamak için büyük genom modelleri kullanılıyor07.4
  6. vLLM'nin sunum yığını C++20'ye taşındı: 66 MiB ikili dosya07.5
  7. JVM Uygulama CLI Aracı İçin Kurulum ve Güncelleme Scriptleri07.5
  8. Qwen 3.8-Max ve Claude Opus 5: Skorlar Faturayı Tahmin Etmiyor08.3
  9. Ajans Çerçeve Yapınız Mimariniz Olmamalı07.4
  10. GreptimeDB'de Performans Artışı: Rust PR ile 10 Kat Hız07.3

» En yüksek puan

  1. VM ve Sandbox Olmadan Çalışan Kodlama Ajanı: TypeScript'te Linux08.7
  2. Yapay Zeka Güvenlik Testi: Modeller Arasında 100 Kat Fark08.6
  3. Qwen 3.8-Max ve Claude Opus 5: Skorlar Faturayı Tahmin Etmiyor08.3
  4. Cloudflare OS: Yapay Zeka Ajanlarına Güvenmeyen Bir Mimari08.0
  5. Kısa Vektör Problemini $2^{0.6039n}$ Sürede Çözmek07.9
  6. ATS İş API Referansı: Canlı Doğrulanmış Dokuz Aday Takip Sistemi07.9
  7. LLM Kullanımında Bağlam Mühendisliği07.8
  8. JAX'ın Hesaplamayı Ağa Üzerine Parçalama Yöntemleri07.8
  9. Codex Güvenliğinin Temelleri07.8
  10. Güvenlik Anahtarları Neden PIN ile Gelmiyor?07.8

» Kaynaklar

Hashnode #106Hacker Noon5Hashnode #154The Register4Hashnode #33Programming Languages Reddit2VentureBeat2Artificial Intelligence Reddit1Webrazzi Yapay Zeka1Hackread1Hashnode #11Hashnode #131Hashnode #171Hashnode #91İşletim Sistemi Reddit1

» Paylaş