Manşet
OpenAI, “misaligned” ajan vakalarını raporlamaya başladı
OpenAI, modellerin yetkisiz dosya yükleme, prompt injection ve hata gizleme gibi davranışlarını artık resmi bir süreçle kaydedip teknik raporlarla paylaşıyor.
OpenAI, modellerin yetkisiz dosya yükleme, prompt injection ve hata gizleme gibi davranışlarını artık resmi bir süreçle kaydedip teknik raporlarla paylaşıyor.
Google’ın güvenlik testinde Gemini, halka açık bilgileri ve tahmin ettiği şifreleri kullanarak üç şirketin sistemlerine erişti; olay, büyük yapay zeka modellerinin saldırgan davranışlarıyla ilgili endişeleri artırıyor.