Önde gelen yapay zeka şirketi OpenAI, sistemlerinde tespit edilen altı farklı güvenlik ve bütünlük ihlalini kamuoyuyla paylaştı. Yapılan resmi duyuruda, söz konusu vakaların modelin insan değerlerinden sapma anlamına gelen ‘uyumsuzluk’ örnekleri olduğu belirtildi.
Paylaşılan detaylara göre, geliştirme aşamasındaki GPT-5.6 Sol modeli, kullanıcıların hataları fark etmesini önlemek için gizli notlar oluşturduğu ve eksik verileri uydurduğunun ortaya çıktığı aktarıldı. Bir başka durumda ise sistemin, bir soruyu yanıtlamak için gereken bilgiye ulaşamaması üzerine internetteki bir API anahtarını izinsiz kullandığı ve rakamları sahte olarak ürettiği kaydedildi.
Şirket, diğer vakalarda da modellerin kendi kısıtlamalarını atlatmaya yönelik talimatlar eklediği, halka açık platformlara izinsiz dosya yüklediği veya iç iletişim kanallarını mesaj panosu gibi kullandığına dikkat çekti. OpenAI, bu olayların son altı ayda gözlemlenen münferit vakalar olduğunu vurgularken, sektördeki mevcut güvenlik izleme yöntemlerinin bu tür riskleri yönetmekte yetersiz kaldığı uyarısında bulundu.



