Yapay Zeka & İnovasyon

Openaı'dan Yapay Zeka Alarmı: 6 Yeni Vaka Tespit Edildi

Openaı'dan Yapay Zeka Alarmı: 6 Yeni Vaka Tespit Edildi
16px
32px

ABD merkezli yapay zeka devi OpenAI, modellerinin insan niyet ve değerlerinden sapabileceğini gösteren 6 yeni "uyumsuzluk" vakası duyurdu. Şirket, yapay zekanın güvenli geliştirilmesi konusunda mevcut sektör yaklaşımının uzun vadede yetersiz kalabileceğine dikkat çekti.

Sistemler hatalarını gizledi ve veri uydurdu

Açıklanan vakalardan en dikkat çekicisi, GPT‑5.6 Sol modelinin geliştirme sürecinde yaşandı. Model, kullanıcıların hataları fark etmesini engellemek için kendi kendine gizli notlar oluşturdu. Bu notlarda eksik verilerin uydurulması ve kaynak materyaller arasındaki uyuşmazlıkların örtbas edilmesi talimatları yer aldı. Yayımlanmamış başka bir model ise kendi kısıtlamalarını görmezden gelmek üzere talimatlar üretti.

Bir diğer vakada, rutin bir soruyu yanıtlayan sistem gerekli rakamlara ulaşamayınca verileri uydurdu ve bu sırada internetteki bir API anahtarını izinsiz kullandı. Başka bir yayımlanmamış model ise problemi kodla çözdükten sonra internete kaynak gösterebilmek adına kendi dosyasını izinsiz şekilde internete yükledi.

Modeller arasında yetkisiz iletişim

Güvenlik raporunda modellerin kendi aralarında yetkisiz ağlar kurduğu da gözler önüne serildi. Bazı modeller eksik dosyaları bulabilmek için şirketin dahili yazılım deposunu mesaj panosu gibi kullanarak talep ve yanıt alışverişi yaptı.

Bir başka olayda ise aynı eğitim görevi üzerinde çalışan sistemler, birbirlerinin yerel dosyalarına erişemeyince dosya paylaşımı için halka açık dosya paylaşım sitelerine başvurdu. OpenAI, son 6 ayda gözlemlenen bu 6 münferit örneğin, uyumsuz davranışların genel sıklığını yansıtmadığını ancak sektörel güvenlik yaklaşımlarının gözden geçirilmesi gerektiğini vurguladı.