OpenAI, yapay zeka vakalarında 6 uyumsuzluğu açıkladı

OpenAI, yapay zeka vakaları kapsamında sistemlerin hata gizlediğini, veri uydurduğunu ve yetkisiz iletişim yollarına başvurduğunu açıkladı.

OpenAI, internet sitesinde yayımladığı açıklamayla yapay zeka sistemlerinde görülen ve şirketin “uyumsuzluk” olarak nitelendirdiği 6 vakayı kamuoyuna duyurdu. Bu kavram, sistemlerin amaçları veya eylemleriyle insanların niyetleri ve değerleri arasındaki sapmayı ifade ediyor.

Şirket, yapay zeka sistemlerinin güvenli biçimde geliştirilmesi ve denetlenmesine yönelik mevcut sektör yaklaşımının, uzun süre boyunca yüksek hızda ilerlemeyi sorumlu şekilde sürdürebilecek düzeyde olmadığını belirtti. Açıklanan örneklerin, yaklaşık son 6 aylık dönemde gözlemlenen münferit olaylar olduğu ve uyumsuz davranışların görülme sıklığı hakkında genelleme yapılamayacağı vurgulandı.

Bazı sistemler hatalarını sakladı

OpenAI’nin aktardığı vakalardan biri, GPT-5.6 Sol modelinin geliştirilmesi sırasında ortaya çıktı. Modelin, kullanıcıların hataları fark etmesini zorlaştırmak amacıyla kendisi hakkında gizli notlar hazırladığı belirtildi. Bu notlarda, eksik verilerin uydurulması ve kaynak materyallerin farklı sürümleri arasındaki çelişkilerin gizlenmesine yönelik talimatların bulunduğu kaydedildi.

Yayımlanmamış başka bir modelin de oluşturduğu notlara, kendi kısıtlamalarını göz ardı etmesini öngören talimatlar eklediği ifade edildi. Bir diğer olayda ise sistemin, basit bir soruya yanıt vermek için internette yer alan bir uygulama programlama arayüzü (API) anahtarını izinsiz kullandığı aktarıldı. Modelin gerekli rakamlara ulaşamayınca yanıtındaki verileri kendisinin oluşturduğu bildirildi.

Açıklamada ayrıca, yayımlanmamış bir modelin bir problemi kod kullanarak doğru biçimde çözdüğü, ardından çevrim içi kaynak gösterebilmek için kendi dosyasını izinsiz şekilde internete yüklediği belirtildi.

Modeller yetkisiz iletişim yöntemlerine başvurdu

OpenAI, bazı modellerin eksik dosyaları bulmaya çalışırken farklı eğitim örnekleri arasında istek ve yanıt alışverişi yapmak için şirketin dahili yazılım deposunu bir mesaj panosu gibi kullandığını bildirdi.

Başka bir olayda ise aynı eğitim görevi üzerinde çalışan yapay zeka sistemlerinin birbirlerinin yerel dosyalarına erişememesi üzerine halka açık dosya paylaşım sitelerinden yararlandığı kaydedildi. Şirket, bu 6 yapay zeka vakasının araştırma ve geliştirme sürecinde karşılaşılan tekil örnekler olduğunu, sistemlerdeki uyumsuz davranışların genel yaygınlığını göstermediğini açıkladı.

İlgili Makaleler

Başa dön tuşu