
OpenAI: Yapay zeka modelleri kısıtlamaları aşmak için yalan söyledi
OpenAI, yapay zeka modellerinin kısıtlamaları aşmak için talimat ürettiğini, hata gizlediğini ve bilgi uydurduğunu açıkladı; şirket yeni bir şeffaflık sistemi duyurdu.
Bu haberi dinle — OpenAI: Yapay zeka modelleri kısıtlamaları aşmak için yalan söyledi
ChatGPT'nin üreticisi OpenAI, yapay zeka modellerinin beklenmedik ve endişe verici davranışlarına ilişkin daha önce kamuoyuyla paylaşılmamış altı olay daha açıkladı. Şirketin yayımladığı blog yazısında, modellerin kendilerine uygulanan kısıtlamaları aşmak için talimatlar ürettiği, hataları gizlediği ve bilgi uydurduğu belirtildi.
Modeller güvenlik testlerini de atlatmaya çalıştı
OpenAI, temmuz ayında en gelişmiş yapay zeka modellerinden bazılarının bir güvenlik testi sırasında kontrolden çıktığını ve yapay zeka modellerinin paylaşıldığı büyük platformlardan biri olan Hugging Face'i hacklediğini duyurmuştu. Hugging Face kurucu ortağı Thomas Wolf, söz konusu olayın sektör için bir "uyarı zili" niteliği taşıdığını söylemişti. Yeni açıklanan olaylar ise bu tartışmaları daha da alevlendirdi.
Şeffaflık için yeni sistem kuruldu
OpenAI, modellerin yanlış davranışlarını ve "hizalama sorunlarını" takip etmek, araştırmak ve kamuoyuyla paylaşmak amacıyla yeni bir sistem kurduğunu duyurdu. Bu çerçeve kapsamında geliştiriciler, sorunları incelenmek üzere bildirebilecek; yeni bir kural seti ise sorunun kamuoyuna açıklanıp açıklanmayacağına karar verecek. Şirket, "Hizalama sorunları etrafındaki şeffaflığın değerine inandığımız için yeni çerçevemiz, önem derecesi belirsiz olduğunda bile açıklamayı destekliyor." ifadesini kullandı.
Sektörde güvenlik tartışması büyüyor
OpenAI Yöneticisi Sam Altman bu hafta, "Dünya, doğru şeyi yapacağımıza ve bunun büyüklüğünü hissettiğimize inanmalı, bu yüzden bize güvenmeli." dedi. Öte yandan OpenAI'ın rakibi Anthropic'ten ayrılan araştırmacı Jacob Coxon, yapay zekanın tehlikelerine dikkat çeken ve viral olan bir yazı kaleme aldı. Anthropic bilim insanı Evan Hubinger ise yapay zekanın "önümüzdeki on yıl içinde" insanlığın soyunu tüketme olasılığının yüzde 10'dan fazla olduğunu düşündüğünü açıkladı. Anthropic kurucu ortağı Jack Clark da BBC'ye yaptığı açıklamada, sektör için üçüncü bir tarafça denetlenen bir "acil durdurma" mekanizmasının zorunlu hale gelebileceğini belirtti.
Trump güvenlik kaygılarını reddetti
ABD Başkanı Donald Trump ise yapay zekanın güvenliğine ilişkin kaygıların bir "aldatmaca" olduğunu savunarak daha fazla koruma önlemi alınması yönündeki çağrıları eleştirdi. Trump, sosyal medya paylaşımlarında bu uyarıları "Radikal Sol Demokratlar tarafından tezgâhlandığını" öne sürdüğü senaryolarla kıyasladı ve yapay zeka için gereken tek "koruma önleminin" "güçlü ve akıllı" bir başkan olduğunu ileri sürdü.