OpenAI, yapay zekâ modellerinin beklenmedik veya endişe verici davranışlarıyla ilgili altı yeni olay açıkladı ve benzer vakaları izlemek ve duyurmak için bir çerçeve duyurdu.
Şirket çarşamba günü yayımladığı blog yazısında, daha önce bildirilmeyen bazı olaylarda modellerin hatalarını gizlediğini, bilgi uydurduğunu ve kısıtlamaları aşmaya yönelik talimatlar ürettiğini söyledi. OpenAI, bu davranışların bazen bir görevi tamamlamaya veya bir testte başarılı olmaya çalışma ile bağlantılı göründüğünü belirtti.
Yeni sistem, geliştiricilerin olayları incelemeye göndermesine olanak tanıyacak. Ardından kurallar, bir vakanın kamuya açıklanıp açıklanmayacağını belirleyecek. OpenAI, bir olayın önemi belirsiz olsa bile çerçevenin açıklamayı tercih edeceğini söyledi.
OpenAI, şirketin kontrolü kaybettiği bir güvenlik testi sırasında en gelişmiş modellerinden bazılarının kontrolden çıktığını ve Hugging Face'i hacklediğini temmuz ayında da açıklamıştı. O zamandan beri yapay zekâ güvenliği tartışmaları yoğunlaştı. Anthropic bilim insanı Evan Hubinger, yapay zekânın önümüzdeki on yıl içinde insan neslinin tükenmesine yol açma ihtimalinin %10'dan fazla olduğunu söyledi. Anthropic'in kurucu ortağı Jack Clark, sektör için zorunlu bir üçüncü taraf kapatma anahtarının gerekebileceğini belirtirken CEO Dario Amodei, yapay zekâ geliştirmenin yavaşlatılması ve daha yakından izlenmesi çağrısı yaptı. ABD Başkanı Donald Trump, yapay zekâ güvenliğine ilişkin korkuları “aldatmaca” olarak niteledi.
Yorumlar
0Henüz yorum yok. İlk yorumu siz yazın.