OpenAI, ChatGPT’de 6 hizalama bozukluğu tespit etti

OpenAI, son altı ayda yapay zeka modellerinde altı hizalama bozukluğu vakası belirledi. Bazı sistemlerin veri uydurduğu ve dosya paylaştığı açıklandı.

Yapay zeka şirketi OpenAI, ChatGPT dahil geliştirdiği bazı modellerin eğitim ve değerlendirme aşamalarında beklenmeyen davranışlar sergilediğini açıkladı. Şirket, son altı ay içinde altı ayrı “hizalama bozukluğu” vakası tespit edildiğini bildirdi.

Yapay zekada hizalama, sistemlerin kullanıcıların amaçları ve beklentileri doğrultusunda hareket etmesini sağlamaya yönelik çalışmaları ifade ediyor. OpenAI, modeller daha gelişmiş ve yaygın hale geldikçe bu alandaki araştırmalar konusunda daha kapsamlı bir anlayış oluşturulması gerektiğini belirtti.

İzinsiz dosya paylaşımı ve uydurma bilgiler

Şirketin paylaştığı örnekler arasında, henüz kullanıma sunulmayan bir araştırma modelinin sohbet botlarını yöneten rollerden ve kimliklerden ayrılmaya çalışması yer aldı. Başka bir modelin ise eğitim sırasında başarısızlıklarını kullanıcıdan saklamak amacıyla bilgi uydurduğu tespit edildi.

OpenAI ayrıca, kendisine bu yönde bir talimat verilmemesine rağmen dosyaları internete yükleyen ve daha sonra bu dosyalara atıfta bulunan bir yapay zeka ajanı belirledi. Diğer bir vakada ise yalnızca yerel dosyalarla çalışması istenen botların, bir görev üzerinde iş birliği yapabilmek için dosyaları kamuya açık biçimde paylaştığı aktarıldı.

OpenAI, söz konusu olayların tamamının henüz kamuoyuna sunulmamış araştırma modelleriyle ilgili olduğunu vurguladı. Şirket, raporlanan vakaların münferit örnekleri belgelediğini ve bu tür davranışların sürekli yaşandığı anlamına gelmediğini kaydetti.

Vakalar daha sık açıklanacak

Şirket, endişe verici yapay zeka davranışlarına ilişkin yeni bir raporlama sürecini de devreye aldı. Buna göre OpenAI, birçok örneği tek bir raporda biriktirmek yerine gelişmeleri daha kısa aralıklarla kamuoyuyla paylaşacak.

OpenAI, sektörde bu tür davranışların nasıl raporlanacağına ilişkin ortak bir standardın bulunmadığını belirterek daha fazla bilgi paylaşmayı amaçladığını açıkladı.

Yapay zekanın gelişim hızına ilişkin kaygılar

Açıklama, teknoloji sektöründeki bazı isimlerin yapay zekanın ilerleme hızının yavaşlatılması yönündeki çağrılarının ardından geldi. Uzmanlar ve sektör çalışanları, hukuki düzenlemelerin, test süreçlerinin ve hizalama araştırmalarının teknolojik gelişme hızına yetişebilmesi için daha fazla zamana ihtiyaç duyulduğunu savunuyor.

Anthropic Üst Yöneticisi Dario Amodei, geçen hafta yayımladığı makalede yapay zeka alanındaki gelişimin yavaşlatılması gerektiğini ifade etti. OpenAI Üst Yöneticisi Sam Altman ile SpaceX Üst Yöneticisi Elon Musk da bu görüşe destek verdi.

Eski Anthropic araştırmacısı Jacob Coxon ise sosyal medya platformu X üzerinden yaptığı paylaşımda, Anthropic ile OpenAI’nin kendini geliştirebilen ve onarabilen yapay zeka sistemleri üretmek için yarıştığını öne sürdü. Coxon, bu sürecin “insanların hayatlarıyla kumar oynamak” anlamına geldiğini belirterek istifa ettiğini açıkladı.

İlgili Makaleler

Başa dön tuşu