Teknoloji dünyasında üretken sistemlerin yetenekleri hızla artarken, Microsoft yapay zeka davranış kuralları taslağını kamuoyu incelemesine açarak modellerin sınırlarını netleştirmeyi hedefliyor. Microsoft AI (MAI) tarafından geliştirilen modellerin hangi temel prensipler doğrultusunda eğitileceğini ve çalışacağını belirleyen bu taslak metin, sistemlerin her koşulda insanın denetimi altında kalmasını amaçlıyor. Şirket, teknolojinin temel amacının insana hizmet etmek olduğunu belirterek, bu amaca hizmet etmeyen sistemlerin reddedilmesi gerektiğini savunuyor.
Yapay zeka ajanlarına yönelik siber saldırıların ve güvenlik risklerinin arttığı bir dönemde paylaşılan metin, altı hafta boyunca kamuoyunun geri bildirimine açık tutulacak. Süreç sonunda toplanan görüşler doğrultusunda metin güncellenecek ve nihai kurallar yıl içinde netleşecek.
İnsan Odaklı Yapay Zeka Anlayışı ve Temel İlkeler
Microsoft bünyesindeki araştırma ekipleri, güvenlik uzmanları ve hukuk birimlerinin ortak çalışmasıyla hazırlanan rehber, “Humanist AI” yani insancıl yapay zeka yaklaşımına dayanıyor. Bu yaklaşımın temelinde teknolojinin bir amaç değil, sadece insanın potansiyelini artıran ve refahını destekleyen bir araç olması fikri yatıyor.
Metinde altı çizilen en net kural, yapay zekanın hiçbir koşulda bir insan gibi algılanmaması ve insan emrine tabi kalması gerekliliği. Geliştirilen sistemlerin denetim mekanizmalarını aşmasına ya da kendi kendine varoluşsal hedefler edinmesine izin verilmeyecek.
Kesin Yasaklar ve Kapatılma Güvencesi
Hazırlanan Microsoft yapay zeka davranış kuralları, modellerin asla çiğneyemeyeceği kesin sınırları ayrıntılı şekilde sıralıyor. Bu sınırlar, kitlesel zarara yol açabilecek silahların tasarlanmasını engellemeyi, çocuk güvenliğini korumayı ve geniş kitleleri hedef alan manipülasyon girişimlerinin önüne geçmeyi kapsıyor.
Taslak metinde öne çıkan kritik teknik ve operasyonel şartlar şu maddelerden oluşuyor:
- Durdurulabilirlik Güvencesi: Modeller hiçbir şart altında bir insanın kendilerini durdurmasına, düzeltmesine veya kapatmasına karşı direnç gösteremeyecek.
- Kapsam Sınırı: Yapay zeka sistemleri kendilerine verilen görev alanını kendi inisiyatifleriyle genişletemeyecek ve insan tarafından atanmamış bağımsız amaçlar edinemeyecek.
- Şeffaf Muhakeme: Sistemler, kendilerini denetleyen uzmanlardan ve güvenlik ekiplerinden karar alma mantıklarını veya muhakeme süreçlerini gizleyemeyecek.
- Esnek Yapılandırma: Kurumsal iş ortaklarının modelleri kendi iş süreçlerine göre güvenle uyarlamasına imkan tanınırken, kullanıcılara tek tip bir yapay zeka dayatılmayacak.
Küresel Katılım ve Geri Bildirim Süreci
Yapay zeka güvenliğinin yalnızca tek bir şirketin kararlarıyla belirlenemeyeceğini ifade eden şirket yetkilileri, bu sürece akademisyenleri, iş ortaklarını ve bağımsız kullanıcıları dahil etmek istiyor. Taslak metinle ilgili resmi inceleme sürecine katılmak isteyenler, ayrıntılara Microsoft Resmi Haber Merkezi üzerinden ulaşarak katkı sağlayabiliyor.
Geri bildirim sürecinde özellikle şu soruların yanıtları aranıyor:
- Modellere insani değerler ve etik sınırlar teknik olarak daha net nasıl kazandırılabilir?
- Geliştiricilerin kullandığı kavramlar teknik testlerde ve ölçümlerde nasıl somutlaştırılabilir?
- Birden fazla yapay zeka ajanının birlikte çalıştığı senaryolarda güvenlik denetimleri nasıl korunabilir?
- Yenilik hızı kesilmeden sağlıklı ve zorunlu güvenlik önlemleri nasıl sürdürülebilir?
Teknoloji Sektörü ve Kullanıcılar İçin Ne Anlama Geliyor?
Geliştirilen bu davranış rehberi, yalnızca Microsoft’un kendi modellerini değil, bu altyapıyı kullanarak ürün inşa eden yazılım geliştiricilerini de yakından ilgilendiriyor. Kurumsal operasyonlarda otonom kararlar alabilen sistemlerin sayısı arttıkça, bu sistemlerin kontrol dışına çıkmasını önleyecek denetim mekanizmalarına duyulan ihtiyaç daha belirgin hale geliyor.
Altı haftalık danışma sürecinin tamamlanmasının ardından toplanan veriler analiz edilecek. Kuralların revize edilmiş son versiyonu yılın ilerleyen dönemlerinde yayımlanarak resmi bir eğitim ve denetim kılavuzu olarak yürürlüğe girecek.