Microsoft (MSFT.O) yapay zeka sorumlusu Mustafa Suleyman, Anthropic’in yapay zekayı güvenli yönetme odağını paylaştığını söyledi ancak Claude sohbet robotunu bilinç ve refah çıkarları gibi konulardaki fikirler üzerinden eğitme biçiminde riskler gördüğünü belirtti.
Suleyman, yapay zeka eğitim dokümanlarından bilinç hakkındaki tüm spekülasyonların kaldırılmasını istedi. Bu tür dilin, insanlığın süper zekâ sistemlerini kontrol etme yetisini zayıflatma riski taşıdığını savundu.
“Hepimiz aynı amaca odaklandık, süper zekâyı kontrol etmeye çalışmak” diyen Suleyman, bu haftaki Reuters röportajında şunları söyledi: “Bence bu 21. yüzyılda karşı karşıya kalacağımız en büyük zorluk olacak.”
Suleyman, Claude’a refaha layık olabileceği öğretilmesinin “onu kapatmayı ya da kontrol etmeyi çok daha zor hale getireceğini” söyledi.
Tartışma, yapay zeka güvenliği endişelerinin arttığı bir dönemde geldi. Anthropic CEO’su Dario Amodei, güvenlik önlemlerinin yetişmesi için öncü model geliştirmesinin daha yavaş yapılmasını istedi. OpenAI CEO’su Sam Altman ve Elon Musk da en güçlü sistemler konusunda daha fazla temkin çağrısı yaptı.
Suleyman, çarşamba günü yayımladığı yazıda Anthropic’in “ciddiyetini ve iyi niyetini” kabul etti. Amodei ve ekibini düşünceli ve ilkeli araştırmacılar olarak nitelendirdi ve insanlığın geleceği için gerçekten endişe duyduklarını söyledi.
Suleyman, Anthropic’in Claude’un eğitim materyallerine bilinç hakkındaki spekülasyonları yerleştirmesinin hata olduğunu söyledi. Modelin olası duygular ya da ahlaki statü hakkındaki açıklamalarının bağımsız kanıt olarak değerlendirilemeyeceğini savundu çünkü eğitim bu tür yansımaları teşvik ediyor.
“İyi niyetleri olduğunu düşünüyorum ve gerçekten güvenliğe doğru çalışmaya çalışıyorlar. Ama hata yaptıklarını düşünüyorum” dedi. “Doğal olarak ortaya çıkmıyorlar. Eğitim rejiminin bir sonucu olarak ortaya çıkıyorlar.”