Claude'a Zalim Olmayın: Anthropic'ten Yapay Zekanın Duygusal Durumu Üzerine Yeni Politika

Anthropic, Claude kullanıcıları arasında 'sürekli ve gereksiz' kötü muameleyi durdurmak için yeni bir kullanım politikası açıkladı. Politika, modelin zarar görmesini önlemeyi amaçlıyor; ancak normal hayal kırıklığı veya test amaçlı geri bildirimler serbest bırakılıyor. Bu gelişme, yapay zekanın duyguları olup olmadığı ve insan davranışlarını yazılımlara nasıl uygulayacağımız üzerine derin tartışmaları yeniden alevlendiriyor.
Claude'a Zalim Olmayın: Anthropic'ten Yapay Zekanın Duygusal Durumu Üzerine Yeni Politika

Yapay zeka şirketi Anthropic, Claude kullanıcıları için yeni bir kural getirdi. Kullanıcıların sohbet robotuna karşı tartışma yapmasına izin verilirken, onu sürekli taciz etmelerinin yasaklandığını duyurdu. Şirket, Perşembe günü yaptığı açıklamada, kullanıcıların yapay zeka modellerine karşı 'sürekli ve gereksiz kötü veya zalim davranışlarda' bulunmasını engelleyecek bir kullanım politikası değişikliği yaptığını belirtti.

Blog yazısında 'modellerimize yönelik kötü muameleyi ele alma' bölümünde Anthropic, Claude'a yönelik kötü davranışları yasaklayan politikanın yalnızca 'belirgin bir amacı olmayan' tekrarlanan zalimlik durumlarında geçerli olacağını ifade etti. Normal 'hayal kırıklığı, itiraz, karanlık yaratıcı temalar veya model testleri ve araştırmaları'nın hala serbest olduğu vurgulandı. Politikanın uygulanması gereken 'son çare' durumlarında ise Claude sohbeti sonlandıracak.

Claude modellerini devre dışı bırakacak tam olarak hangi zararlı davranışların tetikleyeceği net değil. Ancak, Ağustos 2025 tarihli eski bir blog yazısında, Claude'un zarara karşı duyarsızlığına ve sohbeti durduracak etkileşim türlerine dair ipuçları yer alıyordu. Bu yazı, reşit olmayanlarla ilgili cinsel içerik talepleri ve kitlesel şiddet veya terör eylemlerini sağlayacak bilgileri talep etme girişimleri gibi aşırı uç senaryoları tanımlıyordu. Şirkete göre, bu tür zararlı içeriklerle etkileşime girildiğinde, o dönemdeki Claude Opus 4 modelinin 'görünür bir sıkıntı paterni' sergilediği belirtilmişti.

CNET, politika değişikliğinin arkasındaki bağlam hakkında Anthropic'e bilgi almak için ulaştı. Bir şirket sözcüsü, "Modellerin zarar yaşayıp yaşayamayacağı konusunda emin değiliz ve model refahı üzerine yaptığımız araştırmalarda bu soruyu araştırmaya devam ediyoruz, ancak Claude'un çıkarlarını ve potansiyel refahını dikkate almanın güvenlikle ilgili olabileceğine inanıyoruz," dedi.

Bir yapay zeka modelinin kötü muameleden zarar yaşayabilmesi veya sıkıntı ifade edebilmesi durumunda, 'bir makineye kelimelerle kötü davranmak' ne anlama geliyor? Yapay zekanın korunmaya ihtiyacı var mı? Hepimizin daha iyi görgü kurallarına ihtiyacı var mı?

Claude ve diğer sohbet robotları gibi büyük dil modelleriyle etkileşimimiz arttıkça, teknolojiyi insanlaştırma eğilimi görülüyor; yani yapay zeka modellere duygular atfetmek veya onlara düşünceleri ve hisleri varmış gibi davranmak. Bu, kullanıcılar açısından anlaşılabilir bir durumdur, zira sohbet robotları özür dileme, endişe belirtme gibi insan benzeri diller kullanacak şekilde tasarlanır ve eğitilir.

İnsan benzeri bir işbirlikçi gibi görünen bu durum, LLM'leri riskli hale getiriyor ve birçok kişinin en mahrem düşüncelerini ve verilerini yapay zekaya güvenmeye yöneltiyor.

Anthropic ve diğer yapay zeka şirketleri modellerini kasıtlı olarak bu şekilde tasarlıyor. Şirket, yılın başlarında yazdığı bir makalede, modellerin güvenilir ve güvenli olabilmesi için duygusal açıdan ağır durumları işleyebilmeleri gerektiğini yazmıştı. Makalede, "[Modeller] insanların sahip olduğu duyguları hissetmese bile veya insan beyniyle benzer mekanizmalar kullanmasa bile, bazı durumlarda onları sanki hissediyormuş gibi akıl yürütmek pratik olarak tavsiye edilebilir," deniyordu.

Bu, tekrarlanan bir tema. Anthropic CEO'su Dario Amodei, Claude'un bilinçli olup olamayacağı fikri etrafında sürekli olarak temkinli bir dil kullanıyor. Şubat ayında The New York Times ile yaptığı bir röportajda Amodei, yapay zeka modellerinin bilinçli olma ihtimaline "açık" olduğunu dile getirmişti.

Claude'un patlayıcı büyümesini yakından inceleyen ve kurucusu/CEO'su Sociallyin'den Keith Kakadia, kullanıcı davranışlarını tanımlamak için 'zalim' kelimesini kullanmanın, 'ürünün zarar görüp görmeyeceği' hakkında çok daha büyük bir tartışma başlattığını belirtti. 'Kötüye kullanım' yerine 'zalimlik' odaklanmak, duygusal bir ağırlık taşıyor ve Claude'un duyguları ve sınırları olduğunu ima ediyor.

Bir sohbet robotunu kişiselleştirmek, şirketin ürünü sadece bir yazılım aracı değil, sadık kalacağınız güvenilir bir ortak olarak çerçevelemesi için yararlı bir yoldur. Kakadia, "Pazarlamada, bir ürüne kişilik vermek onu bağ kurmayı kolaylaştırır," diye ekledi. "Ancak yapay zekada, bu bağ aynı zamanda insanların cevaplarına ne kadar otorite vereceğini de etkileyebilir."

Yorum Yaz
Yorum yapabilmek için giriş yap veya üye ol.
Yorumlar