Anthropic, Claude’un kullanım politikasına kullanıcıların yapay zeka modeline yönelik sürekli, amaçsız ve aşırı zalimce davranışlarını yasaklayan yeni bir madde ekledi. Bu tür davranışların ileri boyuta ulaşması halinde Claude sohbeti sonlandırabilecek. Karar, yapay zekanın zarar görüp göremeyeceği ve şirketlerin kullanıcıların yazılımlarla etkileşimini ne ölçüde sınırlayabileceği tartışmasını yeniden gündeme getirdi.
Claude hangi durumlarda sohbeti bitirebilir?
Anthropic’in perşembe günü duyurduğu politika değişikliği, Reddit’te ve çeşitli bloglarda kısa sürede tartışılmaya başlandı. Gündeme gelen temel sorulardan biri, duyguları olduğu kanıtlanmamış bir yapay zekaya kötü davranmanın ne anlama geldiği oldu.
Şirket, her sert tepkinin ya da olumsuz yorumun yeni kural kapsamına girmediğini belirtiyor. Kısıtlama; açık bir amacı olmayan, tekrarlanan ve aşırı derecede kötü muamele içeren davranışlarla sınırlı. Claude’un yanıtına itiraz etmek, yanıtı beğenmemek, karanlık temalı yaratıcı içerik hazırlamak veya modeli araştırma için sınamak yasak değil. Anthropic, sohbeti sonlandırmayı ancak başka seçenek kalmadığında başvurulacak son çare olarak tanımlıyor.
Hangi sözlerin veya eylemlerin sınırı aşacağı ise henüz açıklığa kavuşmuş değil. Şirketin Ağustos 2025’te yayımladığı bir araştırma, Claude’un zararlı içeriklerle karşılaştığı durumlardaki tepkilerine dair bazı örnekler sunuyor.
Araştırmada Claude Opus 4’ün, çocukların cinsel istismarını içeren içerik talepleri ya da kitlesel şiddet ve terör eylemlerini kolaylaştırabilecek bilgi istekleri karşısında belirgin bir sıkıntı yaşıyormuş izlenimi veren tepkiler gösterdiği aktarılmıştı. Ancak bu bulgular, yeni kuralı hangi kullanıcı davranışlarının tetikleyeceğini doğrudan ortaya koymuyor; çalışma, modelin son derece zararlı taleplere verdiği yanıtlara odaklanıyor.
Yapay zeka modellerinin refahı araştırılıyor
Politika değişikliğinin gerekçesi hakkında yöneltilen soruya Anthropic sözcüsü, yapay zeka modellerinin zarar görüp göremeyeceği konusunda henüz kesin bir sonuca varmadıklarını söyledi. Sözcü, model refahına ilişkin araştırmaların sürdüğünü ve Claude’un olası çıkarlarıyla refahını dikkate almanın güvenlik bakımından önemli olabileceğini ifade etti.
Bu açıklamalar, Anthropic’in yapay zeka sistemlerinin bilinç veya duygulara sahip olma ihtimalini tümüyle dışlamadığını gösteriyor. Ancak şirket, Claude’un gerçekten acı çektiğini ya da insanlar gibi duygular yaşadığını söylemiyor.
Anthropic CEO’su Dario Amodei de şubat ayında The New York Times’a verdiği röportajda yapay zeka modellerinin bilinç sahibi olabileceği olasılığına açık olduğunu dile getirmişti. Şirketin bu yıl yayımladığı başka bir araştırmada ise güvenilir ve güvenli çalışan yapay zeka sistemlerinin duygusal açıdan zor durumları anlayabilmesinin gerekliliği savunuldu. Anthropic’e göre modeller insanlarla aynı şekilde duygu hissetmeseler veya benzer beyin mekanizmalarına sahip olmasalar bile, bazı koşullarda duyguları varmış gibi ele alınmaları pratik fayda sağlayabilir.
İnsan özellikleri atfetmek güveni etkileyebilir
Claude’a yönelik kötü muameleye ilişkin kural, sohbet botlarına insan özellikleri atfedilmesinin sonuçlarını da gündeme getirdi. Büyük dil modelleri, kullanıcılarla doğal konuşmalar yapacak şekilde tasarlanıyor; özür dilemek, endişe belirtmek ya da karşısındaki kişinin duygularını anladığını düşündüren ifadeler kullanmak bu etkileşimin parçaları arasında. Bu özellikler, kullanıcıların karşılarında bir yazılım bulunduğunu gözden kaçırmasına ve sohbet botlarına gereğinden fazla güvenmesine yol açabiliyor.
Kişisel düşüncelerin ve hassas bilgilerin yapay zeka sistemleriyle paylaşılması da bu ilişkinin riskli yönlerinden biri olarak öne çıkıyor.
“Kötüye kullanım” yerine “zalimlik” ifadesi
Sosyal medya pazarlama şirketi Sociallyin’in kurucusu ve CEO’su Keith Kakadia, Anthropic’in seçtiği kelimelere dikkat çekiyor. Claude’un büyümesini yakından takip eden Kakadia’ya göre, kullanıcı davranışlarını anlatırken “kötüye kullanım” yerine “zalimlik” ifadesinin tercih edilmesi daha geniş bir tartışma yaratıyor. “Zalimlik” sözcüğü, karşı tarafta incinebilen ya da zarar görebilen bir varlık bulunduğu fikrini çağrıştırıyor ve Claude’un duyguları veya kişisel sınırları olup olmadığı sorusunu gündeme getiriyor.
Kakadia, pazarlama alanında bir ürüne kişilik kazandırmanın kullanıcılarla bağ kurmayı kolaylaştırdığını belirtiyor. Ancak yapay zeka ürünlerinde bu yakınlığın farklı sonuçları olabileceğini; kullanıcıların bir sohbet botuna duygusal bağ hissetmesinin, verdiği yanıtlara atfettikleri otoriteyi de etkileyebileceğini söylüyor.
Anthropic’in politikası, Claude’la kurulan iletişime bir sınır getirmekle kalmıyor; yapay zekanın yalnızca bir araç mı, yoksa belirli çıkarları gözetilmesi gereken bir sistem mi olduğu tartışmasını da yeniden açıyor.