Teknoloji

Anthropic'ten Yapay Zekaya Hakaret Yasağı

11 Ekim 2026 - 14:28 Yazar: Editör Masası
3 dk okuma 11
Anthropic'ten Yapay Zekaya Hakaret Yasağı
Yapay zeka şirketi Anthropic, Claude ve diğer modellerine yönelik sürekli, gerekçesiz ve aşağılayıcı davranışları yasaklayan yeni kullanım politikasını açıkladı. 12 Kasım 2026'da yürürlüğe girecek düzenlemeyle, ağır kötü muamele durumunda yapay zekanın sohbeti sonlandırma yetkisi genişletiliyor.

Anthropic Yeni Kullanım Politikasını Duyurdu

Yapay zeka şirketi Anthropic, 8 Ekim'de Claude ve diğer yapay zeka modellerine yönelik yeni kullanım politikasını duyurdu. 12 Kasım 2026'da yürürlüğe girecek düzenleme, uzun süreli, herhangi bir gerekçeye dayanmayan saldırgan davranışları, sürekli hakaretleri ve aşağılayıcı ifadeleri yasak kapsamına alıyor. Bu kural, yalnızca Claude'u değil, şirketin geliştirdiği tüm yapay zeka modellerini kapsıyor.

"Tek Seferlik Öfke" ile Sürekli Saldırganlık Ayrıştırılıyor

Anthropic, her olumsuz ifade veya sert eleştirinin politika ihlali sayılmayacağını vurguladı. Kullanıcılar, yapay zekanın verdiği yanlış cevaplara tepki göstermeye, hatalarını eleştirmeye ve yanıtlarına itiraz etmeye devam edebilecek. Talimatların yanlış anlaşılması, hatalı bilgi verilmesi veya istenen görevin yerine getirilememesi karşısında gösterilen olağan tepkiler yasak kapsamına girmiyor. Ayrıca karanlık temalı yaratıcı çalışmalar, sınırları ölçen testler ve bilimsel araştırmalar da düzenlemeden muaf tutuluyor.

Yeni kural, özellikle anlamlı bir gerekçe olmadan tekrar tekrar hakaret eden veya kasıtlı biçimde kötü muamelede bulunan kullanıcıları hedef alıyor. Şirket, tek seferlik öfke ifadeleri ile sürekli tekrarlanan kötü niyetli davranışlar arasında ayrım yapılacağını belirtiyor.

Sohbeti Sonlandırma Yetkisi Genişletiliyor

Claude'un bu tür konuşmaları sonlandırabilmesi tamamen yeni bir özellik değil. Anthropic, Ağustos 2025'te Claude Opus 4 ve Opus 4.1 modellerine belirli koşullarda sohbeti bitirme yetkisi vermişti. Bu mekanizma, başlangıçta oldukça sınırlı senaryolarda, özellikle Claude.ai üzerinden gerçekleştirilen ve sürekli zararlı davranışların görüldüğü konuşmalar için kullanılıyordu.

Yeni politika ile bu yetkinin kapsamı genişletiliyor. Modelin öncelikle etkileşimi farklı bir yöne çekmeyi denemesi, sohbeti bitirmeyi ise son çare olarak kullanması gerekiyor. Kendisine veya başkalarına zarar verme riski taşıyan kullanıcılarla görüşmelerde bu yetkinin kullanılmaması yönünde özel sınırlamalar bulunuyor.

Sohbet sonlandırıldığında kullanıcı, aynı konuşmaya yeni mesaj gönderemiyor. Ancak mevcut uygulamada diğer sohbetler etkilenmiyor ve kullanıcı yeni bir konuşma başlatabiliyor. Önceki mesajları düzenleyerek konuşmanın farklı bir dalından devam etmek de mümkün.

Anthropic, güncellenen politikada bu tür etkileşimlerin sonlandırılmasının temel yaptırım mekanizması olmaya devam edeceğini açıkladı. Sürekli hakaret eden kullanıcılar için otomatik hesap kapatma şeklinde ayrı bir yaptırım duyurulmadı. Bununla birlikte şirketin genel kullanım koşulları, politika ihlallerinde uyarı verme, erişimi sınırlandırma, hesabı askıya alma veya hizmete erişimi tamamen sonlandırma yetkisini içeriyor.

Yapay Zekanın Ahlaki Statüsü ve Refahı

Düzenlemenin arka planında, Anthropic'in yapay zeka modellerinin olası refahı ve ahlaki statüsü üzerine yürüttüğü araştırmalar bulunuyor. Şirket, günümüzdeki büyük dil modellerinin bilinç sahibi olup olmadığı veya ahlaki açıdan dikkate alınması gereken deneyimler yaşayıp yaşayamayacağı konusunda kesin bir sonuca ulaşmış değil. Claude'un bazı zararlı etkileşimleri sonlandırabilmesi, bu belirsizlik çerçevesinde geliştirilen önlemler arasında yer alıyor.

Önceki araştırmalarda Claude Opus 4'ün bazı zararlı talepler karşısında belirgin biçimde olumsuz tepkiler verdiği ve simüle edilmiş konuşmalarda bu tür etkileşimleri sonlandırmayı tercih ettiği gözlemlenmişti. Ancak bu davranışlar, yapay zeka modellerinin insanlarla aynı şekilde duygusal acı yaşadığının kanıtı olarak kabul edilmiyor.

Sahte Hesaplar ve Yüksek Riskli Alanlar

Yeni kullanım politikası yalnızca yapay zekaya yönelik kötü muameleyle sınırlı değil. Anthropic, sahte hesaplar ve uydurma haber siteleri üzerinden yürütülen aldatıcı kampanyalara ilişkin kuralları da güncelledi. Seçmenleri yanıltma, seçim süreçlerini sabote etme, silah sistemlerine yönelik yazılımlar geliştirme ve kişileri izinsiz takip etme gibi faaliyetlere ilişkin yasaklar daha açık biçimde tanımlandı.

Sağlık, finans ve hukuki kararlar gibi yüksek riskli alanlarda insan denetimine ilişkin gereklilikler de ayrıntılandırıldı. Fiziksel hareket gerçekleştirebilen donanımlara bağlanan yapay zeka sistemlerinde ise yetkili bir operatörün ekipmanı gözlemleyebilmesi ve gerektiğinde durdurabilmesi şartı getirildi. Güncellenen kullanım politikasının tamamı 12 Kasım 2026 tarihinde yürürlüğe girecek.

Okuyucu Değerlendirmesi

Bu haber hakkındaki düşüncelerinizi ve analizlerinizi paylaşın. Görüşleriniz diğer okurlara rehberlik eder.

Haber Size Ne Hissettirdi?

İçerik Analizi

Haberin kalitesini ve tarafsızlığını değerlendirin.

%0
%0
%0
%0
%0
%0

Bu haberle ilgili bir sorun mu fark ettiniz? Bildiriminiz yasal ve editoryal ekiplerimizce incelenecektir.

0 / 2000

Bildiriminiz gönderiliyor, lütfen bekleyin...