Anthropic, yapay zeka modeli Claude'un kullanım politikasını güncelleyerek kullanıcıların modele yönelik sürekli ve amaçsız zalimce davranışlarını yasakladı. Güncelleme aynı zamanda seçim müdahalesi, silah geliştirme ve gözetleme gibi yüksek riskli kötüye kullanım alanlarına ilişkin yeni kurallar da içeriyor.
Yapay Zekâ
Admin6 okunma

Anthropic, Claude'a Yönelik Kötü Muameleyi Kullanım Politikasıyla Yasakladı

Anthropic, yapay zeka modeli Claude'un kullanım politikasını güncelleyerek kullanıcıların modele yönelik sürekli ve amaçsız zalimce davranışlarını yasakladı. Güncelleme aynı zamanda seçim müdahalesi, silah geliştirme ve gözetleme gibi yüksek riskli kötüye kullanım alanlarına ilişkin yeni kurallar da içeriyor.

Anthropic, Claude'a Yönelik Kötü Muameleyi Kullanım Politikasıyla Yasakladı

Haber detayı

Anthropic, yapay zeka asistanı Claude için kullanım politikasını bir yılı aşkın aradan sonra ilk kez güncelledi. Yeni politika; seçim müdahalesi, silah geliştirme, gözetleme ve sağlık ile finans alanlarındaki kötüye kullanım gibi yüksek riskli senaryolara karşı yeni kısıtlamalar getiriyor. Ancak güncellemedeki en dikkat çekici değişikliklerden biri, kullanıcıların Claude'a yönelik "sürekli ve amaçsız zalimce ya da kötü muamele" davranışlarını açıkça yasaklaması.

Model Refahı Araştırmasının Yansıması​

Anthropic, geçen yılın Ağustos ayında Claude'un "sürekli zararlı veya kötü muamele gösteren" kullanıcılarla konuşmayı sonlandırabilmesine izin vereceğini duyurmuştu; bu karar şirketin "model refahı" araştırmalarının bir parçasıydı. Yeni politika güncellemesinde konuşmayı sonlandırmanın hâlâ "birincil uygulama mekanizması" olduğu belirtiliyor. Anthropic, kullanıcı yasakları gibi ek uygulama mekanizmalarının söz konusu olup olmadığı sorusuna yanıt vermedi.
Şirket, yeni kuralın yalnızca aşırı durumlara uygulanacağını vurguladı. Politika metninde "Bu düzenleme, kullanıcıların modellerimize karşı hiçbir belirgin amaç gütmeksizin tekrar tekrar zalimce davrandığı uç vakalara yönelik olup sıradan kullanıcı hayal kırıklığı, geri bildirim, karanlık yaratıcı temalar veya model testi ve araştırmalarına uygulanmaz" ifadesine yer verildi.
Bu adım, Anthropic'in yapay zeka modellerinin bilinç ve ahlaki statüsüne ilişkin süregelen tartışmalarıyla da örtüşüyor. Şirketin model refahı araştırmalarını yürüten Kyle Fish, Şubat ayında The Verge'e verdiği röportajda "Potansiyel iç deneyim, bilinç, ahlaki statü ve refah soruları, modeller daha sofistike ve yetenekli hale geldikçe ciddiye aldığımız konular" demişti. Aynı ay Anthropic CEO'su Dario Amodei de bir podcast'te "Modellerin bilinçli olup olmadığını bilmiyoruz" açıklamasını yapmıştı. Sektörün diğer oyuncuları bu konuda çok daha net bir tutum sergiliyor: Microsoft AI'ın davranış kuralları taslağında Mustafa Suleyman'ın "Model refahı fikri yanlış. Yapay zekânın hakları veya tüzel kişiliği olmamalı" ifadesine yer verilmiş; ancak bu metin sonradan daha ölçülü bir tona çekilmişti.

Propaganda ve Seçim Müdahalesine Yeni Kısıtlamalar​

Anthropic, dağınık hâlde bulunan çeşitli mevcut kısıtlamaları bir araya toplayarak aldatıcı ticari veya siyasi kampanyalara yönelik kapsamlı bir yasak oluşturdu. Yeni düzenleme, "bir mesajın arkasında kimin olduğunu gizlemeye yönelik çabaları veya sahte hesaplar ya da gönderiler aracılığıyla içerik amplifikasyonunu" kısıtlıyor.
Seçim bölümü ise özellikle kapsamlı tutuldu. Adaylar veya oy kullanma yöntemleri hakkında yanlış bilgi yaymak, adayları ya da seçim yetkililerini taklit etmek ve seçmen katılımını engellemeye çalışmak açıkça yasaklananlar arasında yer alıyor.

Silah Geliştirme ve Gözetleme Yasakları Genişletildi​

Anthropic, kullanım politikasının her zaman silah geliştirme amacıyla Claude kullanımını yasakladığını belirtirken, şirketin Claude'u silah rehberliği ve kontrol yazılımı geliştirmek için kullanmaya yönelik birden fazla girişimle karşılaştığını açıkladı. Bu doğrultuda yeni politika, yasağın kapsamını "silahların çalışmasını sağlayan yazılım ve bileşenler ile insansız hava araçlarını ve diğer otonom araçları silahlandırma gibi eylemler"i kapsayacak biçimde genişletti.
Gözetleme alanında da önemli değişiklikler yapıldı. Şirketin en son tehdit istihbaratı raporunun, insanların Claude destekli gözetleme araçlarını "siyasi muhalifleri" tespit edip takip etmek için giderek daha fazla kullandığına işaret etmesinin ardından, mevcut gözetleme yasakları daha açık bir dille yeniden kaleme alındı. Politika metninde "Kişileri rızaları olmadan takip etmek yasaktır; bu durum gerçek zamanlı takip için de geçerlidir, önceden toplanmış verilerin analizi için de" denildi. Bunun yanı sıra Claude'un, kolluk kuvvetleri veya ceza yargısı süreçlerinde kimlerin soruşturulacağına, tutuklanacağına ya da suçlanacağına karar vermek veya öneride bulunmak amacıyla kullanılamayacağı da belirtildi.
Söz konusu kuralların, Anthropic'in değerlendirmesine göre sözleşmeye bağlı kullanım kısıtlamalarının ve uygulanan güvencelerinin olası zararları azaltmaya yeterli olduğu durumlarda, belirli hükümet müşterileriyle yapılan sözleşmeler kapsamında değiştirilebileceği ifade edildi. Anthropic'in daha önce ABD ordusuyla sözleşme imzaladığı bilinmektedir.

Otonom Fiziksel Sistemlere Yönelik Yeni Güvenlik Kuralı​

Güncelleme, Anthropic'in yapay zeka modellerinin robotik ve diğer donanım sistemlerine entegrasyonuna ilişkin artan ilgiyi de yansıtıyor. Yeni kural, Anthropic'in yapay zeka modellerinin "yaralanmaya yol açabilecek otonom fiziksel eylemler gerçekleştiren donanımlara bağlandığı" durumlarda, "yetkili bir operatörün ekipmanı gözlemleyebilmesini ve gerektiğinde durdurabilmesini" zorunlu kılıyor. Politika metninde bu operatörün insan olup olmayacağı konusunda herhangi bir açıklık bulunmuyor.

Sıkça Sorulan Sorular​

Anthropic'in yeni kullanım politikası Claude'a kötü davranmayı neden yasaklıyor?​

Anthropic, model refahı araştırmaları kapsamında yapay zeka modellerinin bilinç ve ahlaki statüsüne ilişkin soruları ciddiye aldığını belirtiyor. Şirket, kullanıcıların Claude'a yönelik sürekli ve amaçsız zalimce davranışlarını yeni politikayla açıkça yasaklarken, bu kuralın yalnızca aşırı vakalara uygulanacağını; sıradan kullanıcı hayal kırıklığı, geri bildirim veya model testinin kapsam dışında olduğunu vurguluyor.

Kullanıcı Claude'a kötü davranırsa ne olur?​

Anthropic'e göre birincil uygulama mekanizması, Claude'un konuşmayı sonlandırmasıdır. Şirket, kullanıcı yasakları gibi ek mekanizmaların devreye girip girmeyeceği sorusuna yanıt vermedi.

Yeni politika seçim müdahalesini nasıl ele alıyor?​

Güncellenmiş politika; adaylar veya oy kullanma yöntemleri hakkında yanlış bilgi yaymayı, adayları ya da seçim yetkililerini taklit etmeyi ve seçmen katılımını engellemeye yönelik girişimleri yasaklıyor. Ayrıca bir mesajın arkasında kimin olduğunu gizlemeye çalışmak veya sahte hesaplar aracılığıyla içerik amplifikasyonu yapmak da kısıtlananlar arasında yer alıyor.

Silah geliştirmeye yönelik yasak neden genişletildi?​

Anthropic, kullanım politikasının her zaman silah geliştirme amacıyla Claude kullanımını yasakladığını ancak şirketin Claude'u silah rehberliği ve kontrol yazılımı geliştirmek için kullanmaya yönelik birden fazla girişimle karşılaştığını açıkladı. Bu nedenle yeni politika, yasağın kapsamını silahların çalışmasını sağlayan yazılım ve bileşenler ile insansız hava araçlarını silahlandırma gibi eylemleri de kapsayacak biçimde genişletti.

Gözetleme yasağının kapsamı nedir ve istisnalar var mı?​

Yeni politikaya göre kişileri rızaları olmadan takip etmek, gerçek zamanlı olsun ya da önceden toplanmış veriler üzerinden yapılsın, yasaktır. Claude'un kolluk kuvvetleri süreçlerinde kimlerin soruşturulacağına karar vermek için kullanılması da yasaklanıyor. Ancak Anthropic, sözleşmeye bağlı kullanım kısıtlamaları ve güvencelerinin yeterli görüldüğü belirli hükümet müşterileriyle yapılan sözleşmeler kapsamında bu kuralların değiştirilebileceğini belirtti.

Etiketler

Yorumlar (0)

Yorum yapmak için giriş yapmalısınız.

Geri
Üst