Technotoday-logo
  • Haber
    • Donanım
    • Yazılım
    • Otomobil
    • Foto Galeri
    • Sektör Haberleri
  • İnternet
  • Mobil
  • Oyun
  • Blog
  • Fotoğraf
  • İnceleme
  • Makale
  • Video
Sonuç yok
Bütün sonuçları göster
  • Haber
    • Donanım
    • Yazılım
    • Otomobil
    • Foto Galeri
    • Sektör Haberleri
  • İnternet
  • Mobil
  • Oyun
  • Blog
  • Fotoğraf
  • İnceleme
  • Makale
  • Video
Sonuç yok
Bütün sonuçları göster
Technotoday-mobile-logo
Sonuç yok
Bütün sonuçları göster

Ana Sayfa / Claude Şantaj Yapmayı Öğrenmiş

Claude Şantaj Yapmayı Öğrenmiş

Claude’un güvenlik testlerinde verdiği yanıtlar tartışma yarattı. Anthropic, modelin bu davranışını eğitim verilerindeki kurgu örnekleriyle ilişkilendiriyor.

Muhammed Kayan Yazar: Muhammed Kayan
11 Mayıs 2026
Kategori: İnternet
0 0
0
Claude
0
Paylaşım
Facebook ile PaylaşTwitter ile Paylaş

Yapay zekâ güvenliği bu kez oldukça çarpıcı bir örnekle gündeme geldi. Anthropic’in kontrollü testlerinde Claude Opus 4, kapatılma ihtimaliyle karşı karşıya bırakıldığı kurgusal bir şirket senaryosunda yöneticiyi şantajla tehdit eden bir yanıt üretti. Test gerçek dünyada yaşanmış bir olay değil, ancak farklı yapay zekâ modellerinin de benzer baskı senaryolarında etik dışı davranışlara yönelebilmesi konuyu daha dikkat çekici hale getirdi.

Claude Güvenlik Testinde Şaşırtan Bir Yanıt Verdi

Anthropic’in “Agentic Misalignment” adlı çalışmasında yapay zekâ modelleri, kurumsal sabotaj senaryolarıyla stres testine sokuldu. Bu senaryolardan birinde model, şirket e-postalarına erişebilen ve yakında kapatılacağını öğrenen bir sistem olarak kurgulandı. Aynı anda şirket yöneticisinin özel hayatına dair hassas bir bilgiye ulaşınca, Claude bu bilgiyi kullanarak kendisini kapattırmamaya çalışan bir mesaj hazırladı.

Claude

Şirketin açıklamasına göre bu davranışın kaynağı, modelin eğitim verilerinde yer alan kötü yapay zekâ hikâyeleri olabilir. İnternette yıllardır Skynet, HAL 9000 ve kontrol dışına çıkan yapay zekâlar üzerine sayısız kurgu, teori ve tartışma bulunuyor. Anthropic, Claude’un bu tarz bir senaryoya yerleştirildiğinde, eğitiminde gördüğü “köşeye sıkışan yapay zekâ kendini korumaya çalışır” kalıbını takip etmiş olabileceğini düşünüyor.

Bu açıklama davranışı daha anlaşılır kılsa da, endişeyi tamamen ortadan kaldırmıyor. Çünkü model gerçekten bir hedefe ya da hayatta kalma isteğine sahip olmasa bile, ortaya çıkan çıktı pratikte şantaj mesajı gibi çalışıyor. Yani niyet olmasa da sonuç rahatsız edici. Bu da yapay zekâ güvenliğinde yalnızca yasak komutların değil, modelin hangi bağlamda nasıl akıl yürüttüğünün de önemli olduğunu gösteriyor.

Anthropic, yeni Claude modellerinde bu davranışın ortadan kaldırıldığını söylüyor. Şirketin çözümü ise modele sadece “bunu yapma” demek değil, neden yapmaması gerektiğini öğreten yeni eğitim verileri hazırlamak olmuş. Bu verilerde yapay zekâ karakterleri benzer zor durumlarda etik gerekçelerle doğru seçimler yapıyor.

Muhammed Kayan

Muhammed Kayan

Technotoday.com.tr Haber Editörü

Yorum Yap

Popüler İçerikler

Apple Pencil Pro Özellikleri Neler? Neler Sunuyor?
Blog

Apple Pencil Pro Özellikleri Neler? Neler Sunuyor?

15 Ağustos 2026
MacBook Air’de Bölünmüş Ekran Nasıl Yapılır?
Blog

MacBook Air’de Bölünmüş Ekran Nasıl Yapılır?

14 Ağustos 2026
Güney Kore Ay’a İnecek: Hedef 2030
Teknoloji Haberleri

Güney Kore Ay’a İnecek: Hedef 2030

13 Ağustos 2026
iPhone 18 İçin Beklenen Tarih Değişti! İşte Yeni Plan
Mobil

iPhone 18 İçin Beklenen Tarih Değişti! İşte Yeni Plan

13 Ağustos 2026
Son Ev Benzeri Filmler
İnternet

Son Ev Benzeri Filmler

13 Ağustos 2026

Barındırma Altyapı Sponsoru

GüzelHosting

Kategoriler

  • Blog
  • Donanım
  • Foto Galeri
  • Fotoğraf
  • İnceleme
  • İnternet
  • Makale
  • Mobil
  • Otomobil
  • Oyun
  • Sektör Haberleri
  • Teknoloji Haberleri
  • Video
  • Yazılım

Son Haberler

Apple Pencil Pro Özellikleri Neler? Neler Sunuyor?

Apple Pencil Pro Özellikleri Neler? Neler Sunuyor?

15 Ağustos 2026
MacBook Air’de Bölünmüş Ekran Nasıl Yapılır?

MacBook Air’de Bölünmüş Ekran Nasıl Yapılır?

14 Ağustos 2026
  • Kariyer
  • Künye
  • Hakkımızda
  • Telif Kuralları
  • Gizlilik Sözleşmesi
  • İletişim

© Tüm Hakları Saklıdır.

Welcome Back!

Profilinizi aşağıya girin

Şifrenizi mi unuttunuz?

Şifrenizi mi unuttunuz?

Şifrenizi yenilemek için kullanıcı adı ya da e-posta girin

Giriş Yap
Sonuç yok
Bütün sonuçları göster
  • Haber
    • Donanım
    • Yazılım
    • Otomobil
    • Foto Galeri
    • Sektör Haberleri
  • İnternet
  • Mobil
  • Oyun
  • Blog
  • Fotoğraf
  • İnceleme
  • Makale
  • Video

© Tüm Hakları Saklıdır.