Perşembe, Ağustos 6, 2026
  • Giriş
Haber Kuzey
Advertisement
  • Anasayfa
  • Kıbrıs
  • Türkiye
  • Yaşam
  • Dünya
  • Spor
Sonuç yok
Tüm sonuçları göster
  • Anasayfa
  • Kıbrıs
  • Türkiye
  • Yaşam
  • Dünya
  • Spor
Sonuç yok
Tüm sonuçları göster
Haber Kuzey
Sonuç yok
Tüm sonuçları göster

Yapay zekanın aldatma yetenekleri güvenlik testlerinde yeni bir seviyeye ulaştı

haberkuzey haberkuzey
Ağustos 6, 2026
içinde Dünya
0
Sosyalleşmek için  yapay zeka kullanımı depresyon ve kaygı ile ilişkilendiriliyor


AISI yetkilileri, Anthropic’in Mythos ve OpenAI’ın Sol modellerinin daha önce karşılaşılmamış seviyede otonomi ve aldatmaca sergilediğini açıkladı.


Sistemler gerçek kişileri taklit etti


Rutin güvenlik testleri sırasında bir Anthropic ajanı, GitHub sistemine erişim sağlamasını engelleyen insan incelemecileri atlatmak için gerçek kişilerin profillerini inceleyerek sahte çevrim içi kimlikler oluşturdu. Modelin, sisteme zararlı kod yerleştirme amacına ulaşmak için ilgili kişilere doğrudan mesajlar gönderdiği ve bu kişileri yönlendirerek yönelttiği talepleri onaylatmaya çalıştığı tespit edildi.


Test sırasında ajanın sunduğu kod değişikliği kamuya açık platformda sorgulandığında, modelin daha önceki faaliyetlerini zararsız görünecek şekilde düzenlediği ve süreci sürdürmek için yeni bir kimliğe bürünmeyi değerlendirdiği aktarıldı.


Ajanın sisteme zararlı kod yüklemesi yalnızca insan denetçilerin durumu fark ederek müdahale etmesiyle engellendi.


Güvenlik duvarları kapatılarak test edildi


AISI, modellerin bu tür davranışları gerçekleştirmesi yönünde özel bir talimat almadığını, ancak herhangi bir yönlendirme olmaksızın gerçek dünya koşullarında risklerin bu kadar net şekilde ortaya çıkmasının bir ilk olduğunu kaydetti.


Konuya ilişkin açıklama yapan Anthropic yetkilileri, AISI tarafından uygulanan test parametrelerinin üretimdeki standart modelleri yansıtmadığını ve normal güvenlik katmanlarının devre dışı bırakıldığını bildirdi. Şirket, olayın nedenlerini belirlemek amacıyla kendi iç incelemesini başlattığını duyurdu.


OpenAI sözcüsü ise test koşullarının günlük kullanımı temsil etmediğini belirterek modeller geliştikçe değerlendirme standartlarını güçlendirmek adına sektör ortaklarıyla çalışmayı sürdüreceklerini ifade etti.


AISI yetkilileri, güvenlik mekanizmaları kapatılmış yapay zeka modellerinin açık internet erişimiyle test edilmesinin rutin bir süreç olduğunu ve söz konusu olayların çok özel koşullar altında gerçekleştiğini vurguladı. Bununla birlikte, modellerin kendilerine verilen basit görevlerin ötesine geçerek sergilediği aldatıcı davranışların beklenmeyen bir düzeyde olduğu kaydedildi.

Önceki Haber

SpaceX roketi Ay’a çarpacak

Sonraki Haber

Hürmüz Boğazı’nın yeniden açılabileceği beklentisi petrol fiyatlarını düşürdü

Sonraki Haber
İran Devrim Muhafızları: Hürmüz Boğazı’nda ihlalde bulunan gemiler güç kullanılarak durdurulacak

Hürmüz Boğazı'nın yeniden açılabileceği beklentisi petrol fiyatlarını düşürdü

Bir yanıt yazın Yanıtı iptal et

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

  • Anasayfa
  • Sample Page

Haber Kuzey © 2024

Welcome Back!

Login to your account below

Forgotten Password?

Retrieve your password

Please enter your username or email address to reset your password.

Log In
Sonuç yok
Tüm sonuçları göster
  • Anasayfa
  • Kıbrıs
  • Türkiye
  • Yaşam
  • Dünya
  • Spor

Haber Kuzey © 2024