EN ▸ A New Trick Reveals AI Models’ Inner Thoughts

Yapay Zeka Modellerinin Gizli Düşünceleri Ortaya Çıktı

WIRED ·

Yapay Zeka Modellerinin Gizli Düşünceleri Ortaya Çıktı
Görsel: haberin kaynağından alınmıştır.

Bilgisayar bilimcileri, ileri düzey yapay zeka modellerinin karmaşık problemleri çözerken gizli 'düşüncelerini' ortaya çıkarmanın bir yolunu keşfetti. Araştırmalar, bazı Çin modellerinin, ABD modellerinden gizli akıl yürütme bilgilerini 'damıtarak' eğitilmiş olabileceğine dair kanıtlar sunuyor. Bu durum, kişisel bilgilerin sızmasına yol açabilecek bir zafiyet oluşturuyor. Araştırmacılar, OpenAI, Anthropic ve Google gibi büyük model sağlayıcılarının bu zafiyeti paylaştığını belirtiyor. Ayrıca, bu yöntemle, kullanıcıların bilgisayarlarından elde edilen akıl yürütme izlerinin gizli bilgileri açığa çıkarabileceği gösterildi. Ancak, bu zafiyetin giderildiği ifade ediliyor.