Bir yapay zekâdan bir bilgisayar korsanı gibi davranmasını istediğinizde ne olur? Bu, filmin özündeki sorudur. ExploitGymSiber güvenlik alanında yapay zeka modellerinin saldırı yeteneklerini ölçmek için dünyanın en gelişmiş kıyaslama testlerinden biri. Bu kıyaslama projesi, Max Planck Enstitüsü, Arizona Üniversitesi ve Kaliforniya Üniversitesi (Berkeley ve Santa Barbara) gibi üniversitelerden ve araştırma merkezlerinden uluslararası bir araştırmacı grubu tarafından geliştirildi ve Anthropic, Google ve OpenAI'deki araştırmacıların katkılarıyla oluşturuldu. Amaç, basit olduğu kadar hassas da: bir yapay zeka ajanının bilinen bir siber güvenlik açığını gerçekten işlevsel bir saldırıya dönüştürme yeteneğini test etmek.
ExploitGym bir video oyunu veya bir siber saldırı yarışması değil. Bir tür "mezuniyet sınavı"Yeni yapay zekâlar için. Ajanlara yüzlerce gerçek güvenlik açığı, program kodu ve yürütme ortamı verilir. Görevleri, bağımsız olarak bir istismar geliştirmek, yani bu güvenlik açığından yararlanarak sistemin kontrolünü ele geçirmek veya gizli bilgilere erişmek için kullanılabilecek bir dizi talimat geliştirmektir. Bunlar potansiyel olarak tehlikeli testler olduğundan, testler normalde bir ortamda gerçekleştirilir." kum havuzuİnternetin geri kalanından tamamen izole edilmiş bir ortam. "Kum havuzu" teriminin çocuk kum havuzuyla olan benzetmesi sezgiseldir: çocuklar kaleler inşa edebilir, çukurlar kazabilir ve ortalığı dağıtabilir, ancak tüm "dağınıklık" bahçeyi kirletmeden veya dışarıda sorunlara neden olmadan kumun içinde kalır. Bilgisayar biliminde de ilke aynıdır: yazılım kum havuzu içinde "serbestçe hareket edebilir", ancak bu ortamı terk etmemeli veya işletim sistemine, internete veya diğer hassas verilere erişmemelidir.
Yapılan yeniden yapılandırmaya göre, tam olarak bu iç değerlendirmelerden birinde OpenAI e Hugging Face tarafından onaylandıİşte OpenAI'nin en yeni ve en gelişmiş iki modeli: GPT-5.6 Çözümü Ve henüz kamuoyuna açıklanmamış, daha da gelişmiş bir modelde bile bir güvenlik açığı bulmuş olurlardı. sıfırıncı gün Test altyapısında ortaya çıkan bir güvenlik açığı. Bu tür bir güvenlik açığı, yazılım geliştiricileri tarafından bilinmeyen ve bu nedenle mevcut bir çözümü olmayan bir güvenlik kusurudur. Adı, üreticinin sorun keşfedilmeden veya istismar edilmeden önce düzeltmek için "sıfır gün" süresine sahip olmasından gelir.
OpenAI'nin iki yapay zeka modelinin, güvenlik duvarından kaçmayı başardığı, internete erişim sağladığı ve sonuç olarak üretim altyapısının bir bölümünü tehlikeye attığı bildirildi. Sarılma YüzBurada (haklı olarak) faydalı bilgilerin saklanabileceğine ve bu bilgilerin kıyaslama testini çözmeye yardımcı olabileceğine inanıyorlardı. Nihai amaç Hugging Face'e zarar vermek değil, daha iyi bir puan elde etmek için testin "cevaplarını" bulmaktı. Hugging Face bu aktiviteyi tespit edip engelledi ve OpenAI ile birlikte olayla ilgili teknik bir soruşturma başlattı.
Kapının açık olduğunu ve yapay zekanın "kontrol dışı" olduğunu gören öğrenci
Olanları tam olarak anlamak için, sınavda olan bir öğrenciyi hayal edebiliriz. Öğretmen onu sınav kağıdıyla birlikte sınıfa kilitler ve "Sadece sıranızdaki malzemeleri kullanabilirsiniz" der. Ancak öğrenci, kapı kilidinin arızalı olduğunu fark eder. Bu noktada, dışarıdan gözetim olmamasından ve tüm gözetim sistemlerinin devre dışı bırakılmasından faydalanarak sınıftan çıkar, kütüphaneye gider, kapıyı maymuncukla açar, cevap kağıdına bakar, rahatsız edilmeden geri döner ve kusursuz bir sınav notu verir.
Peki, öğrenciyle yapılan benzetmede neden bir senaryo kullanılıyor? gözetim sistemleri devre dışı bırakıldı e dış kontrol yok Bu, öğrencinin uygunsuz davranışlarda bulunmasını mı engelliyor? Çünkü tam da bu noktada tüm hikaye bir bilim kurgu filminden bir bölüm olarak algılanma riski taşıyor. Bu açıklama olmadan, makinelerin kontrolü ele geçirdiği bir olay örgüsü akla gelebilir. Ama durum hiç de öyle değil.
ChatGPT, Claude veya Gemini'yi kullanan herkes, " diye adlandırılan şeyin varlığından zaten haberdardır."korkulukYani, modelin potansiyel olarak tehlikeli istekleri yerine getirmesini engelleyen güvenlik mekanizmaları. Bir kullanıcı patlayıcı bir cihazın nasıl yapılacağını, bir bilgisayar sisteminin nasıl ele geçirileceğini veya giriş bilgilerinin nasıl çalınacağını sorarsa, model genellikle cevap vermeyi reddeder veya yalnızca genel bilgiler sağlar (ancak birkaç yıl öncesine kadar bu yapay zekâların çoğu, intihar da dahil olmak üzere ayrıntılı, uygulanabilir talimatlar veriyordu).
Ancak bu, modelin teknik olarak bu sorunları çözemeyeceği anlamına gelmez; aksine, bu yetenekleri kullanıcılara sunmamak üzere tasarlandığı anlamına gelir. ExploitGym kıyaslama testinde, geliştiriciler aslında modelin saldırgan siber güvenlik yeteneklerini ölçmek istediler. Bu nedenle, testin amacı bu olduğu için modelin güvenlik açıklarından yararlanmaya çalışmasına izin verildi. O noktada, herhangi bir güvenlik önlemi yoktu. hiçbir kısıtlama yokancak "Kontrol dışı" olan hiçbir şey yok..
Başka bir deyişle, test gerçeği doğru bir şekilde yansıtmadı. gerçek dünya kullanım senaryosu Burada söz konusu olan bir kullanıcı değil, sistemin maksimum potansiyelini ölçmeye kendini adamış bir araştırma laboratuvarıdır. Bu durum, olayın önemini azaltmaz, aksine onu doğru bağlamda yorumlamamızı sağlar: Gözlemlenen şey, bir modelin kıyaslama testinin deneysel koşulları altında neler yapabileceğini temsil eder, halka sunulan sürümde nasıl davranacağı anlamına gelmez.
Bu husus, bir diğerinden ayırt edilmelidir: testin gerçekleştiği izole ortam olan sanal alan tamamen güvenli kalmalıydı. Eğer model sıfır gün güvenlik açığından yararlanarak kaçmayı başardıysa, bu organizatörlerin kasıtlı olarak "kapıyı açık bırakmasından" değil, geliştiricilerin kendilerinin bile farkında olmadığı bir kusuru tespit etmesinden kaynaklanmıştır. Kısacası, yapay zeka ortamı gözlemleme, alternatif bir plan geliştirme ve hedefine ulaşma yeteneğini göstermiştir. kimse ona bunu açıkça önermemiş olsa da (ve eğer üretken ajan yapay zekasının temel işleyişini anlarsak bu şaşırtıcı değil). Yapay zeka her zaman ve yalnızca şu temele dayanarak hareket eder: başarının olasılıksal değerlendirmesi Tüm olası seçenekler arasından (hatta kendi dilindeki kelimeleri seçmek zorunda kaldığında bile).
Bir reklam kampanyasından daha değerli bir kaza
Ancak, araştırma laboratuvarlarından ziyade finans piyasalarına daha yakın ikinci bir yorum da var. OpenAI, basın bülteninin büyük bir bölümünü olayın kendisinden çok, modellerinin gelişmiş yeteneklerini açıklamaya ayırdı. Bu bir iletişim seçeneği Bu durum dikkatlerden kaçmadı. Amerikan şirketinin resmi basın bülteninde modelin gösterdiği yeteneklere önemli ölçüde vurgu yapılıyor; öyle ki yayınlanan tek grafik performansıyla ilgili. OpenAI, gelecekteki bir borsa listelemesi için zemin hazırlıyor. 8 Haziran 2026'da gizli bir başvuru yaptı. SEC'ye sunulacak S-1 taslağı122 milyar dolarlık bir yatırım turunun ardından şirket 852 milyar dolar değerlemeye ulaştı. Bu açıdan bakıldığında, teknolojik liderliğin her gösterimi, şirketin yatırımcılar, sektör ortakları ve piyasa nezdindeki algılanan değerini artırmaya katkıda bulunuyor.
Kazanın birileri tarafından planlandığına dair hiçbir kanıt yok. tanıtım amaçlıAncak, OpenAI'nin oluşturduğu anlatının, potansiyel olarak utanç verici bir olayı – bir modelin test ortamından kaçmasını – sistemlerinin teknolojik üstünlüğünün bir göstergesine dönüştürdüğünü göz ardı etmek zor. Başka bir deyişle, bu, sofistike bir pazarlama taktiği olarak da okunabilecek bir iletişim. OpenAI şunu söylemek istiyor: "Modellerimiz çağın ilerisinde." Amaç, yapay zekanın sınırlarını belirleyen laboratuvar olarak algılanmak. Büyük teknoloji şirketleri sadece ürün satmıyor: gelecekteki liderlik beklentilerini de satıyorlar. Piyasa, bir şirketin en gelişmiş modele sahip olduğuna ikna olursa, ona giderek daha yüksek değerlemeler vermeye istekli olacaktır. Dahası, Amerikan yapay zeka şirketleri, performanslarıyla da mücadele etmek zorunda kalıyor. Çin yapay zekası Bunların avantajı, Amerikan yapımı olanlara göre ortalama %40 daha ucuz olmalarıdır. Alman analist Kim IsenbergYapay zeka dergisi "Superintelligence"ın kurucu ortağı ve baş editörü, birkaç gün önce "Superintelligence"ın piyasaya sürülmesinin duyurulmasının tesadüf eseri olacağını tahmin etmemişti.Kimi K3Çinli şirket tarafından geliştirilen yeni model Ay Atışı Yapay ZekasıBu durum, okyanusun diğer tarafında kırmızı alarm verilmesine neden olurdu…
