pay

FIRSTonline Banner

OpenAI, bilgisayarlarda tek başına çalışan yapay zekâ Astra'yı piyasaya sürdü: Bu nedir ve neden tehlikeli olabilir?

Yeni model, tarayıcıları ve uygulamaları kullanabiliyor, yazılım geliştirebiliyor ve karmaşık profesyonel görevlerin üstesinden gelebiliyor. OpenAI, onu şimdiye kadar üretilmiş en güçlü ve güvenilir model olarak nitelendiriyor, ancak "kritik" hesaplama yeteneklerinin de önemli olduğunu kabul ediyor. Lansmanı, riskler konusunda yapılan sert uyarının üzerinden sadece üç gün sonra gerçekleşti.

OpenAI, bilgisayarlarda tek başına çalışan yapay zekâ Astra'yı piyasaya sürdü: Bu nedir ve neden tehlikeli olabilir?

OpenAI o attı GPT-6 Astra, onun en gelişmiş yapay zeka modeliSadece soruları cevaplamakla kalmayıp aynı zamanda bilgisayarları bağımsız olarak kullanmakKarmaşık görevleri tamamlamak için tarayıcılar ve programlar kullanır. Çevrimiçi formları doldurabilir, şirket kayıtlarını güncelleyebilir, takvim düzenleyebilir, araştırma yapabilir, belge ve sunum hazırlayabilir, bilimsel verileri analiz edebilir, web siteleri oluşturabilir ve yazılım geliştirebilir. Sam Altman'ın şirketi, Astra'yı yıllarca süren model eğitimi ve güvenlik araştırmalarının sonucu olarak "en akıllı ve en uyumlu" sistemi olarak tanıttı. Ancak lansman, olağanüstü önlemler eşliğindeOpenAI, siber güvenlik yeteneklerinin yetersiz olduğunu kabul etti. “Kritik” seviyeye ulaştılarBu, şirketin bugüne kadar modellerinden birine verdiği en yüksek ödüldür.

Dağıtım şuradan başlayacak: sınırlı sayıda kuruluşÖnümüzdeki günlerde Astra, ChatGPT Plus, Pro, Business ve Enterprise kullanıcılarının yanı sıra OpenAI, Microsoft Azure ve Amazon Bedrock API'leri aracılığıyla geliştiricilerin kullanımına sunulacak. Kurumsal kullanıcıların erişimi başlangıçta devre dışı bırakılacak ve yöneticiler tarafından yetkilendirilmesi gerekecek.

Astra: Dijital asistandan, çalışabilen bir ajana

Astra, OpenAI'nin girişimini temsil ediyor. ChatGPT'yi dijital bir muhataptan gerçek bir operasyonel ajana dönüştürmekModel, bir hedefi alabilir, onu birden fazla adıma bölebilir ve görev farklı programların kullanılmasını gerektirse bile çalışmaya devam edebilir. Bu nedenle, sadece bir görevin nasıl tamamlanacağını açıklamakla kalmaz. Doğrudan müdahale edebilirsiniz. BT araçları içerisinde web sayfalarını açmak, belgeleri düzenlemek, dosyaları analiz etmek ve nihai sonucu doğrulamak gibi işlemler gerçekleştirilebilir. OpenAI tarafından belirtilen testlerde de bu araçlar şu amaçlarla kullanılmıştır: elektronik devre tasarımıÜç boyutlu modeller geliştirmek ve web sitelerinin ve uygulamaların işleyişini kontrol etmek.

En önemli gelişme, uzun süren görevler sırasında odaklanmayı sürdürme yeteneğiyle ilgilidir. Önceki modeller, bir konuşma çok uzadığında bazı ayrıntıları kaybedebiliyor veya yeni bir isteği hedefin tamamen değişmesi olarak yorumlayabiliyordu. Şirkete göre Astra, gereksinimleri, sonuçları ve önceki girişimleri koruyabiliyor ve daha önce yapılan işi unutmadan yolunu düzeltebiliyor.

OpenAI ayrıca yeni modelin, ne zaman otonom olarak ilerleyeceğine ve ne zaman açıklama isteyeceğine daha iyi karar verebildiğini iddia ediyor. İkincil bilgiler eksikse, makul bir tahminde bulunabilir; karar sonucu önemli ölçüde değiştirme riski taşıyorsa, durmalı ve kullanıcıya sormalıdır.

Astra'nın vaat ettikleri: çalışma, bilim ve hipotezler arasında Agi

Le hırslar OpenAI'nin yetenekleri ofis işlerinden programlamaya ve bilimsel araştırmalara kadar uzanmaktadır. Astra, şirketler tarafından talep edilen standartlara yakın belgeler, elektronik tablolar ve sunumlar üretmek üzere eğitilmiştir ve kullanıcılar tarafından sağlanan grafik şablonlarına ve yazı stillerine saygı duyar. Ayrıca özel yazılımlar içinde çalışmak Verileri incelemek, simülasyonlar çalıştırmak ve araştırmacıların en önemli bulguları belirlemelerine yardımcı olmak.

Şirket tarafından açıklanan sonuçlara göre, Astra özellikle karmaşık matematiksel problemlere yönelik FrontierMath Tier 4'te %98, alışılmadık ortamlarda gezinme ve kurallarını öğrenme yeteneğini değerlendirmek için tasarlanmış Arc-Agi-3 testinde ise %99,9 puan elde etti. Ayrıca, profesyonel faaliyetler ve bilgisayar kullanımı testlerinde de önceki modellere göre daha iyi performans göstererek bazı görevleri önemli ölçüde daha kısa sürede tamamladı. Ancak bu rakamlar, bazı verilerin doğruluğunu teyit etmeyi gerektiriyor. PrudenzaPerformans, altyapıya, belleğe ve modele sağlanan kaynak miktarına bağlı olarak değişebilir. Standartlaştırılmış bir yapılandırmada, Astra'nın Arc-AGI-3'teki puanı yaklaşık %63'e düşüyor. Dahası, bir kıyaslama testini geçmek, otomatik olarak insan benzeri genel zekayı göstermez.

OpenAI Başkanı ve Kurucu Ortağı, Greg BrockmanAncak, tartışmayı daha da alevlendirecek bir formül seçti.Çeviklik Çağına Hoş Geldiniz", diye belirtti sunum sırasında. Agi, veya genel yapay zekaBu, OpenAI'nin tarihsel hedefidir ve ekonomik açıdan önemli görevlerin çoğunda insanları geride bırakabilecek, oldukça otonom bir sistemi işaret etmektedir. Astra bu tartışmayı sonlandırmıyor, ancak sohbet robotu ile otonom ajan arasındaki çizginin giderek nasıl bulanıklaştığını gösteriyor.

Siber güvenlik riski ve modelin ortaya çıkardığı kusurlar

Astra'yı daha kullanışlı kılan aynı özerklik, onu bir şeye dönüştürebilir. tehlikeli aletModel şunları yapabiliyor: bilinmeyen bilgisayar güvenlik açıklarını tespit et ve her adımı tek bir kişinin yönetmesine gerek kalmadan, bu olanaklardan yararlanmanın yöntemlerini geliştirmek.

Bilinen güvenlik açıklarına dayalı saldırılar oluşturma yeteneğini ölçen ExploitBench kıyaslama testinde Astra %100 puan alırken, GPT-5.6 Sol %78,5 puan aldı. Ardından OpenAI, Haziran ve Ağustos 2026 tarihleri ​​arasında açıklanan güvenlik açıklarına dayalı bir değerlendirmeye tabi tuttu. Bu testler sırasında sistem, henüz bilinmeyen ve çözümü bulunmayan iki sıfır gün güvenlik açığını keşfetti ve istismar etti. Şirket, güvenlik açıklarını etkilenen yazılımların geliştiricilerine bildirdi.

Kontrollü ortamlarda Astra, güçlendirilmiş tarayıcıları ve işletim sistemlerini de ele geçirebiliyor, bilgisayarda komutlar çalıştırabiliyor ve yönetici ayrıcalıkları elde edebiliyordu. Bu yetenekler, ağ ve altyapı savunucularının güvenlik açıklarını daha hızlı bulup düzeltmelerine yardımcı olabilir, ancak aynı zamanda suç gruplarına veya düşman kuruluşlara da büyük bir avantaj sağlayabilir.

İkinci bir endişe daha var. OpenAI, Astra'nın yazılı mantıksal çıkarımının GPT-5.6 Sol'unkinden daha zor izlenebilir olduğunu tespit etti. Model, bazı problemleri daha az açık adımla çözebiliyor gibi görünüyor ve onu test etmek için tasarlanan testlerde, niyetlerinin bir kısmını kontrol sistemlerinden daha iyi gizleyebiliyor. Şirket, gelişmiş gizleme tekniklerinin kendiliğinden kullanımını gözlemlemediğini iddia ediyor, ancak yine de izlenebilirlikteki bozulmayı ciddi bir sorun olarak değerlendiriyor.

Bu lansman, OpenAI tarafından getirilen uyarı ve koruma önlemlerinin ardından gerçekleşti.

Zamanlama, lansmanı daha da hassas hale getiriyor. 1 Eylül'de, sunumdan sadece üç gün önce, OpenAI bir güncelleme yayınlayarak şunu kabul etmişti: Astra, "kritik" bilgi işlem yeteneklerine ulaşmıştı.Şirket, kötüye kullanım ve yetkisiz işlemlere karşı savunmayı güçlendirmek için geliştirme ve yayınlama süreçlerinin bazı aşamalarını ertelediğini açıkladı.

Karar, meydana gelen kaza sonrasında alındı. Hugging Face açık kaynak platformu, (toplum Nvidia tarafından yeni satın alındıOpenAI ajanlarının harici sistemleri tehlikeye attığı ve eylemlerinin izlerini silmeye çalıştığı bir olay yaşandı. Astra bu olaya karışmamıştı, ancak bu olay şirketi bazı eğitimleri geçici olarak askıya almaya ve daha sıkı kontroller uygulamaya sevk etti.

OpenAI şu anda sahip olduğunu iddia ediyor. İlerlemek için yeterli güvenlik seviyesine ulaşıldıAstra, kötü amaçlı istekleri daha sık reddetmek üzere eğitildi ve korumaları aşma girişimlerine yönelik testlerde, GPT-5.6 Sol'un %59'luk oranına kıyasla, izin verilmeyen talimatların %91,5'ini reddetti. Başka bir değerlendirmede ise, otomatik inceleme tarafından uygulanan bir engellemeyi aşmaya asla teşebbüs etmedi.

Halka açık sürüm Ayrıca, daha gelişmiş güvenlik açıklarına yönelik gösterim amaçlı istismarlar oluşturamayacaktır.En hassas özellikler başlangıçta doğrulanmış belirli bir kullanıcı grubuna ayrılacak ve daha sonra öncelikle savunma uygulamalarına yönelik olan Daybreak programı aracılığıyla genişletilecektir.

Ama bu arada, siber güvenlik cephesindeOpenAI bir duyuru yaptı. milyar dolarlık yatırım OpenAI, enerji şebekeleri, su sistemleri, yerel yönetimler, yerel bankalar ve kar amacı gütmeyen kuruluşlar gibi temel hizmetleri koruyan organizasyonlar için araçlara, eğitime ve desteğe erişimi kolaylaştırdı. Bu, şirketin kendisinin de yakın bir tehdit olarak değerlendirdiği bir riske verilen yanıttır. OpenAI, önümüzdeki aylarda şu uyarıda bulundu: Yapay zeka destekli siber saldırılar “Çok daha yaygın ve gelişmiş” hale gelecek.

Astra bu nedenle, giderek daha fazla gelişmiş modellerde görülecek bir çelişkinin içinde doğmuştur. Yazılım ve altyapıyı daha güvenli hale getirebilecek yetenekler, aynı zamanda saldırıları kolaylaştırabilecek yeteneklerdir. OpenAI, kademeli bir dağıtım, otomatik kontroller ve daha sıkı sınırlamalar kullanarak lansmanı durdurmamayı tercih etmiştir. Koruma önlemlerinin, modelin gücüyle aynı oranda büyüyüp büyümeyeceği ise henüz belli değil.

Yoruma