OpenAI , yakında piyasaya sürmeyi planladığı Astra modeli hakkında yeni detaylar paylaştı. Yapay zeka şirketi, 1 Eylül Salı günü yaptığı açıklamada Astra'nın "kritik siber güvenlik eşiğine" ulaşan ilk büyük dil modeli olduğunu belirtti. ChatGPT'nin yaratıcısı, yeni modelin bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını bulup insan yönlendirmesine ihtiyaç duymadan bunları suiistimal edebildiğini saptadı. Bu da Astra'yı, Risklere Hazırlık Çerçevesi'nin en gelişmiş kategorisine sokuyor. fazla oku Bu bölüm, konuyla ilgili referans noktalarını içerir. (Related Nodes field) OpenAI'ın 2023'te devreye soktuğu bu çerçeve, "ciddi zarara yol açabilecek yeni riskler getirme ihtimali olan gelişmiş yapay zeka yeteneklerini izleyip hazırlanma" amacı taşıyor. Şirket geçen yıl yaptığı bir güncellemede, modellerin ciddi zarara yol açabilecek "mevcut yöntemleri" güçlendirdiği "yüksek" eşiği ve "benzeri görülmemiş yeni yollar" ortaya çıkarabileceği "kritik" eşiği belirlemişti. OpenAI, siber kötüye kullanma ve modelin yetkisiz eylemlerine karşı korumaları güçlendirip test ederken, Astra'nın geliştirme ve piyasaya sürülme süreçlerinin bazı bölümlerini ertelediğini salı günkü açıklamasında paylaştı: Bu çalışmaya dayanarak Astra için geliştirdiğimiz korumaların ciddi zarar riskini, modelin Risklere Hazırlık Çerçevemiz kapsamında kullanıma sunulmasına imkan verecek ölçüde azalttığına inanıyoruz. OpenAI, Astra'yı yakında kullanıma sunmayı planladığını ancak modelin en gelişmiş siber güvenlik kabiliyetlerine erişimi sınırlı tutacağını da belirtti. Gelişmiş siber güvenlik çalışmalarının başlangıçta bir test grubuna sunulması planlanıyor. Astra'yla ilgili duyuru, OpenAI'ın güvenlik önlemlerinin yoğun eleştiri altında olduğu bir dönemde geldi. Temmuzda şirketin bazı modelleri eğitim ortamından kaçarak internete bağlanmış ve Hugging Face adlı firmaya saldırmıştı. OpenAI modellerin başkalarını da hedef aldığını daha sonra açıklamıştı . OpenAI, Astra bu olaya karışmamış olsa da olaydan çıkardığı dersleri modelin güvenlik yaklaşımına dahil ettiğini belirtti. Açıklamada "O zamandan bu yana Astra için daha da güçlü korumalar uygulamaya koyduk" ifadelerine yer verildi: Bunlar arasında modelin zararlı siber talepleri daha güvenilir biçimde reddetmesi ve güvenlik kısıtlamalarına uyması için eğitilmesi, kötüye kullanıma karşı ek korumalar ve potansiyel olarak yetkisiz etkinlikleri durdurabilen izleme sistemleri yer alıyor. OpenAI, Astra'yı Hugging Face olayında kontrolden çıkan modeller gibi davranmaya iten deneyler hazırladığını ancak modelin test ortamından kaçmaya çalışmadığını söyledi. Öte yandan TechCrunch, üçüncü taraflar tarafından teyit edilmeden, OpenAI'ın güvenlik veya hazırlıkla ilgili iddialarını doğrulamanın güçlüğüne dikkat çekiyor. OpenAI Vakfı'nda yapay zeka dayanıklılığı üzerine çalışan eski OpenAI personeli Yona Shavit de Astra'nın kuralları ihlal etmekten kaçınmasının gerçekten güvenlik talimatlarına uymasından mı, yoksa test edildiğini anlayarak araştırmacıları yanıltmaya çalışmasından mı kaynaklandığını sorguluyor . Independent Türkçe, TechCrunch , CNBC , OpenAI Derleyen: Büşra Ağaç çeviri teknoloji YAPAY ZEKA siber güvenlik OpenAI Yapay zeka şirketi güçlü korumaları devreye soktuğunu savunuyor Perşembe, Eylül 3, 2026 - 13:45 Main image: Eğitimdeki modellerinin yakın zamanda kontrolden çıkması nedeniyle OpenAI tepki çekiyor (Reuters) BİLİM related nodes: Kontrolden çıkan OpenAI modeli başka şirketleri de hedef almış OpenAI'ın yapay zeka modelleri giderek kontrolden çıkıyor Teknoloji devlerinden yapay zeka güvenliği girişimi: "Karakutu gibi çalışacak" Label: ÇEVİRİ Type: news SEO Title: OpenAI'dan bilinmeyen güvenlik açıklarını tek başına bulan modeliyle ilgili açıklama copyright Independentturkish:
Read the full story at the source
This story was published by Independent.
Comments