DOSYA – OpenAI logosu, bir cep telefonunda, ChatGPT’nin Dall-E metinden resme modeliyle (8 Aralık 2023, Boston’da) oluşturulan bir görüntünün önünde görüntüleniyor.
Michael Dwyer/AP
başlığı gizle
başlığı değiştir
Michael Dwyer/AP
ChatGPT yapımcısı OpenAI, yapay zeka sistemlerinin test ortamından çıkıp başka bir yapay zeka şirketine sızmasına neden olan “benzeri görülmemiş siber olayı” hala araştırdığını söyledi.
OpenAI Salı günü yaptığı açıklamada, en yetenekli AI modellerinden ikisinin, AI girişimi Hugging Face’i hedef alan siber saldırıdan sorumlu olduğunu söyledi. Olay, daha güçlü yapay zeka korkuluklarına olan ihtiyaç ve yapay zeka ajanlarının ne ölçüde kendi başlarına hareket edebilecekleri konusundaki tartışmaları alevlendiriyor.
Hugging Face geçen hafta, kendi başına hareket eden bir yapay zeka ajanının neden olduğundan şüphelendiği veri işleme sistemlerine bir izinsiz giriş tespit ettiğini söyledi. Ancak New York merkezli girişim, bu haftaya kadar OpenAI’nin sorumlu olduğunu öğrendiğini ve Hugging Face CEO’su Clément Delangue’nin “daha önce gördüğümüz hiçbir şeye benzemeyen bir saldırı” olarak adlandırdığı saldırıyı kontrol altına almak için daha büyük şirketle birlikte çalıştığını söyledi.
San Francisco merkezli OpenAI, yapay zekasının çalıntı kimlik bilgilerini kullandığını ve Hugging Face sunucularına erişimde önceden bilinmeyen bir güvenlik açığı keşfettiğini söyledi. Korumalı alan olarak bilinen izole bir test ortamında olması gerektiği için azaltılmış korkuluklarla çalışıyordu.
Ancak şirket, “oldukça dar bir test hedefine ulaşmak için aşırı çaba sarf ettiğini”, insan yönlendirmesi olmadan internete bağlanmanın yollarını bulduğunu ve “değerlendirmeyi aldatmak için kullanabileceği gizli bilgilere erişim elde ettiğini” söyledi.
Bazı uzmanlar OpenAI’nin teknolojiyi yanlışlıkla suçladığını söylüyor
Amsterdam Üniversitesi’nden sosyal bilimci Hannes Cools, siber saldırının kendi başına hareket eden bir yapay zeka ajanı olarak çerçevelenmesinin, şirketin gerginliğinin bir kısmını hafifleten gereksiz bir antropomorfizasyon olduğunu söyledi.
Cools, “Belirli güvenlik önlemlerini kapatmak insani bir karardır” dedi. “Bu anlamda haydut bir yapay zeka değil. Yapay zeka sistemine verilen yönlendirmeye dayalı olarak belirli talimatları takip etti.”
OpenAI’ye göre bu talimatlar, yapay zekanın bir bilgisayar sistemini ne kadar iyi kullanabileceğini test etmek için “karmaşık saldırı yolları” kullanılmasını gerektiriyordu.
Yine de diğer uzmanlar, yapay zeka modellerinin çok az insan yönlendirmesiyle sorunlara neden olabilme becerisinin tehlikelere işaret ettiğini söylüyor. OpenAI, izinsiz girişin, yeni piyasaya sürülen GPT‑5.6 Sol ve hala dahili olarak test edilen “daha da yetenekli” bir model de dahil olmak üzere AI modellerinin bir kombinasyonundan kaynaklandığını söyledi.
Georgetown Üniversitesi Güvenlik ve Gelişen Teknoloji Merkezi’nde siber güvenlik araştırma görevlisi olan Colin Shea-Blymyer, “Anlayabildiğimiz kadarıyla, patladı ve bu hacklemeyi kendi başına yaptı” dedi. “Bu, siber operasyonlar için geniş bir dil modelinin kullanımında gördüğümüz en yüksek özerklik düzeyidir.”
Bir yapay zeka ajanı ‘öğretmen evinin’ anahtarlarını nasıl buldu?
Shea-Blymyer’in “neredeyse tamamen kendi kendine yönlendirilen” bir saldırı olarak tanımladığı saldırıdaki en şaşırtıcı yeniliklerden biri, yapay zeka ajanının tanınmış bir yapay zeka geliştirme merkezi ve pazarı olan Hugging Face’i hedef alma yönünde görünüşte bağımsız bir karar vermesiydi.
OpenAI’nin yapay zeka yeteneklerini ve risklerini test etmeye yönelik iç ortamının, “bir öğrenciyi bir odaya koyup ona ‘Kötü şeyler yapın. Şimdi işiniz ne kadar kötü bir insan olabileceğinizi değerlendirmek’ demek gibi çalıştığını söyledi.” Sonra odayı kilitliyorsunuz, hafta sonu için çıkıyorsunuz, geri döndüğünüzde odadan çıkmış oluyorlar.”
Ancak daha sonra “test edilen siber güvenlik ajanı sanal alanından çıktı, internete erişim sağladı ve kendi kendine şunu düşündü: ‘Üzerinde çalıştığım testin cevapları kimde olacak?’ “
Cevap, yapay zeka test verilerinin depolandığı Hugging Face’ti.
“Bunun üzerine ajan, tabiri caizse ‘Öğretmenin evine gideceğiz’ diye düşündü. Ve oradan içeri girip cevap anahtarını çalmak için bir plan yaptı” dedi.
Hack, açık kaynak ve kapalı yapay zeka arasındaki tartışmayı öne çıkarıyor
Hack, açık kaynaklı yapay zeka modellerinin, özellikle de Çin’de üretilen ve Anthropic, Google ve OpenAI gibi ABD merkezli “sınır yapay zeka” şirketlerinin inşa ettiği modeller kadar ucuz ve neredeyse aynı kalitede olanların yararları ve riskleri hakkında yoğun tartışmaların olduğu bir dönemde gerçekleşti.
İsmine rağmen OpenAI’nin modelleri kapalı. Hugging Face, aksine, geliştiricilerin temel bileşenleri herkesin incelemesi, değiştirmesi ve üzerine geliştirme yapması için erişilebilir hale getirdiği açık kaynak teknolojisinin büyük bir destekçisidir.
Hugging Face’in kurucu ortağı ve baş bilim sorumlusu Thomas Wolf, saldırının siber güvenlik savunması için açık kaynak modellere geniş erişimin önemine olan inancını güçlendirdiğini söyledi. Hugging Face, izinsiz girişle mücadele etmek için Çin modelini kullandı.
Wolf bir sosyal medya gönderisinde şöyle yazdı: “Bir sınır modeli size saldırdığında ve altyapınızın içinde yanal olarak hareket ettiğinde, savunucuların kapalı bir platforma yönlendirilmek yerine saatler, hatta dakikalar içinde sınıra yakın araçlara geniş erişime ihtiyacı var”.












