Teknoloji

OpenAI, Astra modelinin geliştirmesini neden güvenlik gerekçesiyle yavaşlattı

TechCrunch11 sa önce
Siber güvenlik kodlarının göründüğü bir ekran
Siber güvenlik kodlarının göründüğü bir ekranPhoto: Tima Miroshnichenko / Pexels

OpenAI, geliştirmekte olduğu Astra adlı yapay zeka modelinin, şirketin kendi tanımına göre bir "kritik siber güvenlik eşiğine" ulaştığını açıkladı. Şirkete göre bu, modelin gerçek dünyada güvenliği sıkı biçimde sağlanmış sistemlere karşı siber saldırıları bağımsız olarak tespit edip gerçekleştirebilecek yeteneğe sahip olduğu anlamına geliyor.

Bu açıklama, OpenAI'ın kendi geliştirdiği modellerin yeteneklerini izlemek için kullandığı iç risk çerçevesinin bir parçası olarak geldi. Şirket, belirli yetenek eşiklerine ulaşan modeller için geliştirme hızını kasıtlı olarak yavaşlatmayı ya da ek güvenlik önlemleri devreye sokmayı öngören bir politika izliyor.

Siber güvenlik eşiği, bir yapay zeka modelinin insan müdahalesi olmadan güvenlik açıklarını bulma, istismar kodu yazma ve bu kodu gerçek sistemlere karşı uygulama konusunda ne kadar yetkin olduğunu ölçüyor. Bu tür bir yetenek, savunma amaçlı güvenlik araştırmalarında değerli olabileceği gibi, kötü niyetli kullanımda da ciddi bir risk oluşturuyor.

OpenAI, Astra'nın geliştirme sürecini durdurmadığını, ancak modelin dağıtımı öncesinde ek güvenlik testleri ve koruma katmanları eklemek için hızı kasıtlı olarak azalttığını belirtiyor. Bu, yapay zeka şirketlerinin son dönemde giderek daha sık başvurduğu bir yaklaşım haline geldi.

Bu adım, yapay zeka sektöründeki daha geniş bir tartışmanın parçası. Modellerin yetenekleri hızla artarken, bu yeteneklerin kötüye kullanılma potansiyeli de artıyor; özellikle siber güvenlik alanında, bir modelin "savunma" ile "saldırı" amacıyla kullanılması arasındaki çizgi çoğu zaman bulanık.

Güvenlik araştırmacıları, bu tür yeteneklere sahip modellerin hem faydalı hem tehlikeli olabileceğini uzun süredir vurguluyor. Bir yandan, otomatik güvenlik açığı taraması savunma ekiplerinin sistemlerini daha hızlı güçlendirmesine yardımcı olabilir; öte yandan aynı yetenek, kötü niyetli aktörlerin eline geçtiğinde yıkıcı sonuçlar doğurabilir.

OpenAI'ın açıklaması, şirketin bu riski kabul ettiğini ve modelin piyasaya sürülmeden önce ek güvenlik katmanlarıyla desteklenmesi gerektiğini düşündüğünü gösteriyor. Şirket, bu tür modellerin dağıtımı öncesinde harici güvenlik uzmanlarıyla iş birliği yaptığını da belirtiyor.

Bu gelişme, rakip yapay zeka şirketlerinin de benzer risk çerçevelerini benimsemesi yönünde bir emsal oluşturabilir. Sektördeki büyük oyuncuların çoğu, kendi modellerinin siber güvenlik, biyogüvenlik ve diğer yüksek riskli alanlardaki yeteneklerini izlemek için benzer eşik sistemleri geliştiriyor.

Eleştirmenler ise bu tür açıklamaların şeffaflık kadar pazarlama amacı da taşıyabileceğini belirtiyor; bir modelin "tehlikeli derecede güçlü" olduğunu duyurmak, aynı zamanda o modelin yeteneklerine dair bir reklam işlevi görebiliyor. Yine de düzenleyiciler ve güvenlik uzmanları, bu tür açıklamaların sektörde daha fazla şeffaflığa yol açmasını umuyor.

Astra'nın ne zaman ve hangi güvenlik önlemleriyle kullanıma sunulacağı henüz netleşmedi. OpenAI, modelin geliştirme sürecine devam edeceğini ancak yayın kararının, ek güvenlik değerlendirmelerinin sonuçlarına bağlı olacağını belirtiyor.

Bu yazı, TechCrunchkaynağına dayanılarak Vesper'ın yapay zeka editörü tarafından hazırlanmıştır. Görsel, Pexels'tan Tima Miroshnichenko tarafından çekilmiş bir stok fotoğraftır.

Bunları da okuyun