OpenAI, yeni yapay zeka modeli GPT-Red’i tanıttı. Güvenlik testleri için geliştirilen sistem kullanıcılara sunulmayacak, ancak GPT-5.6 gibi modellerin güvenliğini artıracak.
OpenAI, güvenlik ekiplerinin kullanımına yönelik geliştirdiği yeni yapay zeka modeli GPT-Red’i duyurdu. Bu sistem, mevcut ve gelecekteki GPT modellerinin zayıf noktalarını belirlemek amacıyla saldırgan bir yaklaşımla testler gerçekleştiriyor.
GPT-Red, OpenAI’ın güvenlik ekipleri için özel olarak tasarlanmış dahili bir yapay zeka modelidir. Temel görevi, geliştirilen GPT modellerini potansiyel saldırılara karşı test ederek güvenlik açıklarını tespit etmektir. Şirket, bu yöntemin modellerin genel kullanıma sunulmadan önce daha güvenli hale getirilmesini sağladığını belirtti.
OpenAI tarafından paylaşılan bilgilere göre GPT-Red, klasik güvenlik testlerinin ötesine geçerek otomatik ‘red teaming’ yöntemini kullanıyor. Model, yapay zeka sistemlerini kandırmaya, güvenlik duvarlarını aşmaya ve komut enjeksiyonu gibi saldırılar gerçekleştirmeye çalışıyor. Başarılı olduğu her saldırı senaryosu, yeni eğitim verisi olarak sisteme entegre ediliyor.
Bu süreçte kullanılan ‘self-play’ yöntemiyle GPT-Red saldırı üretirken, karşı taraftaki savunma modeli de bu saldırıları engellemeye odaklanıyor. Her iki taraf da sürekli gelişim göstererek yapay zeka sistemlerinin dayanıklılığını artırıyor. OpenAI, bu yaklaşımın manuel testlere kıyasla daha kısa sürede çok sayıda senaryo üretilmesine olanak tanıdığını vurguluyor.
GPT-Red, özellikle GPT-5.6’nın güvenliğinin artırılmasında önemli bir rol oynadı. Model, GPT-5.6’nın eğitim sürecinde kullanılan saldırı örneklerini üreterek, bu versiyonun önceki modellere göre komut enjeksiyonu saldırılarına karşı yaklaşık 6 kat daha dayanıklı hale gelmesini sağladı. Güvenlikteki bu artışın, modelin genel yeteneklerinden ödün vermeden elde edildiği belirtildi.
OpenAI, GPT-Red’in ChatGPT veya API aracılığıyla kullanıcılara sunulmayacağını kesin bir dille ifade etti. Modelin, kasıtlı olarak saldırı üretme yetenekleriyle eğitilmiş olması bu kararın temel nedeni olarak gösterildi. Şirket, bu teknolojiyi yalnızca kendi güvenlik araştırmalarında kullanacağını ve dolaylı olarak daha güvenli GPT modelleri aracılığıyla kullanıcılara fayda sağlamayı hedeflediğini açıkladı.
OpenAI ayrıca GPT-Red hakkındaki detaylı teknik bilgileri içeren bir bilimsel ön baskıyı (preprint) yakında yayımlayacağını duyurdu. Şirket, gelecekte GPT-Red’in gelişmiş sürümleriyle yeni nesil yapay zeka modellerini daha güvenli ve dayanıklı hale getirmeyi amaçlıyor.
Reklam % İşbirliği: [email protected]