OpenAI, güvenlik için geliştirdiği GPT-Red adlı yeni yapay zeka modelini tanıttı. Kullanıcılara sunulmayacak modelin amacı, mevcut ve gelecekteki GPT’leri test etmek.
OpenAI, güvenlik odaklı yeni yapay zeka modeli GPT-Red’i duyurdu. Bu özel sistem, mevcut ve gelecekteki GPT modellerinin zayıf noktalarını belirlemek amacıyla OpenAI’ın güvenlik ekipleri tarafından geliştirildi.
GPT-Red, yapay zeka sistemlerini taklit ederek güvenlik açıklarını ortaya çıkaran otomatik bir ‘red teaming’ yaklaşımı kullanıyor. Model, komut enjeksiyonu gibi saldırıları simüle ederek zayıflıkları tespit ediyor ve bu senaryoları yeni eğitim verilerine dönüştürüyor.
OpenAI’ın ‘self-play’ olarak adlandırdığı yöntemle GPT-Red, saldırı senaryoları üretirken, savunma modeli de bu saldırıları engellemeye çalışıyor. Bu çift yönlü gelişim süreci, manuel testlere kıyasla daha fazla senaryonun hızlıca üretilmesini sağlıyor.
GPT-Red’in, GPT-5.6’nın güvenlik eğitiminde önemli rol oynadığı belirtildi. Model, komut enjeksiyonu saldırılarına karşı önceki sürümlere göre yaklaşık 6 kat daha dayanıklı hale getirildi.
OpenAI, bu güvenlik artışının GPT-5.6’nın genel yeteneklerini etkilemediğini vurguladı. Model, normal kullanım senaryolarındaki performansını koruyarak yalnızca kötü niyetli komutlara karşı daha dirençli hale geldi.
GPT-Red’in ChatGPT veya API üzerinden kullanıma sunulmayacağı açıklandı. Modelin saldırı üretme yetenekleriyle eğitilmesi nedeniyle yalnızca OpenAI’ın güvenlik araştırmalarında kullanılacağı belirtildi.
OpenAI, GPT-Red’in teknik detaylarını içeren bir bilimsel ön baskıyı yakında yayımlayacağını duyurdu. Şirket, gelecekte bu modelin gelişmiş sürümleriyle yeni nesil yapay zeka sistemlerini daha güvenli hale getirmeyi hedefliyor.
Türkiye’nin en güçlü ve en iddialı haber teması: Seobaz Haber Teması. Hız, SEO uyumu ve modern tasarımıyla rakiplerinizi geride bırakın, haber sitenizi zirveye taşıyın.
Yorum Yap