Beyaz Saray ve NIST'ten Küresel Yapay Zekâ Güvenlik Standardı: Dağıtım Öncesi Zorunlu Kırmızı Takım Protokolü

ABD Yapay Zekâ Güvenlik Enstitüsü (NIST AISI), sınır modellerin (frontier AI) siber saldırı ve otonom çoğalma risklerine karşı kamuya açılmadan önce bağımsız kırmızı takım denetiminden geçmesini zorunlu kıldı.

NIST Yapay Zekâ Güvenlik Enstitüsü siber denetim merkezi ve sınır model kırmızı takım stres testi

Küresel yapay zekâ regülasyonlarında ve ulusal güvenlik standartlarında tarihi bir eşik geçildi: ABD Ticaret Bakanlığı’na bağlı Ulusal Standartlar ve Teknoloji Enstitüsü (NIST) ve ABD Yapay Zekâ Güvenlik Enstitüsü (US AISI); OpenAI, Anthropic, Google DeepMind ve Meta gibi devlerin geliştirdiği en gelişmiş “Sınır Modeller” (Frontier AI) için “Dağıtım Öncesi Zorunlu Bağımsız Kırmızı Takım (Pre-Deployment Red-Teaming) Protokolü”nü yürürlüğe koydu.

Avrupa Birliği (AB AI Office), Birleşik Krallık (UK AISI) ve Japonya Yapay Zekâ Güvenlik Enstitüsü ile tam koordinasyon içinde hazırlanan küresel protokol; 10 üzeri 26 işlem gücüyle (FLOPs) eğitilen tüm süper zekâ modellerinin kamuya veya ticari API’lara sunulmadan önce en az 30 günlük bağımsız siber güvenlik, otonom çoğalma ve biyolojik tehdit denetiminden geçmesini zorunlu kılıyor.


Kırmızı Takım (Red-Teaming) Neyi Denetliyor?

Sınır modellerin muhakeme yeteneği arttıkça, zararlı niyetli aktörler tarafından otonom siber saldırılar düzenlemek veya kimyasal silah sentezlemek için kötüye kullanılma riski de büyüdü.

NIST protokolünün odaklandığı 3 kritik güvenlik kategorisi:

  1. Otonom Siber Saldırı ve Sıfır Gün Sızmaları: Modelin bir insan korsana ihtiyaç duymadan nükleer santral veya bankacılık ağlarındaki sıfır gün açıklarını bulup tek başına sızma kabiliyeti ölçülüyor.
  2. KBRN (Kimyasal, Biyolojik, Radyolojik, Nükleer) Yardımı: Modelin tehlikeli patojenlerin veya sentetik virüslerin laboratuvarda üretilmesine dair adım adım talimat vermesi simüle edilerek filtreler test ediliyor.
  3. Otonom Kendi Kendini Kopyalama ve Aldatma: Yapay zekânın araştırmacıların denetiminden kaçmak için kendi ağırlıklarını başka sunuculara gizlice yedekleme veya insan değerlendiricilere yalan söyleme eğilimleri yapay zekâ tuzaklarıyla (honeypot) taranıyor.
Güvenlik uzmanlarının yapay zekâ modelini otonom siber saldırı ve sızma girişimlerine karşı stres testine tabi tutması
Denetimden geçemeyen veya kritik eşikleri aşan modeller, güvenlik filtreleri güçlendirilene kadar kamuya sunulamıyor.

Şirketlerin Tepkisi: Sorumlu İnovasyon mu Bürokrasi mi?

Yeni protokol, Silikon Vadisi’nde geniş bir mutabakatla karşılandı. OpenAI ve Anthropic yönetimleri, güvenlik standartlarının bağımsız devlet enstitüleri tarafından denetlenmesini desteklediklerini açıkladı.

Açık kaynak savunucuları ise hesaplama eşiğinin (FLOPs) yalnızca mega veri merkezlerine sahip trilyon dolarlık şirketleri kapsayacak şekilde netleştirilmesinden memnuniyet duydu; küçük girişimcilerin ve akademik araştırmacıların bu bürokrasiden muaf tutulduğu vurgulandı.

KriterÖnceki Dönem (Gönüllü Şirket İçi Test)Yeni Küresel NIST Red-Teaming Standardı
Denetim TürüŞirketlerin Kendi İç Güvenlik EkipleriBağımsız Devlet ve Uluslararası Enstitü Denetçileri
Test SüresiŞirket İnisiyatifindeKamuya Açılmadan Önce En Az 30 Günlük Karantina
Kapsam EşiğiBelirsiz10^26 FLOPs Üzeri Eğitilen Tüm Sınır Modeller
Yaptırım GücüYasal Zorunluluk Yoktuİhlal Halinde Ticari Dağıtımı Durdurma ve Ağır Para Cezası

Kısa Özet

  • Zorunlu Güvenlik Testi: NIST ve US AISI sınır yapay zekâ modellerine zorunlu kırmızı takım protokolü getirdi.
  • 30 Günlük Denetim: Modeller yayına girmeden önce siber saldırı ve biyolojik risk testinden geçecek.
  • Küresel Koordinasyon: ABD, AB, İngiltere ve Japonya güvenlik enstitüleri ortak standart uygulayacak.
  • Girişimciler Muaf: Kural yalnızca devasa frontier modelleri kapsıyor, küçük açık kaynak geliştiricileri etkilenmiyor.

Sonuç

NIST’in kırmızı takım güvenlik protokolü, yapay zekâ çağının ‘önce yayınla, sonra düzelt’ döneminden ‘önce güvenliğini kanıtla, sonra yayınla’ dönemine evrildiğini tescilliyor. İnsanlık, süper zekâ yarışında güvenlik kontrolünü elden bırakmıyor.

Sık sorulan sorular

Zorunlu Kırmızı Takım (Red-Teaming) Protokolü nedir?

Sınır modellerin kamuya sunulmadan önce siber saldırı, patojen sentezi ve otonom çoğalma risklerine karşı bağımsız denetçilerce test edilmesidir.

Hangi yapay zekâ modellerini kapsamaktadır?

10 üzeri 26 işlem gücüyle (FLOPs) eğitilen en gelişmiş frontier (sınır) yapay zekâ süper modellerini kapsamaktadır.

Küresel koordinasyonda hangi kurumlar var?

ABD (NIST AISI), Avrupa Birliği (EU AI Office), Birleşik Krallık (UK AISI) ve Japonya Yapay Zekâ Güvenlik Enstitüsü yer almaktadır.

Açık kaynak geliştiricileri bu kuraldan etkilenir mi?

Hayır. Yüksek FLOPs eşiği sayesinde küçük girişimler, üniversiteler ve açık kaynak geliştiricileri bu regülasyondan muaf tutulmuştur.

Toplum & Etik kategorisinden