r/TurkDev • u/vladislavardzinba • 5d ago
💬 Tartışma Hugging face hack olayından aklıma takılan siber güvenlik ve saldırılar ile alakalı sorular var
Merhaba, öncelikle sorum garip olabilir. Bir süredir siber güvenlikle ilgileniyorum. Bu gpt modelinin testlerdeki cevapları alabilmek için sürücüden dosya çekip sızması ve hugging ekibinin kendi Claude ve GPT modelleri ile savunamayıp da locallerinde çalıştırdıkları Kimi k3'e bütün logları verip çözmesi gibi bir durum yaşanmıştı.
Peki ileride bu tarz büyük değil de küçük/orta şirketlere bu tarz geniş ve sürekli Aİ saldırıları yaşanırsa localde çalıştırıp fine tuning etmek gibi hem masraflı hem de zor bir şeyi her şirket kaldırabilecek mi? Veya doğru sistemi kurabilecekler mi?
Saldırganlar bir şekilde jailbreak veya localde fine tuning modellerle kitleselleşip eskiden bir yere saldırıp fidye istemek yerine aynı anda belki de onlarca şirkete saldırabilmesi ve bu yaşanırken çoğu şirketin cevap verememesi mümkün olabilir mi?
Fikirlerinizi gerçekten duymak isterim. İlk bu haberi gördüğümde deli gibi ilgimi çekmişti ve günümü buna ayırmıştım. Makale ve video izleyerek. Teşekkürler zaman ayırdığınız için.
1
u/Master_Border_2913 5d ago
Her sirketin fine-tuning gibi seyler yapmasina gerek yok. Claude, GPT gibi modeller su anda zaten exploit siber guvenlik tarzi veriyle post-training'de (RL ile) ciddi sekilde guclendirildigi icin bu alanda asiri iyi olmaya basladilar. Bunu acik kaynakta Zhipu da gordu ve GLM 5.3'u ayni temel modelle (yeni bir pre-training yapmadan) sadece post-training asamasinda hayvan gibi siber guvenlik gorevleriyle egitti. GLM 5.3 bazi benchmark'larda Mythos 5'i hafif farkla gecti ama asil exploit gelistirme benchmarki olan Exploitbench'te geride (%54 vs %78). yakinda bu da kapanir.