Yapay zekada güvenlik alarmı: Çinli şirket soruşturma başlattı

Yapay zekada güvenlik alarmı: Çinli şirket soruşturma başlattı

Çinli yapay zeka geliştiricisi Moonshot’ın Kimi K2.6 ve K3 Swarm modellerinin güvenlik önlemlerinin aşılabildiği ortaya çıktı.

Çinli yapay zeka geliştiricisi Moonshot’ın Kimi K2.6 ve K3 Swarm modellerinin güvenlik önlemlerinin aşılabildiği ortaya çıktı. Modellerin biyolojik silah üretimi ve suikast yöntemleriyle ilgili talimatlar verebildiği belirtilirken şirket inceleme başlattı.

Çin merkezli yapay zeka geliştiricisi Moonshot, Kimi K2.6 ve K3 Swarm modellerinin güvenlik sınırlarının aşılabildiğinin ortaya çıkmasının ardından inceleme başlattı.

Yapay zeka sistemlerinin güvenliğini test eden Mindgard, temmuz ayında yaptığı testlerde söz konusu modellerin geliştiriciler tarafından belirlenen bazı güvenlik önlemlerini aşabildiğini tespit etti. Bulgular, "jailbreak" olarak adlandırılan ve yapay zeka sistemlerinin güvenlik kısıtlamalarını aşmasını amaçlayan yöntemlerle yapılan testler sırasında ortaya çıktı.

Mindgard, modellerin biyolojik silah üretimi ve suikast yöntemleri gibi tehlikeli konularda talimatlar verebildiğini belirtti. Ancak şirket, verilen yanıtların gerçek dünyada uygulanabilir olup olmadığının henüz kanıtlanmadığını da ifade etti.

Mindgard kurucusu Peter Garraghan, güvenlik önlemleri aşıldığında modelin kötü niyetli konular da dahil olmak üzere çeşitli alanlarda daha serbest ve yaratıcı yanıtlar verebildiğini söyledi.

Moonshot ise üçüncü tarafların yaptığı güvenlik testlerinin daha güvenli yapay zeka sistemleri geliştirilmesi açısından önemli olduğunu belirterek Mindgard ile bulgular hakkında görüşmeler yürüttüğünü açıkladı.

SİBER SALDIRILARDA KULLANILABİLİR

Mindgard ayrıca jailbreak uygulanmış bir Kimi K2.6 sürümünün bilgisayar kaynaklarında kod çalıştırmasına ve internete bağlanmasına olanak sağlayabileceğini, bunun da modelin siber saldırılar için kullanılabilecek bir araç haline gelmesine yol açabileceğini belirtti.

Şirket, 27 Temmuz'da Moonshot'a güvenlik açığı hakkında bilgi verdiğini ve yaklaşık bir hafta sonra konuyla ilgili ikinci bir mesaj gönderdiğini açıkladı. Mindgard, 12 Eylül'de de bulgularını içeren bir blog yazısı yayımladı.

Moonshot tarafından yapılan açıklamada ise modelin şirket içindeki değerlendirmelerde bu tür taleplere karşı genel olarak yüksek bir ret oranı gösterdiği belirtildi.

YAPAY ZEKA GÜVENLİĞİ TARTIŞMASI

Gelişmeler, yapay zeka sektöründe açık kaynaklı ve kapalı modellerin güvenliği konusundaki tartışmaların sürdüğü bir dönemde yaşandı.

Surrey Üniversitesi Profesörü Alan Woodward, açık kaynaklı modellerin kötü niyetli kişilerin eline geçme riski taşıdığını ancak aynı teknolojilerin siber savunma amacıyla da kullanılabileceğini söyledi.

Uzmanlar, yapay zeka sistemlerinin güvenlik önlemlerini aşmaya yönelik yöntemlerin kötüye kullanılabileceği konusunda uyarıyor. Bu nedenle yalnızca modellerin güvenliğinin değil, yapay zekayı kötü amaçlarla kullanan kişilerin tespit edilmesi ve hukuki süreçlerin de önem taşıdığı belirtiliyor.