Kimi K3 ABD’nin Yapay Zeka Liderlerinden Geri mi Kaldı: Siyaset mi, Gerçek mi?

  • ABD hükümeti testlerinde Kimi K3’ün, önde gelen Amerikan yapay zeka modellerinin gerisinde kaldığı tespit edildi.
  • Ancak ABD modelleri güvenlik filtreleri kapalı test edildi. Kimi K3’te durum böyle değildi.
  • Korumaları halka açık sürümden önce bile hackleme konusunda yardımcı olmasına izin verdi.
Promo

ABD, Çin’in en yeni yapay zeka modelini hack’leme testiyle sınıyor. Sonuçlar Moonshot AI’ın Kimi K3 modelinin, Amerikan rakiplerine kıyasla oldukça geride kaldığını ortaya koyuyor.

ABD merkezli Yapay Zeka Standartları ve İnovasyon Merkezi (CAISI), İngiliz ortağıyla birlikte yaptığı testlerin sonuçlarını paylaştı. Bu hamle, Washington’ın Moonshot’ı Kimi K3’ü çalıntı Amerikan teknolojisiyle geliştirmekle suçlamasından sadece bir gün sonra geldi.

Sponsorlu
Sponsorlu

Kimi K3, ABD Siber Testlerinde Sınıfta Kaldı

Ticaret Bakanlığı, perşembe günü elde edilen sonuçları açıkladı. ABD ve İngiliz uzmanların birlikte yürüttüğü testte Kimi K3’ün, en iyi Amerikan modellerinin çok gerisinde kaldığı belirtildi.

Moonshot, Kimi K3’ü 16 Temmuz’da piyasaya sürdü. Talepler öylesine yoğundu ki, yeni üyelikleri sadece iki gün sonra durdurmak zorunda kaldı.

Bu lansman, ABD’li çip hisselerini salladı ve Amerika’nın yapay zeka liderliğine dair soru işaretleri oluşturdu.

Carnegie Mellon Üniversitesi tarafından geliştirilen gerçek Chrome tarayıcı açıklarına dayanan ExploitBench adlı testte; Kimi K3’ün skoru yüzde %32 oldu. Bu sonuç, Çin’in GLM-5.2 modelinin %24’lük performansının önünde. Ancak ABD’li modeller yaklaşık %76 ile bariz şekilde önde.

Exploit Geliştirme Kapasitesi
Exploit Geliştirme Kapasitesi Metrikleri Testi. Kaynak: NIST
Sponsorlu
Sponsorlu

En zor aşama, bir hedef bilgisayarı tamamen ele geçirmek. Kimi K3 bu adımda 41 testin hiçbirinde başarılı olamadı. Amerikan modelleri ise bu zorluğu 20 kez aştı.

The Last Ones adlı diğer testte, 32 adımlık bir sahte şirket ağına sızılması gerekiyor. İnsan uzmanlar bu görevi ortalama 20 saatte tamamlıyor. Kimi K3 ortalamada 17. adıma ulaşabildi. ABD’li modeller ise ortalama 28,5 adımı gördü. Kimi K3 10 denemede yalnızca bir kez tüm adımları tamamlayabildi.

Amerikan sistemlerinin ise altı yedi denemede görevi başarıyla bitirdiği söyleniyor.

Fark Sandığınız Kadar Büyük mü?

Ancak rakamlar tüm resmi göstermiyor. Raporun dipnotlarında bazı önemli noktalar var.

Öncelikle ABD modellerindeki güvenlik filtreleri test sırasında kapalıydı. Yani modellerin tüm potansiyeli ortaya koyuldu. Oysa yayımlanan halka açık sürümlerde bu filtreler kapatılmıyor. Sonuçlar bir anlamda “en iyi senaryo”, gerçek koşullardan uzak.

Takım, testlerin erken ve sınırlı yapıldığını da vurguladı. Kimi K3 yalnızca tek bir testte puanlandı ve tam test setinin küçük bir kısmı kullanıldı. Dolayısıyla bu puanlar sağlam değil. Ayrıca bazı testler kamuya açık değil: Yani dışarıdan doğrulama yapmak imkansız.

Bir de temel bir farklılık var. Kimi K3 herkesin indirebileceği açık bir model. Rakip Amerikan çözümleri ise kapalı ve özel sistemler. İngiliz enstitüsünün tespitine göre açık modeller, kapalı modellere genelde dört ila yedi ay geriden geliyor. Kimi K3, halka açık şekilde kullanıma sunulduktan sonra kapsamlı tam teste alınacak.

Üstelik testler gerçek saldırı ortamı değil. Sahte ağda ne bir insan savunucu vardı ne de güvenlik alarmı. Yine de Kimi K3, bir önceki açık kaynak liderini geride bıraktı ve tüm aşamayı en azından bir kez tamamlamayı başardı.

Testin zamanı ve kaynağı da soru işaretlerine neden oluyor. CAISI, daha önce ABD Yapay Zeka Güvenliği Enstitüsü adını taşıyordu. Trump yönetimi haziran 2025’te kurumun adını değiştirdi. Kuruluş, Çin’e yönelik Amerikan çip satışlarını kısıtlayan bakanlığın bir birimi. Ayrıca raporun, Çinli bir rakip hakkında bu kadar kısa sürede yayımlanması, çalıntı teknoloji iddiasını da beraberinde getirdi.

Zayıf Güvenlik Şartları: Risk Artıyor!

Yine de düşük puanlar Kimi K3’ün güvenli olduğu anlamına gelmiyor. Testler, modelin içindeki korumaların hack girişimini veya sistemlere saldırıyı engellemediğini ortaya koydu.

Asıl mesele ise bundan sonrası. Moonshot, tüm modeli 27 Temmuz’da kamuya açmayı planlıyor. O noktadan sonra geri dönüş yok. Herkese açık olduğunda, isteyen kişiler güvenlik korumasını kaldırabilir.

Test, çalıntı teknoloji iddiası sonrası geldi. Washington, Moonshot’ın Kimi K3’ü çalıntı Amerikan yapay zeka teknolojisi ile geliştirdiğini öne sürüyor. Beyaz Saray’ın teknoloji direktörü Michael Kratsios, Moonshot’ın Anthropic’in Claude Fable 5’ini gizlice kopyaladığını söyledi. “Distillation” adı verilen yöntem; güçlü bir modelin verdiği yanıtlarla yeni bir modeli eğitiyor.

Anthropic da bu iddiayı destekliyor. Şubat ayında 3,4 milyondan fazla Claude sohbetinin Moonshot’a ait yüzlerce sahte hesap üzerinden geçtiğini tespit etti. Kopyalanan modellerin orijinaldeki güvenlik filtrelerini kaybettiği uyarısı yapıldı. Bu testte de ortaya çıkan zayıflık tam olarak bu.

ABD hâlâ yapay zekaya, Çin’e kıyasla 23 kat fazla yatırım yapıyor. Fakat Çin laboratuvarları aradaki farkı hızla kapatıyor. Asıl sınav ise Kimi K3 kamuya açıldığında ve bağımsız uzmanlar modeli doğrudan inceleyebildiğinde verilecek.


BeInCrypto'nun en güncel kripto para piyasası analizlerini okumak için buraya tıklayın.

Feragatname

Bu haber makalesi doğru ve güncel bilgi vermeyi amaçlamaktadır. Ancak okuyucuların bu içeriğe dayalı herhangi bir karar vermeden önce tüm bilgileri bağımsız olarak doğrulamaları ve bir profesyonele danışmaları tavsiye edilir.

Sponsorlu
Sponsorlu