Mark Zuckerberg çarşamba günü Meta’nın ilk yapay zeka (AI) kodlama asistanı olan Muse Code’u beta sürümünde tanıtıyor. Ancak lansmanda bizzat paylaşılan dört farklı kıyaslamada Anthropic’in Claude Opus 5 modeli her alanda önde yer alıyor.
Meta buna rağmen bu karşılaştırma tablolarını yayınlıyor. Şirketin önceliği daha iyi bir araç sunmak değil, daha ucuz bir çözüm sağlamak. Bağımsız test verileri ise aradaki farkın Meta’nın gösterdiğinden daha büyük olduğunu ortaya koyuyor.
Bizi X’te takip edin , en güncel haberleri anında yakalayın
Meta’nın Kendi Grafikleri Bile Anthropic’i Zirveye Taşıdı
Muse Code’un kalbinde Muse Spark 1.2 modeli bulunuyor. Terminal-Bench 2.1 testinden %82,9 puan aldı.
Claude Opus 5 aynı testte %86,7’ye ulaşıyor. Terminal-Bench testi Laude Institute ve Stanford Üniversitesi araştırmacılarının hazırladığı bir ölçüt; sistem onarımı, veri işlemesi ve güvenliği kapsayan 89 gerçek işten oluşuyor.
İkinci sıra hiç de küçümsenecek bir sonuç değil. Muse Code, OpenAI’nin Codex modelini (%81,8) ve Grok Build’ı (%81,6) geride bırakıyor.
Sıradaki grafik daha da acımasızdı. DeepSWE 1.1, internet bağlantısının kapalı olduğu 113 kodlama görevi içeriyor. Burada Muse Spark 1.2 %59,3 ile üçüncü sıraya geriliyor.
Meta ardından tamamen kendi ekiplerinin paylaştığı 440 gerçek pull request’ten derlenen bir test yayınlıyor. Muse Spark 1.2 bu alanda %70,6 puan alırken Opus 5’e yaklaşık dokuz puan farkla geride kalıyor.
Bu skor, Temmuz ayında piyasaya çıkan Muse Spark 1.1 modelini yalnızca 2,3 puan geçmiş durumda.
Meta Kendi Grafiklerine Bu Modeli Hiç Almadı
Meta kendisini GPT-5.6 Terra ile karşılaştırdı. Fakat OpenAI’nin Sol adında daha güçlü bir modeli bulunuyor ve Meta bu modeli üç ayrı kıyaslamanın hiçbirine dahil etmiyor.
Sol, bağımsız Terminal-Bench 2.1 liderlik tablosunda %89,5 ile zirvede. Opus 5 ise %89,1 ile hemen arkasında.
İki skor da Meta’nın Opus 5 için açıkladığı %86,7’lik değerin üzerinde. Yani Meta rakibinin güçlü ayarını görmezden gelerek kendi seçtiği daha zayıf bir seçenekte bile geride kaldı.
Gerçek lider Sol ile karşılaştırıldığında Muse Spark 1.2, 3,8 yerine tam 6,6 puan geriden geliyor.
Meta yalnızca bir tabloda Sol’a yer veriyor. Ekran kartı (GPU) çekirdeği görevinde, 1.000’in üzerinde araç çağrısı yapılan testte Sol taban değerin yüzde %71,2 üstüne çıkıyor. Muse Spark 1.2 %68,7 ile altı model arasında dördüncü oluyor.
Burada bir uyarı yapmak şart. Muse Spark 1.2 henüz söz konusu kamuya açık liderlik tablosunda görünmüyor. Listenin 183 modelinden sadece 26’sı test edilmiş durumda; %82,9’luk performans Meta kaynaklı bir veri olarak kalıyor.
Zuckerberg şöyle belirtti: ‘Muse Spark 1.2, önümüzdeki dönemde açıklayacağımız daha büyük ve gelişmiş modellerin öncüsü olarak önemli bir adım.’ dedi.
Zuckerberg Kendi Modelini Geride Bırakan Rakibi Ağırlayabilir!
Meta’nın, Anthropic’e işlem gücü kiralamak üzere görüşmeler yürüttüğü konuşuluyor. Anlaşmanın iki yıl içinde 10 milyar dolara ulaşabileceği ifade ediliyor. Böylece Meta’nın veri merkezleri, Muse Code’un devirmek istediği Claude modellerinin işlem gücünü sağlayacak.
Muse Code ekibinin arkasındaki yatırım oldukça büyük. Zuckerberg haziran 2025’te Scale AI ve kurucusu Alexandr Wang için 14,3 milyar dolar ödemişti. Wang artık Meta Superintelligence Labs’in başında.
Wang’ın elinde fiyat avantajı kalıyor. Ücretler Meta’nın temmuz ayında ilk ücretli API lansmanıyla aynı: Milyon giriş token’ı için 1,25 dolar, milyon çıkış token’ı için 4,25 dolar.
Katılımcı seviyesi ise bundan 10 kat daha cazip. Geliştiriciler, Meta’nın kendi kodları üzerinde eğitim yapmasına izin verirse bu indirimli tarifeden yararlanıyor. Ancak Wang, Muse Spark serisinin ne kadar benimsendiğiyle ilgili veri paylaşmıyor.
Meta’nın mali tabloları indirimin nedenini açıklıyor. Gelir geçen çeyrekte %28 artışla 60,8 milyar dolara ulaşırken faaliyet karı %8 düşerek 18,8 milyar dolara gerilemiş durumda.
Faaliyet kar marjı bir yılda %43’ten %31’e indi. Meta sadece bu çeyrekte sermaye projelerine 31,08 milyar dolar harcadı ve yıl sonu itibarıyla 145 milyar dolara kadar çıkabileceğini öngörüyor.
Muse Code, Claude Code’da olmayan bazı mühendislik yetenekleri de sunuyor. Arka planda çalışan yardımcı agent’lar oturum boyunca bağlamı koruyor. Alt agent’lar ise havuzdan izole edilmiş depolama ortamlarında görev yapabiliyor.
Meta böylece ‘ikinci en iyi’ kodlayıcıyı geliştirip piyasadaki ekonomik modellerle yarışacak şekilde fiyatlandırıyor. Beta sürecinde geliştiricilerin, doğrulukta birkaç puanlık fark için faturanın onda birine razı olup olmayacağı netleşecek.









