Çinli yapay zeka şirketleri, ABD’li rakiplerine olan mesafeyi hızla kapatırken Google’ın bir sonraki büyük modeli Gemini 3.5 Pro’nun çıkışı ertelendi. Moonshot AI, 2.8 trilyon parametreli Kimi K3’ü tanıtırken; Alibaba, WAIC 2026’da Qwen 3.8 Max’in önizlemesini yayınladı.

Kimi K3, bağımsız kıyaslama platformu Artificial Analysis’in (AA) Intelligence Index’inde 57 puanla üçüncü sıraya yerleşti. Bu skor, modeli Anthropic’in Fable 5 ve OpenAI’nin GPT-5.6’sının ardına konumlandırırken; Gemini 3.0 Pro, Claude Opus 4.8 ve GPT-5.5 gibi modelleri geride bıraktı. Özellikle ajan tabanlı AI ve kodlama alanlarında güçlü performans sergileyen Kimi K3, AA’nın Kodlama Ajanı Endeksi’nde GPT-5.6 Sol, GPT-5.6 Terra ve Fable 5’in ardından dördüncü oldu.

Model, Terminal-Bench v2’de %84, DeepSWE’de %64 başarı gösterirken; SWE-Atlas-QnA’da yalnızca %23 alarak genel ortalamasını düşürdü. Buna rağmen Kimi K3, Terminal-Bench v2’de Fable 5’i geçti; DeepSWE’de SpaceXAI’ın Grok 4.5 ve Claude Opus 4.8’i geride bıraktı. Frontend Code Arena’da ise GPT-5.6’yı aşarak birinci oldu.

Ajan kıyaslamalarında da iddialı olan Kimi K3, τ³-Banking’de GPT-5.6 Sol’u dar farkla geçti; AutomationBench-AA ve SpreadsheetBench 2’de birinci, BrowseComp’ta ise %91.2 ile yeni bir rekor kırdı. Bununla birlikte, Humanity’s Last Exam (HLE) ve CritPt gibi en zorlu testlerde altıncı sırada kaldı.

Yüksek performansın maliyeti

Kimi K3, açık ağırlıkları yayınlanana kadar yalnızca Moonshot AI’nin API’si üzerinden erişilebilir durumda. AA’ya göre model, akıl yürütme token’larını devre dışı bırakma imkanı sunmuyor ve alışılmadık derecede ayrıntılı yanıtlar üretiyor. Değerlendirme sırasında 130 milyon çıktı token’ı oluşturan model, ortalama 63 milyon token’ın iki katından fazla tüketim yaptı. 2.8 trilyon parametrelik MoE mimarisi, 896 uzmandan yalnızca 16’sını aktifleştirse de GPU bellek ve hesaplama gereksinimleri maliyetleri yüksek tutuyor.

Alibaba’dan Qwen 3.8 Max

Alibaba, 19 Temmuz’da Şanghay’daki WAIC’de 2.4 trilyon parametreli Qwen 3.8 Max’in önizlemesini sundu. Çok modelli yapısıyla metin, görsel, video ve belge işleyebilen modelin genel yeteneklerinin Fable 5’in hemen ardında olduğu belirtiliyor. Alibaba, ajan kodlama, yazılım geliştirme ve araç kullanımında önemli iyileştirmeler vaat ediyor. Modelin açık kaynak olarak yayınlanması planlanıyor. Bağımsız kıyaslama sonuçları henüz mevcut olmasa da topluluk testleri, Qwen 3.8 Max’in ön uç geliştirme ve ajan kodlamada GPT-5.6 ve Kimi K3 ile rekabetçi olduğunu gösteriyor.

Google baskı altında

Bloomberg’e göre Gemini 3.5 Pro, Haziran 2026’da planlanan çıkışını kaçırdı. Kod üretimi ve hata ayıklamada iç hedeflerin gerisinde kalan model, ek veri setleriyle ince ayar yapılmasına rağmen yeterli iyileşme sağlayamayınca eğitimin yeniden başlatılmasına karar verildi. OpenAI’nin GPT-5.6’sı, Meta’nın Muse Spark 1.1’i ve SpaceXAI’ın Grok 4.5’i ile rekabet edememe endişesi, Google’ın hisselerinde %4’lük düşüşe yol açtı. Analistler, Google’ın önümüzdeki dönemde öncü model sağlayıcıları arasındaki yerini kaybedebileceğini belirtiyor.

ABD’de Çin modelleri yükselişte

OpenRouter verilerine göre, Temmuz 2026’nın ilk haftasında ABD’li şirketler tarafından kullanılan AI token’larının %58’i Çinli modeller tarafından sağlandı. Bu oran, 2025 başında %10’un altındaydı. DeepSeek en çok kullanılan bireysel model olurken; Çinli modellerin haftalık işlem hacmi 18 trilyon token’a ulaştı. Fiyat avantajı (ABD öncü modellerine göre 10-50 kat daha düşük maliyet), geliştiricilerin Çinli açık ağırlıklı modellere yönelmesinde başlıca etken olarak gösteriliyor.

Neden önemli

Çinli modellerin kıyaslama performansında ABD’li rakiplerini yakalaması ve hatta bazı alanlarda geçmesi, yapay zeka endüstrisindeki güç dengesinin değişmekte olduğunu gösteriyor. Google’ın gecikmesi, büyük dil modellerinde hızın yanı sıra kaliteyi korumanın zorlaştığına işaret ediyor. Açık kaynak stratejisi ve agresif fiyatlandırma, Çinli modellerin küresel pazarda benimsenmesini hızlandırırken; ABD’li şirketlerin inovasyon ve maliyet verimliliği arasında denge kurma baskısını artırıyor.