Çin'in e-ticaret ve bulut devi Alibaba'nın Qwen araştırma ekibi, Qwen3.8-Max adlı yeni bir büyük dil modelini tanıttı. Bu model, 2.4 trilyon parametreye sahip bir mixture-of-experts (MoE) multimodal büyük dil modeli (LLM) ve otonom yazılım mühendisliği ve uzun vadeli empresa işlerine odaklanıyor.

Qwen3.8-Max'in Özellikleri

Qwen3.8-Max, bazı anahtar benchmarklerde GPT-5.6 Sol Max ve Fable 5'i geçerek dikkat çekiyor. OSWorld-Verified benchmarkinde 86.1 puan alan Qwen3.8-Max, GPT-5.6 Sol Max'in 83.2 puanını ve Fable 5'in 85.0 puanını geride bırakıyor. Ayrıca PaperBench ve TerminalBench 2.1'de en yüksek puanı elde ediyor.

Stratejik Değişim

Qwen3.8-Max'in açıklanması, Alibaba için potansiyel olarak önemli bir stratejik değişimi de işaret ediyor. Şirket, Qwen3.8-Max'in açık ağırlıklarını gelecek hafta Qwen3.8-27B ile birlikte yayınlayacak. Bu, bir Max-class Qwen modelinin self-hosted dağıtıma açık ilk kez sunulmasını temsil edecek.

Ne Anlama Geliyor?

Bu gelişme, büyük dil modellerinin otonom yazılım mühendisliği ve uzun vadeli empresa işlerine odaklanmasını gösteriyor. Qwen3.8-Max, bu alanda güçlü bir performans sergileyerek empresa otomasyonu için bir çözüm sunuyor. Ayrıca, büyük dil modellerinin benchmarklerinin değiştiğine işaret ediyor; artık sadece geleneksel akıl yürütme sınavlarına veya kodlama bilmecelerine odaklanmak yerine, uzun vadeli yürütme yeteneklerini ölçen benchmarkler kullanılıyor.