DeepSeek ve Qwen'in Yükselişi: Çin'in Açık Kaynak Yapay Zekâ Devrimi (2026)
Sezer Koçer
11 dk okuma

Özet
DeepSeek V4.1 Flash, Qwen3.8-Max ve Kimi K3 açık ağırlıklıdır, tam açık kaynak değildir. Fiyat bölgeye ve önbelleğe göre değişir.
2026'da sınır model yalnız kapalı bir API'nin arkasında durmuyor. DeepSeek, Alibaba Qwen ve Moonshot Kimi, ağırlığı indirilebilen veya çok düşük liste fiyatıyla çağrılabilen modeller yayımladı. Bu yazı üçünü aynı rafta okur: DeepSeek V4.1 Flash, Qwen3.8-Max ve Kimi K3. Başlıkta "açık kaynak" geçse de teknik ayrım açık ağırlıktır. Eğitim verisi ve eğitim kodu bu modellerde kapalıdır.
Amaç, hangi modeli hangi fiyata ve hangi makinede çalıştırabileceğinizi seçmektir. Skor, fiyat etiketi ve dizüstünde "çalışır" iddiası ayrı satırlardır.
Neden bu modeller duyuluyor?
Temel model, geniş veriyle eğitilmiş ve ince ayarla göreve çekilebilen bir dil modelidir. Çin laboratuvarlarının farkı, sınır seviyeyi yalnızca bir sohbet kutusunda tutmamalarıdır. Ağırlık yayımlanınca modeli kendi kümenize indirebilir, ince ayar deneyebilir ve çıkarımı kendi ağınızda tutabilirsiniz.
Ağırlığın inmesi, eğitim verisinin, eğitim kodunun ve tüm ara araştırmanın da inmesi demek değildir. Lisans ve kurumsal kullanım bu boşluktan etkilenir.
Açık kaynak ile açık ağırlık
İndirilebilir olmak, OSI anlamında açık kaynak olmak değildir.
- Kapalı model. GPT-5.6 Sol veya Claude Fable 5.1 gibi modellerde ağırlığa erişemezsiniz. İstek atar, cevap alırsınız.
- Açık ağırlık. Çalıştırmak için gereken parametre matrisleri indirilebilir. Eğitim verisi gizlidir. Lisans ticari kullanıma izin verebilir. Bu, "eğitim seti de açık" anlamına gelmez.
- OSI açık kaynak yapay zekâ. Eğitim verisi, eğitim kodu ve modeli değiştirme hakkının birlikte açık olmasıdır. 2026 sınır modellerinin neredeyse hiçbiri bu tanıma uymaz.
DeepSeek-V4.1-Flash model kartı lisansı MIT olarak işaretler. MIT, ağırlığı kullanma ve dağıtma açısından geniştir. Yine de 45 trilyon tokenlık eğitim karışımı ve eğitim kodu kartta açık değildir. Qwen3.8-27B ikincil kartlarda Apache-2.0 geçer. 2.4 trilyonluk Max kontrol noktası duyuruda açılacağı söylenmiş ve Eylül indekslerinde açık ağırlık olarak listelenmiştir. Bu, onu bir dizüstü modeli yapmaz. Kimi K3 ağırlıkları Temmuz 2026 sonunda yayımlanmış olarak anlatılır. Lisans metni Modified MIT diye anılır. Ticari hizmete açmadan o metni okuyun. Bu yazı lisans hükmü yerine geçmez.
DeepSeek V4.1 Flash
10 Eylül 2026'da API'de deepseek-flash adıyla genel kullanıma geçti. Resmi fiyat sayfası ve model kartı aynı çekirdeği anlatır. Toplam 552 milyar omurga parametresi. Mixture of Experts sayesinde prefill sırasında yaklaşık 8 milyar, decode sırasında yaklaşık 16 milyar parametre aktiftir. Bilgi toplamda durur. Fatura ve gecikme, o an yanan uzmana bağlıdır.
Bağlam 1 milyon token. Girdi metin ve görüntüdür. En fazla çıkış, fiyat sayfasında 384 bin token olarak yazar. FP4 KV önbelleği ve seyrek dikkat, küresel KV izini token başına yaklaşık 890 bayta indirir. Bu, DeepSeek'in kendi teknik notundaki sayıdır. Bir milyon token için yalnız bu iz kabaca 890 MB eder. Model ağırlığının kendisi bu hesaba dahil değildir. İkincil özetler sıkıştırılmış kontrol noktasını 160 GB mertebesinde anlatır. 32 GB ekran kartına sığmaz.
Fiyat, milyon token başına ve iki tarifedir. Yoğun saat, hafta içi 01:00–04:00 ve 06:00–10:00 UTC'dir. Diğer saatler ve hafta sonu sakin tarifedir. Sakin tarife, yoğunun yarısıdır.
| Kalem | Sakin | Yoğun | | --- | --- | --- | | Giriş, önbellek isabeti | 0,003 USD | 0,006 USD | | Giriş, isabetsiz | 0,15 USD | 0,30 USD | | Çıkış | 0,60 USD | 1,20 USD |
Eski deepseek-v4-flash adı hâlâ kabul edilir. Arkadaki model V4.1 Flash'tır ve Flash fiyatından kesilir. deepseek-v4-pro ayrıdır. 14 Eylül'de onu Flash'a yönlendirme planı geri çekildi. Pro, kendi fiyatıyla duruyor.
Qwen3.8-Max
Alibaba'nın 2026 yazı duyurusu, Qwen3.8-Max'i 2,4 trilyon parametre ve token başına yaklaşık 95 milyar aktif parametre olarak tanımlar. Bağlam, barındırılan API'de 1 milyon tokendir. Girdi metin, görüntü ve videodur. Çıktı metindir. Duyuru, kod, ofis işi ve uzun ufuklu görevlerde uçtan uca teslimatı öne çıkarır. "365 gün süren e-ticaret simülasyonu" veya "500 turlu çip tasarımı" bu duyurunun cümlesi değildir. Onları skor sanmayın.
Fiyat bölgeye göredir. Uluslararası Singapur satırında liste, milyon token başına 2 dolar giriş ve 6 dolar çıkıştır. Alibaba'nın Almanya, ABD, Japonya, Hong Kong ve Pekin kartında aynı model 1,65 dolar giriş ve 4,951 dolar çıkış olarak yazar. Önbellek ayrı kalemdir. 1,65 dolarlık kartta örtük önbellek 0,206 dolar, açık önbellek okuma 0,137 dolar görünür. "Her yerde sekiz kat ucuz, yani 0,25 dolar" cümlesi tek bölgenin eski anlık görüntüsüdür. Üretime hangi uç noktayı bağladığınızı fiyat sayfasından okuyun.
2,4 trilyonluk kontrol noktası çok düğümlü bir iştir. Aynı ailenin 27 milyarlık yoğun modeli, Apache-2.0 olarak anılan ve makineye sığan kontrol noktasıdır. Onun varsayılan bağlamı 262 bin tokendir, 1 milyona uzatılabilir. Max'in 1 milyonluk API penceresiyle karıştırmayın.
Kimi K3
Moonshot, Kimi K3'ü 16 Temmuz 2026'da API'ye aldı. 2,8 trilyon parametre, 1 milyon token bağlam, yerel görüntü girişi. Mimari notlarda Kimi Delta Attention geçer. Bu, uzun dizide dikkati seyreltmek için anlatılan melez bir dikkat katmanıdır. Tek bir "aktif milyar" sayısı resmi kartta bu yazının okuduğu özetlerde net değildir. İkincil kartlar 896 uzmanlı bir MoE der. Aktif parametreyi bilmeden yerel bellek hesabı yapılmaz.
Düşünme modu varsayılan olarak açıktır. Muhakeme token'ı çıkış fiyatından yazılır. Kısa bir cevap, uzun bir düşünme izi yüzünden pahalıya çıkabilir. Resmi API, milyon token başına 3 dolar isabetsiz giriş, 0,30 dolar önbellek isabeti ve 15 dolar çıkıştır. Fiyat, 1 milyonluk pencerenin tamamında düzdür. Ağırlıklar Temmuz sonunda yayımlanmış olarak geçer. 2,8 trilyonu bir oyuncu bilgisayarında açmak pratik değildir. Dağıtım notları onlarca hızlandırıcıdan söz eder.
Yan yana
Sayılar Eylül 2026 fiyat sayfaları ve model kartlarındandır. OpenAI satırları kısa bağlam liste fiyatıdır. Uzun bağlam katı ayrıca şişer.
| Model | Toplam | Aktif | Bağlam | Ağırlık | 1 milyon çıkış | | --- | --- | --- | --- | --- | --- | | DeepSeek V4.1 Flash | 552 milyar | 8 milyar prefill, 16 milyar decode | 1 milyon | İndirilebilir, kart MIT diyor | 1,20 USD yoğun, 0,60 sakin | | Qwen3.8-Max | 2,4 trilyon | yaklaşık 95 milyar | 1 milyon API | 2,4T küme işi, 27B ayrı ve daha açık | 6 USD Singapur, 4,951 diğer kart | | Kimi K3 | 2,8 trilyon | tek sayı net değil | 1 milyon | Yayımlanmış, lisans metnini okuyun | 15 USD | | GPT-5.6 Sol | gizli | gizli | 1 milyon sınıfı | Kapalı | 20 USD kısa bağlam | | GPT-5.6 Luna | gizli | gizli | 1 milyon sınıfı | Kapalı | 1,20 USD kısa bağlam |
Sol'un girişi kısa bağlamda 4 dolardır. Luna'nın girişi 0,20 dolardır. İkisi de 272 binin üstündeki istekte katlanır. Flash'ın 1,20 doları yalnızca yoğun çıkıştır. Sakin saatte çıkış 0,60 dolardır. Luna ile "aynı fiyat" demek, tarifeyi siler.
Skor ne işe yarar?
DeepSeek'in kendi kartı, Terminal-Bench 2.1 Pass@1 için %90,6 yazar. Aynı kart Terminal-Bench 4.0 Pass@1 için %31,2 yazar. GPQA Diamond Pass@1 %90,9'dur. Aynı tabloda GPT-5.6 Sol'un GPQA satırı %94,1, Opus 5'in Terminal-Bench 4.0 satırı %51,8'dir. Bunlar kartın kendi karşılaştırmasıdır.
Terminal-Bench 4.0 yazısında kamu ajan tablosunun başı %58 bandındaydı ve token toplamı tam koşuydu. %90,6 o tablonun satırı değildir. 2.1 daha eski ve daha doymuş bir settir. 4.0'da aynı model %31,2 ile o kamu tablosunun gerisindedir. İki sayıyı tek "Terminal-Bench skoru" diye toplamak, modeli olduğundan güçlü ya da zayıf gösterir.
Qwen duyurusundaki OmniDocBench 1.5 satırı 92,1'dir. Bu, belge çıkarımıdır. Terminal işi değildir. %80 ile %83 arasındaki fark, sizin deponuzda kazanan ilan etmez. Ajan döngüsü ile tek atış Pass@1 de aynı sınav değildir.
On milyon giriş, iki milyon çıkış
Örnek hacim aylık 10 milyon isabetsiz giriş ve 2 milyon çıkıştır. Önbellek yoktur. Muhakeme token'ı bu 2 milyonun içindedir. Gerçek işte düşünme izi çıkışı şişirir.
DeepSeek V4.1 Flash, yoğun tarifede 10 çarpı 0,30 artı 2 çarpı 1,20 eşittir 5,40 dolar. Sakin tarifede bunun yarısı, 2,70 dolar. Önbellek isabeti yoğunken giriş 0,006 dolara, sakinken 0,003 dolara iner. Aynı 10 milyon giriş, tam isabette sentin altına düşer. İsabetsiz girişle karıştırmayın.
Qwen3.8-Max, Singapur listesiyle 10 çarpı 2 artı 2 çarpı 6 eşittir 32 dolar. 1,65 ve 4,951 dolarlık kartta aynı hacim yaklaşık 26,40 dolardır. Bölge seçmeden "Qwen 32 dolar" demek eksiktir.
Kimi K3, 10 çarpı 3 artı 2 çarpı 15 eşittir 60 dolar. Düşünme token'ı bu 2 milyonun üstüne çıkarsa fatura 60'ta kalmaz. Önbellek isabeti girişi 0,30 dolara indirir. Çıkışı indirmaz.
Ucuz etiket, işi az tokenla bitiren modeldir. Uzun muhakeme, düşük birim fiyatı geçebilir. Aynı bağlamı her çağrıda yeniden göndermek de önbellek satırını hiç kullanmamaktır.
Ağırlık neden iner?
Veri kendi ağınızda kalır. İnce ayar denersiniz. Sağlayıcının o günkü kuyruğuna bağlı kalmazsınız. Token başına ABD veya Çin bulutuna ödeme yazılmaz.
Gizli fatura donanımdır. Ekran kartı, bellek, model güncellemesi ve bunu ayakta tutan kişi, API faturasını geçebilir. Ağırlığın Çin'de eğitilmiş olması, çalıştığı sunucunun güvenli olduğu anlamına gelmez. Güvenlik, ağırlığın sizin kapalı ağınızdaki sürecidir. Sunucu açıksa modelin lisansı sizi kurtarmaz.
Bellek bant genişliği bu hesabın parçasıdır. Büyük durumun gecikmesiz taşınması, NVIDIA Vera CPU yazısında duran konudur. Vera, 2,8 trilyonluk modeli tek başına çalıştıran kutu değildir.
Hangi makine?
552 milyar, 2,4 trilyon ve 2,8 trilyon, 16 GB RAM'li bir dizüstüne inmez. Qwen'in küçük açık kontrol noktaları, kuantize edilirse o sınıfta denenebilir. 27 milyar, 4 bitte ağırlık olarak yaklaşık 14 GB mertebesindedir. KV önbelleği ve çalışma payı bunun üstüne biner. 32 GB sistem belleği bir deneme olabilir. Garantili bir üretim kutusu değildir.
DeepSeek'in 16 milyar aktif parametresi, 552 milyarın belleğe yüklenmesini kaldırmaz. Aktif uzman, diskteki havuzun tamamını silmez. 32 GB ekran kartı bu havuzu taşımaz.
2,4 trilyon ve 2,8 trilyon için çok düğümlü bir küme gerekir. Çoğu ekip bu ikisini API'den çağırır. Yerelde tutulacak iş için 27B sınıfı ayrı bir karardır.
Örnek iş akışı
Aşağısı temsili bir teknoloji mağazasıdır. Vitrin Next.js, çekirdek ASP.NET Core, veri PostgreSQL. Hiçbir satır bu modellerin o işi ölçülmüş olarak kazandığını söylemez.
Ürün metni yüksek hacimli ve düşük belirsizliktedir. Flash'ın sakin tarife çıkışı 0,60 dolardır. Bu iş için birim fiyat lehinedir. Yine de Türkçe ürün sayfasını kendi örneklerinizle okuyun.
İade koşulu ve servis rehberi uzun belgedir. Qwen'in OmniDocBench satırı bu tür çıkarım için bir ipucudur. Yanlış garanti cümlesi, ucuz tokendan pahalıya çıkar. RAG'de kaynak cümlesini cevapta göstermek, model ailesinden bağımsız bir kuraldır.
NullReferenceException ve depo okuma, düşünme izi isteyebilir. Kimi'nin 1 milyonluk penceresi şemayı ve ilgili C# dosyasını tek istekte taşıyabilir. Taşımak, hatayı doğru düzeltmek değildir. Çıkış 15 dolardan faturalanır.
Müşteri davranışı ve maliyet tablosu dış API'ye gitmemelidir. O iş, indirdiğiniz ve kendi ağınızda koşan küçük açık ağırlığa kalır. 27B bu rafın adayıdır. 2,4T değildir.
Çekme isteğini okuyan bir ajan, bileşen hatasını arayabilir. Bunu "vibe coding kazanır" diye kapatmayın. Diff gürültüsü, test ve token, bir önceki yazıdaki boş şablonla ölçülür.
Veri ve KVKK
Müşteri verisini Çin veya ABD'deki bir API'ye göndermek uyum sorusudur. KVKK yorumunu bu yazı yapmaz. "Eğitimde kullanmıyoruz" taahhüdü, logun ve alt işleyenin nerede durduğunu tek başına kapatmaz. En dar yol, verinin sizin ağınızdan çıkmamasıdır. O yol da yama, erişim ve ağ çıkışı ister.
Açık ağırlık, veri merkezini otomatik güvenli yapmaz. Kapalı API, otomatik ihlal de değildir. Sözleşme, bölge ve saklama süresi hukukçunun masasıdır. Model kartı değildir.
Ne değişti?
MoE ve seyrek dikkat, her parametreyi her token için yakmadan büyük bir modeli fiyatlanabilir kıldı. Flash'ın 0,15 dolarlık sakin girişi, Sol'un 4 dolarlık kısa bağlam girişinin çok altındadır. Bu, Flash'ın 4.0 terminal setinde Sol'u geçtiği anlamına gelmez. Kart tersini yazar.
Seçim tek model çağırmak olmayabilir. Metin hacmi Flash'ta, belge Qwen'de, kod muhakemesi Kimi'de, gizli tablo ise hiç dışarı çıkmayan küçük ağırlıkta durabilir. Buna sürü demek şart değil. Şart olan, her işi en pahalı pencereye yığmamaktır.
Sıkça Sorulan Sorular
DeepSeek nedir?
Mixture of Experts kullanan, ağırlığı indirilebilen ve API'si yoğun ile sakin tarife diye ayrılan bir model ailesidir. V4.1 Flash, 10 Eylül 2026 fiyat kartındaki
deepseek-flashmodelidir.Qwen nedir?
Alibaba'nın model ailesidir. Qwen3.8-Max 2,4 trilyon parametre sınıfındadır. 27 milyarlık kardeş kontrol noktası, yerelde denenebilecek olan parçadır.
Kimi K3 nedir?
Moonshot'un Temmuz 2026 modelidir. 2,8 trilyon parametre, 1 milyon token, düşünme token'ı çıkış fiyatından yazılır. API 3 ve 15 dolardır.
DeepSeek ile Qwen farkı nedir?
Flash, aktif parametreyi ve KV izini küçülterek birim fiyatı düşürür. Max, çok daha büyük bir havuz ve daha yüksek liste fiyatıdır. İkisi de her işte aynı kazanan değildir.
DeepSeek açık kaynak mı?
OSI anlamında değil. Ağırlık açıktır ve kart MIT der. Eğitim verisi ve eğitim kodu açık değildir.
Qwen ücretsiz mi?
API ücretlidir ve bölgeye göre 2/6 veya 1,65/4,951 dolar bandındadır. Apache-2.0 olarak anılan 27B kontrol noktasını kendi makinenizde çalıştırırsanız o ağırlık için lisans ücreti yazılmaz. Elektrik ve ekran kartı yazılır.
Kimi K3 dizüstünde çalışır mı?
2,8 trilyonluk havuz, standart bir dizüstü veya tek oyuncu ekran kartı için değildir. API ya da çok düğümlü bir küme gerekir.
Açık ağırlık ne demektir?
Modelin yalnız bir sohbet servisi olarak kalmayıp, çalıştırmak için gereken ağırlık matrislerinin yayımlanmasıdır. Eğitim setinin yayımlanması ayrı bir iddiadır.
Flash kodlama için kullanılır mı?
1 milyon token ve düşük birim fiyat, depo okumayı ucuzlatır. Terminal-Bench 2.1 kartı %90,6 der. Aynı kart 4.0 için %31,2 der. Kod ajanı seçimini 2.1 skoruyla kapatmayın.
API maliyetleri nasıl kıyaslanır?
Aynı hacimde, isabetsiz giriş ve düşünmesiz 2 milyon çıkış varsayımıyla Flash yoğun 5,40 dolar, Qwen Singapur listesi 32 dolar, Kimi 60 dolardır. Önbellek, bölge ve muhakeme bu sırayı değiştirir.
Birim fiyat bir mimari seçimdir. Açık ağırlık bir veri seçimidir. İkisi aynı anda "en ucuz ve her makinede çalışır" olmaz. Flash'ı sakin saatte yüksek hacimli metne, gizli tabloyu indirdiğiniz küçük ağırlığa, 2 trilyonun üstünü ise ancak kümeniz varsa kendi sunucunuza ayırın.