Oyunlar için En İyi Açık Kaynak Üretken Yapay Zekâ Modelleri (2026)
Son güncelleme: Eylül 2026.
Üretken yapay zekâyla ilgili durum şu: En iyi modeller yıllarca API anahtarlarının ve öngörülemeyen fiyatlandırmaların arkasında kaldı. İş akışınızı bir aracın etrafında kurup ona alışıyor, ardından bir sabah fiyatların değiştiğini söyleyen bir e-postayla uyanıyordunuz. Daha da kötüsü, şirket tamamen farklı bir alana yönelebiliyordu.
Bu durum 2024'ün sonlarında değişti. Tencent, Alibaba ve DeepSeek gerçekten indirebileceğiniz modeller yayımlamaya başladı. Üstelik kapalı alternatiflerle yarışan modeller. Böylece içerik üreticileri bir başkasının iş modeline bağlı olmayan seçeneklere kavuştu.
Video, 3D varlıklar, müzik ve sesleri tamamen kontrolünüzdeki modellerle üretebilseydiniz nasıl olurdu? Artık bulunduğumuz nokta tam olarak bu. Bu rehber, gerçekten var olan seçenekleri, işe yarayanları ve bugün kullanmaya başlayabileceklerinizi ele alıyor.
Video Üretimi
Video üretimi yıllarca Runway veya Pika demekti: kapalı platformlar, abonelik ücretleri ve çıktıyla yapabileceklerinize getirilen sınırlamalar. Peki ya şimdi? Benzer modelleri kendi donanımınızda çalıştırabilirsiniz.
Önde gelen açık kaynak video modeli HunyuanVideo ile metinden video üretimi, 720p çıktı
| Model | Kuruluş | Parametre | Özellikler | Donanım | Maliyet |
|---|---|---|---|---|---|
| HunyuanVideo | Tencent | 13B | 720p, metin+görsel | 80GB | ~$0.20 |
| HunyuanVideo-1.5 | Tencent | 8.3B | 480p-1080p, metin+görsel | 14GB | ~$0.05 |
| Mochi 1 | Genmo | 10B | 480p@30fps | 12GB+ | ~$0.10 |
| LTX-Video | Lightricks | — | 768x512, gerçek zamanlı | 12GB | ~$0.02 |
| LTX-2 / LTX-2.5 | Lightricks | 19B (2) / 22B (2.5) | 4K, senkronize ses, 2.5'te çoklu çekim | Üst düzey | ~$0.30 |
| Wan 2.1 | Alibaba | 1.3-14B | 480p-720p | 8GB+ | ~$0.03 |
| Wan 2.2 | Alibaba | 27B MoE (14B etkin) | 720p, MoE | 8GB+ | ~$0.03 |
| CogVideoX1.5-5B | Tsinghua | 5B | 1360x768@16fps, 10 saniyeye kadar | 12GB | ~$0.04 |
| SkyReels-V3 | Skywork | 14-19B | Ses güdümlü, referanstan videoya, V2V | Üst düzey | ~$0.10 |
| MiniMax H3 | MiniMax | 33B | 2K, 4-15 sn, stereo ses, 9 adede kadar referans görsel | Üst düzey | kıyaslanmadı |
| Step-Video-T2V | StepFun | 30B | En büyük açık T2V, 204 kare | Üst düzey | ~$0.15 |
| Open-Sora 2.0 | HPC-AI | 11B | Flux entegrasyonu | Üst düzey | ~$0.20 |
Ağırlıklar: HunyuanVideo ↗ · Mochi 1 ↗ · Wan 2.1 ↗ · Open-Sora ↗
Örnekleri görün: HunyuanVideo galerisi ↗ · Mochi örnekleri ↗ · CogVideoX örnekleri ↗
Bunun içerik üreticileri için anlamı
HunyuanVideo, profesyonel değerlendirmelerde Runway Gen-3'ten daha iyi performans gösteriyor ve tamamen açık. Peki dezavantajı? Ciddi bir donanıma ihtiyacınız var. 80GB VRAM'e sahip bir A100 veya H100. Çoğumuz için bu, gerektiğinde bulut GPU'ları kiralamak anlamına geliyor.
HunyuanVideo-1.5, donanım hesabını değiştirdi. Tencent bu modeli Kasım 2025'te, 14GB'lık tüketici sınıfı bir GPU'da çalışan 8.3B parametreli açık bir model olarak yayımladı. Model, 480p/720p çözünürlükte metinden videoya ve görselden videoya üretimin yanı sıra isteğe bağlı 1080p yükseltme sunuyor. Yeni Seçici ve Kayan Döşeme Dikkati (Selective and Sliding Tile Attention, SSTA) mekanizması, orijinal HunyuanVideo'nun yaklaşık iki katı çıkarım hızı sağlıyor. HunyuanVideo kalitesini istiyor ancak 80GB'lık bir ekran kartını haklı çıkaramıyorsanız, evde gerçekten çalıştırabileceğiniz sürüm bu.
Mochi 1, gerçekten çalıştırabileceğiniz model. RTX 3060 seviyesindeki 12GB'lık bir GPU bunun üstesinden rahatlıkla geliyor. Çıktıları gerçekten yaratıcı ve kendine özgü sanatsal bir niteliğe sahip. HunyuanVideo'nun görsel doğruluğuna tam olarak ulaşamasa da sürecin kontrolü sizde oluyor.
LTX-2, oyunlar açısından işlerin ilginçleştiği nokta. Videoyla senkronize ses üreten ilk açık model. Sesin kendiliğinden çekimle eşleştiği ara sahneleri düşünün. Prodüksiyon sonrası senkronizasyona gerek yok. Lightricks, Ocak 2026'da modelin tüm ağırlıklarını, çıkarım ve eğitim kodunu açık kaynak olarak yayımladı; model 50fps'ye kadar yerel 4K çıktı ve 20 saniyeye kadar senkronize ses sunuyor. Lisansla ilgili bir uyarı: LTX-2'nin açık ağırlıkları akademik kullanım için ücretsizken ticari kullanım yalnızca yıllık geliri $10M'ın altında olan şirketlere ücretsiz. Bu nedenle üzerine bir iş kurmadan önce bu eşiği kontrol edin. Eylül 2026 itibarıyla güncel kontrol noktası, yerel çoklu çekim üretimi (aynı karakter ve görsel tarza sahip birbiriyle bağlantılı birkaç çekim), standart VAE rekonstrüksiyonu yerine bir difüzyon video kod çözücüsü ve daha uzun istemler için Gemma 4 12B metin kodlayıcısı ekleyen 22B'lik LTX-2.5 modelidir. Bunların tümü, aynı $10M gelir sınırını ve bu sınırın üzerinde ücretli anlaşma gereksinimini koruyan LTX-2.x Community License kapsamındadır.
SkyReels-V3 (Skywork, Ocak 2026), dikkate değer yeni açık model serisi. 14B ve 19B varyantlarında ses güdümlü video, referanstan videoya ve videodan videoya üretim yapabilen birleşik, çok modlu bir model. Bu nedenle bir karakterin veya referans görselin çekimi yönlendirmesi gerektiğinde güçlü bir seçenek. Step-Video-T2V (StepFun), 30B ile en büyük açık metinden videoya modeli ve sade bir MIT lisansıyla sunuluyor. İzin veren lisans koşulları sizin için küçük bir GPU'ya sığmaktan daha önemliyse bilmenizde fayda var.
MiniMax H3 (Hailuo 3.0), en yeni açık seçenek ve referans güdümlü ara sahneler için takip edilmesi gereken model. MiniMax, modeli 31 Temmuz 2026'da API olarak kullanıma sundu ve 33B'lik temel ağırlıkları Ağustos ayında iki kontrol noktasıyla Hugging Face üzerinde yayımladı: İlk ve son kareden üretim için FL2VA ve 9 adede kadar referans görsel, 3 referans video klibi ve 3 ses klibi (toplam 12 dosya) kabul ederek yerel stereo sesle 2K'ya kadar çözünürlükte 4 ila 15 saniyelik içerik üreten Ref2VA. Model, MiniMax H3 Community License kapsamında. Model kartı ABD, AB, Birleşik Krallık ve Güney Kore'deki kullanıcılardan önce bir başvuru formu göndermelerini istiyor; dolayısıyla her stüdyo için doğrudan kullanıma hazır değil.
Wan 2.1, bir oyun dizüstü bilgisayarında çalışıyor. Küçük varyantlar için 8GB'lık bir GPU yeterli. Video üretimiyle prototip oluşturmak isteyip gerekli donanım yatırımını haklı çıkaramadıysanız başlangıç yolunuz bu.
Wan 2.2 (Alibaba, Temmuz 2025), Uzmanlar Karışımı tasarımı üzerine kurulan ilk açık kaynak video modeli: Toplam 27B parametresi var ancak her adımda yalnızca 14B'si etkin. Metinden videoya (T2V-A14B), görselden videoya (I2V-A14B) ve tüketici sınıfı GPU'larda çalışan hibrit bir 5B varyantı olarak sunuluyor; tamamı ticari kullanıma uygun Apache 2.0 lisansına sahip.
Bilinmesi gereken bir uyarı: Wan 2.2 hâlâ son açık Wan sürümü. Daha yeni Wan 2.5 (Eylül 2025), 2.6 (Aralık 2025), 2.7 (Nisan 2026) ve şimdi de Wan 3.0 (Ağustos 2026; Alibaba Cloud Model Studio bilgilerine göre 1080p'ye kadar 30 saniyelik tek çekim klipler ve referans girdileri) senkronize ses, 1080p ve daha hassas kare kontrolü ekledi ancak herkese açık ağırlıkları bulunmayan, yalnızca API üzerinden kullanılabilen modeller. Satış ortaklığı siteleri ne iddia ederse etsin, Wan-AI Hugging Face kuruluşu Eylül 2026 itibarıyla hâlâ en fazla 2.2 sürümünü sunuyor. Kendi sunucunuzda çalıştırmak sizin için önemliyse ulaşabileceğiniz üst sınır 2.2. 4K ve senkronize sese ihtiyacınız olduğunda tercih edilecek açık model ise LTX-2.5.
Mantıklı iş akışı şu: Yerel prototipleme için Mochi 1 veya Wan 2.1. Nihai kalite gerektiğinde bulut GPU'larında HunyuanVideo-1.5 veya LTX-2.5.
Görüntü Üretimi
Açık kaynağın şimdiden kazandığı alan burası. Bugün indirebileceğiniz modeller Midjourney ile gerçekten rekabet ediyor. Yalnızca “neredeyse onun kadar iyi” değiller; gerçekten rekabetçiler.
FLUX.1 örnekleri, Apache 2.0 lisanslı bir modelden fotogerçekçi kalite
| Model | Kuruluş | Yayımlanma | Parametre | Temel Özellik | Lisans | Maliyet/görsel |
|---|---|---|---|---|---|---|
| FLUX.1 [schnell] | Black Forest Labs | Ağu 2024 | 12B | 4 adımda üretim, hızlı | Apache 2.0 | ~$0.001 |
| FLUX.1 [dev] | Black Forest Labs | Ağu 2024 | 12B | Pro'ya yakın kalite | Ticari olmayan | ~$0.002 |
| SD 3.5 Large | Stability AI | Eki 2024 | 8B | Metin işleme, çeşitli tarzlar | Stability lisansı | ~$0.002 |
| SD 3.5 Large Turbo | Stability AI | Eki 2024 | 8B | 4 adımlı, hızlı | Stability lisansı | ~$0.001 |
| HiDream-I1 | HiDream.ai | Nis 2025 | 17B | Yüksek kalite, Full/Dev/Fast varyantları | MIT | ~$0.002 |
| CogView4 | Tsinghua / Zhipu | Mar 2025 | 6B | Yerel Çince metin, 2048px'e kadar | Apache 2.0 | ~$0.002 |
| Qwen-Image | Alibaba | Ağu 2025 | 20B | Sınıfının en iyi metin işlemesi, düzenleme | Apache 2.0 | ~$0.002 |
| FLUX.2 | Black Forest Labs | Kas 2025 | 32B | Metin+düzenleme, 4MP, çoklu referans | dev: Ticari olmayan / klein 4B: Apache 2.0 | ~$0.003 |
| Ideogram 4.0 | Ideogram | Haz 2026 | 9.3B | Tasarım işleri, metin işleme, JSON yerleşim kontrolü | Ticari olmayan | ~$0.002 |
Doğrudan deneyin: FLUX.1 schnell demosu ↗ · SD 3.5 Large demosu ↗ · GitHub (FLUX) ↗
Örnekleri görün: FLUX galerisi ↗ · FLUX LoRA galerisi ↗ · Replicate örnekleri ↗
Oyun varlıkları oluşturmak için
FLUX.1 [schnell], bilmeniz gereken model. Apache 2.0 lisansına sahip; yani lisans sorunları konusunda endişelenmeden ticari oyunlar yayımlayabilirsiniz. Yalnızca 4 adımda üretim yaptığı için hızlı yineleme yapabilirsiniz. Ne istediğinizi tarif edin, sonucu görün, ayarlayın ve tekrarlayın.
SD 3.5 Large sonunda metinleri düzgün biçimde işleyebiliyor. Önceki sürümler eklemeye çalıştığınız her türlü metni bozuyordu. Bu özellik; kullanıcı arayüzü maketleri, oyun içi tabelalar, başlık ekranları ve görsellerinizde okunabilir sözcüklere ihtiyaç duyduğunuz her yer için önemli.
FLUX.2 (Black Forest Labs, Kasım 2025), daha büyük halef model: Tek bir kontrol noktasında metinden görüntüye üretim ve görüntü düzenlemeyi gerçekleştiren 32B'lik model, 4 megapiksele kadar güçlü çoklu referans karakter/tarz tutarlılığı ve güvenilir metin işleme sunuyor. Açık ağırlıklı FLUX.2 [dev], ticari olmayan bir lisans kullanıyor. Ancak boyutu damıtılmış FLUX.2 [klein] (Ocak 2026), 4B sürümünü Apache 2.0 kapsamında sunuyor, bir saniyeden kısa sürede üretim yapıyor ve yaklaşık 8GB VRAM ile çalışıyor. Dolayısıyla oyun görsellerini yayımlamak için ticari açıdan güvenli bir seçenek hâlâ mevcut. Özellikle 4B klein sürümünü alın; daha büyük klein 9B, ticari olmayan FLUX lisansı kapsamında kalıyor. Nicemlenmiş işlem hatları [dev] sürümünü 18-24GB'lık GPU'larda çalışabilir hâle getiriyor. Black Forest Labs'in yeni nesli FLUX 3, 23 Temmuz 2026'da duyurulan birleşik bir görüntü, video ve ses modeli. Eylül 2026 itibarıyla yalnızca API üzerinden kullanılabiliyor: Senkronize sesli video 4 Ağustos'ta önizleme olarak kullanıma açıldı ve açık ağırlıklı FLUX 3 Dev, BFL sürüm notlarına göre “2026'nın ilerleyen dönemleri için planlanıyor.” Model çıkana kadar ticari açıdan güvenli FLUX seçeneği klein 4B olmaya devam ediyor.
Bilinmeye değer iki açık seçenek daha var. Chroma1-HD (8.9B, Apache 2.0), tamamen açık bir FLUX.1-schnell türevi. Bu nedenle [dev] lisansı olmadan FLUX ailesi kalitesini elde etmenin ticari açıdan güvenli yolu. OmniGen2 (Apache 2.0), metinden görüntüye üretim ile talimat tabanlı düzenlemeyi tek yerde birleştiren bir model. Sıfırdan üretmek yerine mevcut bir varlık üzerinde yineleme yaparken (“kılıcı mavi renkte parlat”) en hızlı seçenek bu.
Qwen-Image (Alibaba, Ağustos 2025), görsellerinizde tabela, kullanıcı arayüzü, poster veya eşya etiketi gibi okunabilir metinlere ihtiyaç duyduğunuzda tercih edilecek açık model. Sınıfının en iyi metin işleme performansına ve güçlü, talimat tabanlı bir düzenleme varyantına sahip 20B'lik bir Apache 2.0 modeli. Dolayısıyla ticari açıdan güvenli ve çoğu görüntü modelinin hâlâ zorlandığı konuda olağanüstü başarılı. Aralık 2025 yenilemesi Qwen-Image-2512, insan gerçekçiliğini ve metin yerleşimini iyileştirirken Apache 2.0 lisansını korudu; kendi sunucunuzda çalıştıracaksanız bu kontrol noktasını alın. Daha yeni Qwen-Image-2.0 (Şubat 2026) yalnızca API üzerinden kullanılabiliyor. Eylül 2026 itibarıyla QwenLM deposu, herkese açık ağırlıklara sahip en yeni kontrol noktaları olarak hâlâ Qwen-Image-2512 ve Qwen-Image-Edit-2511'i listeliyor. Ideogram 4.0 (Haziran 2026), Ideogram'ın açık ağırlıklı ilk sürümüdür: tasarım çalışmaları için geliştirilmiş, çok dilli metin oluşturmada güçlü ve yapılandırılmış JSON istemleri aracılığıyla açık düzen ve renk kontrolü sunan 9,3 milyar parametreli bir difüzyon dönüştürücüsü. Ancak üzerine bir şeyler geliştirmeden önce bilmeniz gereken bir nokta var: çıkarım kodu Apache 2.0 lisanslı olsa da ağırlıklar ticari olmayan bir lisansa tabi. Dolayısıyla ticari lisansı satın almadığınız sürece bu, araştırma ve prototipleme aracıdır.
Stable Diffusion'ın etrafındaki ekosistem hâlâ rakipsiz. Hassas kompozisyon için ControlNet. Düzeltmeler için inpainting. Özel stiller için LoRA ince ayarı. FLUX arayı kapatıyor ancak bugün kapsamlı özelleştirmeye ihtiyacınız varsa SD'nin araç olgunluğu size daha fazla seçenek sunuyor.
Ben şöyle değerlendirirdim: dokular ve sprite'lar için ikisi de iş görür. Belirli stil gereksinimleri olan konsept çizimler için LoRA'larla SD 3.5. Ticari olarak yayımlanacak oyunlarda saf kalite için FLUX schnell.
3D Üretimi
Oyununuzda üç saniye görünen bir dekor nesnesini modellemek için sekiz saat harcadıysanız bu bölüm sizin için. 3D üretimi bir süre önce “ilginç araştırma” aşamasından gerçek bir üretim aracına dönüştü ve 2026 itibarıyla açık modeller gerçekten iyi. Bir eskizden dokulu bir mesh'e bir dakikadan kısa sürede geçebilirsiniz.
Bu sayfa, kendi sunucunuzda çalıştırabileceğiniz açık modelleri ele alıyor. Bir model yerine araç seçiyorsanız en iyi yapay zekâ 3D model üreticileri rehberimiz, barındırılan seçenekleri (Meshy, Tripo, Rodin, Hi3D) açık modellerle karşılaştırıyor ve her birinin fiyatlandırmasını ve ticari kullanım haklarını açıklıyor.
TRELLIS, tek görüntülerden PBR malzemeli, dokulu 3D mesh'ler üretir
| Model | Kuruluş | Yayımlanma | Temel Özellik | Çıktı | Mesh başına maliyet |
|---|---|---|---|---|---|
| TRELLIS.2-4B | Microsoft | Ara 2025 | 4 milyar parametre, yerel PBR, 1536³'e kadar | Normal haritalı, dokulu mesh | ~$0.03 |
| Hunyuan3D 2.1 | Tencent | Haz 2025 | Üretime hazır PBR, tüm ağırlıklar + eğitim kodu | Yüksek doğruluklu, dokulu mesh | ~$0.05 |
| SAM 3D | Meta | Kas 2025 | Tek görüntüden 3D'ye (nesneler + insan vücudu) | Tek fotoğraftan mesh | ~$0.02 |
| Stable Fast 3D | Stability AI | Ağu 2024 | Tek görüntü → yaklaşık 0,5 sn'de mesh | Hızlı, dokulu mesh | ~$0.001 |
| TripoSG | VAST-AI | Mar 2025 | 1,5 milyar parametreli düzeltilmiş akış tabanlı şekil üretimi | Yüksek kaliteli mesh | ~$0.01 |
| TripoSR | Stability / Tripo | 2024 | Tek görüntüden hızlı rekonstrüksiyon | Mesh (dokusuz) | ~$0.001 |
| UniRig | Tsinghua / Tripo | 2025 | Otomatik rig: iskelet + skinning ağırlıkları | Rig'lenmiş, canlandırılabilir mesh | ~$0.01 |
Doğrudan deneyin: TRELLIS.2 demosu ↗ · Hunyuan3D demosu ↗ · InstantMesh demosu ↗
Örnekleri görün: TRELLIS.2 proje sayfası ↗ · 3D AI Studio galerisi ↗
Gerçekten işe yarayan bir iş akışı
Şu anda içerik üreticileri için sonuç veren yaklaşım, modelleri birbirine zincirlemek. Üretilmiş veya fotoğraflanmış olması fark etmeksizin bir görüntüyle başlayın. Birden fazla görünüm elde etmek için görüntüyü Stable Zero123 veya Wonder3D'den geçirin. Mesh'i oluşturmak için bu görünümleri InstantMesh veya TripoSR'a verin. Ardından düzgün malzemeler için TRELLIS.2 veya Hunyuan3D kullanın.
Microsoft'un TRELLIS.2 modeli, üretime hazır varlıklar konusunda yeni lider. Diğer modelleri zorlayan geometrilerin üstesinden geliyor: ince yüzeyler, delikler, karmaşık topoloji. 4 milyar parametreli sürüm, malzeme gibi görünmeye çalışan basit köşe renkleri yerine gerçek PBR dokulara sahip mesh'ler üretiyor.
Stable Fast 3D tamamen hız odaklı. Görüntüden mesh'e yaklaşık yarım saniyede geçiyor. Mesh'in temizlenmesi ve dokulanması gerekiyor ama prototipleme için? Saatler harcamadan önce bir fikrin işe yarayıp yaramadığını anlamak için? Rakipsiz. Tek görüntüden daha temiz geometri istediğinizde TripoSG bir üst basamak.
Hunyuan3D 2.1, Tencent'in kullanmanız gereken açık modeli: üretim kalitesinde PBR dokulamayla birlikte tüm ağırlıkları ve eğitim kodunu sunuyor. Adlandırmaya dikkat edin, çünkü pek çok kişinin kafasını karıştırıyor. Hunyuan3D 2.5, 3.0 ve 3.1 sürümlerinin hepsi mevcut ancak yalnızca API üzerinden kullanılabiliyor ve herkese açık ağırlıkları yok. Dolayısıyla kendi sunucunuzda çalıştırmak için temel üreticinin en güncel sürümü hâlâ 2.1 (Tencent'e 2.5'i açık kaynak yapıp yapmayacağını soran bir GitHub başlığı, Eylül 2026 itibarıyla yanıtsız kaldı). Barındırmak yerine denemeyi tercih ederseniz 3D üreticimiz Hunyuan3D'yi tarayıcıda çalıştırıyor. Tencent ayrıca 2.1 üzerine geliştirilmiş iki yararlı uzantıyı da açtı: Hunyuan3D-Omni, çoklu koşul kontrolü (nokta bulutu, voksel, iskelet, sınırlayıcı kutu) eklerken Hunyuan3D-Part bir mesh'i düzenlenebilir parçalara ayırıyor. Lisansı ayrıca AB, Birleşik Krallık ve Güney Kore'yi kapsam dışında bırakıyor; bu nedenle oyununuzu bu bölgelerde yayımlamadan önce koşulları kontrol edin.
SAM 3D (Meta, Kasım 2025) en yeni yaklaşım: tek bir fotoğrafı, nesneler ve insan vücutları için ayrı modeller kullanarak 3D mesh'e dönüştürüyor. Meta'nın segmentasyon çalışmalarıyla birleştirildiğinde görüntüdeki bir nesneyi ayırıp yalnızca o nesneyi yeniden oluşturabilirsiniz.
UniRig (Tsinghua ve Tripo, MIT), herkesin mesh'i elde ettikten hemen sonra karşılaştığı açığı kapatıyor: rigleme. Bir girdi mesh'i için otomatik olarak geçerli bir iskelet ve skinning ağırlıkları oluşturuyor; böylece üretilmiş bir karakter, statik bir dekor nesnesi olarak kalmak yerine gerçekten canlandırılabiliyor. Bunu NVIDIA'nın SOMA-X otomatik animasyon çalışmasıyla eşleştirdiğinizde tamamen üretilmiş ve tamamen rig'lenmiş bir karakter, araştırma demosu olmaktan çıkıyor.
Bağımsız içerik üreticileri için gerçekçi beklenti şu: FLUX ile konsept çizimi üretin, geometri için InstantMesh'ten geçirin, ardından Blender'da dokulayın veya otomatik PBR için TRELLIS kullanın. Varlık başına 4-8 saat yerine 30-60 dakikadan söz ediyoruz. Sıfır zaman değil ama gerçek bir fark.
Ses ve Müzik
Ses üretimi henüz görüntü ve videonun seviyesine ulaşmadı. Ancak özellikle prototipleme ve ses efektleri için çalışma biçiminizi değiştirmeye yetecek kadar seçenek var.
Yapay zekâyla üretilmiş müzik örneği. İstediğiniz atmosferi tarif edin, ona uygun müziği alın
| Model | Kuruluş | Yayımlanma | İşlevi | Lisans | 30 sn maliyeti |
|---|---|---|---|---|---|
| ACE-Step 1.5 | StepFun/ACE Studio | Oca 2026 | Yaklaşık 4 dakikalık hızlı müzik, 19 dil, ses klonlama | MIT | ~$0.02 |
| Stable Audio 3.0 | Stability AI | May 2026 | Yaklaşık 6 dakikaya kadar şarkılar; açık Small, Small-SFX + Medium modelleri | Stability Community | ~$0.02 |
| YuE | MAP | Oca 2025 | Şarkı sözlerinden vokalli ve eşlikli tam şarkılar | Apache 2.0 | ~$0.05 |
| MusicGen | Meta | 2023 | Metinden müzik, kontrol edilebilir | kod MIT / ağırlıklar CC-BY-NC | ~$0.01 |
| DiffRhythm 2 | ASLP-lab | Şub 2026 | Hızlı tam şarkı üretimi | Apache 2.0 | ~$0.02 |
| Magenta RealTime | Haz 2025 | Gerçek zamanlı, istemlerle yönlendirilebilir müzik | kod Apache / ağırlıklar CC-BY | ~$0.02 |
Doğrudan deneyin: MusicGen demosu ↗ · AudioCraft deneme alanı ↗
Örnekleri görün: MusicGen örnekleri ↗ · AudioGen örnekleri ↗
Gerçekten yayımlayabileceğiniz seçenekler
Meta'nın MusicGen modeli, oyun seslerinin prototiplenmesi için hâlâ pratik bir seçenek. İstediğiniz atmosferi tarif edin, ona uyan müziği alın; ayrıca 12 GB'lık bir GPU'da sorunsuz çalışıyor. Lisansla ilgili bir ayrıntı var: MusicGen kodu MIT lisanslı ancak model ağırlıkları CC-BY-NC (ticari olmayan kullanım) lisansına tabi. Bu nedenle prototipleme için kullanın ve yayımlayacağınız her şeyde ACE-Step veya Stable Audio gibi ticari lisanslı bir modele geçin.
Stable Audio'nun açık ses efekti modeli (Small-SFX) ayak seslerini, kapı gıcırtılarını, ortam rüzgârını ve mekanik sesleri işleyebiliyor, yerel olarak çalışıyor ve Stability'nin topluluk lisansıyla sunuluyor. Dolayısıyla ticari olarak gerçekten kullanabileceğiniz seslere ihtiyaç duyduğunuzda başvurmanız gereken açık SFX seçeneği bu. Diğer açık SFX modellerinin kısıtlamaları olduğu için tercih edilmesi gereken model de bu: Meta'nın AudioGen modeli CC-BY-NC lisanslı ve TangoFlux, Stability'nin ticari olmayan topluluk lisansına tabi. Bu nedenle yayımlanacak bir oyun için ikisi de yalnızca prototiplemeye uygun.
Magenta RealTime (Google), mümkün olan en iyi anlamda diğerlerinden ayrılıyor: gerçek zamanlı, istemlerle sürekli yönlendirilebilen müzik için geliştirilmiş tek açık ağırlıklı model. Tamamlanmış bir parçayı işlemek yerine çalarken yönlendirebileceğiniz canlı müzik üretiyor. Bu da oyuncunun yaptıklarına göre değişen uyarlanabilir oyun müziklerinin tam olarak ihtiyaç duyduğu yapı. Kod Apache 2.0, ağırlıklar ise CC-BY lisanslı; ikisi de ticari kullanıma uygun.
YuE gerçekten heyecan verici. Vokalli tam şarkılar üreten ilk açık model. Tema şarkıları. Gerçek şarkı söyleme içeren arka plan müzikleri. Kalite değişkenlik gösteriyor ancak indirip kendi başınıza çalıştırabileceğiniz diğer her şeyden çok daha ileride.
ACE-Step, artık bilinmesi gereken açık müzik modeli ve hızla gelişti: 1.5 serisi (Ocak 2026, daha büyük 5B XL varyantıyla birlikte), Mayıs 2025'te yayımlanan ilk sürümün yerini aldı ve artık MIT lisanslı. Birkaç dakikalık müziği hızla üretiyor, 19 dili destekliyor ve ses klonlama, remiksleme ve şarkı sözü düzenleme özellikleri sunuyor. Oyun prototiplemesi açısından YuE ve MusicGen'in açık bıraktığı boşluğun büyük bölümünü kapatıyor.
Stable Audio 3.0 (Mayıs 2026), ses alanındaki daha büyük güncelleme. Yaklaşık altı dakikaya kadar şarkılar üretebiliyor ve Stability, dört varyanttan üçünün açık ağırlıklarını yayımladı: Small ve özel ses efekti modeli Small-SFX cihaz üzerinde çalışırken Medium daha iyi müzikal yapı ve tam parça uzunluğu sunuyor. Yalnızca Large modeli API'ye özel kaldı. Small-SFX artık özellikle oyun ses efektleri için en güçlü açık seçenek. Üç açık model, ürettiklerinizi kullanmanıza ve satmanıza izin veren Stability AI Community License kapsamında sunuluyor; Stability'nin duyurusuna göre yıllık geliri $1 milyonun üzerindeki şirketler için Enterprise License gerekiyor. Tüm model ailesi lisanslı verilerle eğitildiği için hukuki zemini, sonuçlanmamış davalarla karşı karşıya olan müzik üreticilerinden daha sağlam.
Dürüst değerlendirme şu: açık modeller ile kapalı modeller (Suno, Udio) arasındaki fark azalıyor ancak tam vokalli şarkılar konusunda hâlâ belirgin ve bu kapalı araçlar da eğitim verileriyle ilgili sonuçlanmamış davalarla karşı karşıya. Ses efektlerinde açık modeller, özellikle Stable Audio'nun SFX modeli, gerçekten rekabetçi. Yayımlamak istediğiniz şarkılar için çok sayıda yineleme yapmayı veya son prodüksiyon için bir müzisyenle çalışıp bu araçları diğer her şeyde kullanmayı bekleyin.
Konuşma ve Seslendirme
Ses üretimi artık “oyunlar için yeterince iyi” seviyesini çoktan geçti ve bu, küçük ekiplerin yapabileceklerini değiştiriyor.
Doğal konuşma, doğru tempo ve duyguyla yapay zekâ tarafından üretilmiş oyun anlatımı
| Model | Kuruluş | Yayımlanma | Temel Özellik | Lisans | Dakika başına maliyet |
|---|---|---|---|---|---|
| Qwen3-TTS | Alibaba | Oca 2026 | 3 sn'den ses klonlama, ses tasarımı, 10 dil | Apache 2.0 | ~$0.002 |
| Chatterbox | Resemble AI | 2025 | Duygu kontrolü, yaklaşık 5 sn'den klonlama, 23 dil | MIT | ~$0.003 |
| CSM | Sesame AI | Mar 2025 | Diyalog akışı, doğal duraklamalar | Apache 2.0 | ~$0.005 |
| Fish Speech 1.5 | Fish Audio | 2024 | 10-30 sn'den zero-shot klonlama | kod Apache / ağırlıklar CC-BY-NC-SA | ~$0.002 |
| OpenVoice V2 | MyShell/MIT | Nis 2024 | Duygu/aksan kontrolü | MIT | ~$0.003 |
| XTTS-v2 | Coqui (topluluk) | 2024 | 17 dil, ses klonlama | CPML (ticari olmayan kullanım) | ~$0.005 |
Örnekleri dinleyin: Fish Audio sesleri ↗ · OpenVoice demosu ↗
NPC'lerin insanlar gibi konuşmasını sağlamak
Sesame'in CSM (Conversational Speech Model) modeli özellikle diyalog için geliştirildi. Doğal duraklamalar üretiyor. Tonlama değişiklikleri. Gerçek konuşmanın ritmi. Çoğu TTS, senaryo okuyan biri gibi ses çıkarır ve bunu anında fark edersiniz. CSM ise konuşan biri gibi duyuluyor. Bu fark, düşündüğünüzden daha önemli.
Qwen3-TTS (Alibaba, Ocak 2026), ticari projelerde başvurulacak model. Tüm model ailesi Apache 2.0 lisanslı, yaklaşık 3 saniyelik referans sesten bir sesi klonlayabiliyor, 10 dil konuşuyor ve açıklama tabanlı ses tasarımını destekliyor. Böylece referans kayıtları aramak yerine bir NPC'nin sesini düz metinle tarif edebilirsiniz. 0.6B ve 1.7B modelleri mütevazı donanımlarda çalışıyor. Chatterbox (Resemble AI), etkileyici sesler için öne çıkan seçenek ve MIT lisanslı olduğundan oyununuzla birlikte yayımlayabilirsiniz. Yaklaşık 5 saniyelik kayıttan bir sesi klonluyor, 200 ms'nin altında gecikmeyle çalışıyor, 23 dili destekliyor ve duygu abartma denetimine sahip ilk açık model; böylece bir NPC tekdüze konuşmak yerine gerçekten öfkeli veya korkmuş duyulabiliyor. İki Apache-2.0 seçeneği daha belirli kullanım alanlarını karşılıyor: Orpheus (Canopy), NPC repliklerine kolayca eşlenebilen <laugh> ve <sigh> gibi satır içi duygu etiketlerini kabul ediyor ve düşük donanımlı sistemler için 150M'lik bir sürüm sunuyor; Dia (Nari Labs) ise öksürük ve kahkaha gibi sözsüz sesleri de tek geçişte içeren çok konuşmacılı diyaloglar için geliştirildi. Mistral'ın Voxtral TTS modeli (Mart 2026), Mistral'ın haber sayfasına göre sesli aracılara yönelik, açık ağırlıklı daha yeni bir seçenek; ancak yayımlamadan önce lisansını okuyun.
Fish Speech ve OpenVoice ses klonlama işini üstleniyor. Bir seslendirme sanatçısından 10-30 saniyelik kayıt alın, ardından o sesle sınırsız diyalog üretin. Bunun ne anlama geldiğini düşünün: önemli replikler için seslendirme sanatçılarıyla çalışabilir, ardından performanslarını yüzlerce varyasyonu ve ortam diyaloğunu kapsayacak şekilde genişletebilirsiniz. Fish Speech için bir lisans notu: kod açık olsa da 1.5 ağırlıkları CC-BY-NC-SA lisanslıdır, dolayısıyla bu bir prototipleme aracıdır. Yayımlanacak oyunlarda bunun yerine OpenVoice (MIT) veya Qwen3-TTS (Apache 2.0) kullanın.
NVIDIA ACE (tamamen açık değil, ancak bilinmeye değer) artık cihaz üzerinde NPC çalıştırmak için Qwen3-8B'yi destekliyor. Yerel LLM + yerel TTS + dudak senkronizasyonu; hepsi tüketici sınıfı GPU'larda çalışıyor. Bulut çağrılarına ihtiyaç duymayan gerçek zamanlı NPC konuşmaları için uygun teknoloji yığını bu.
Bağımsız geliştiriciler için mantıklı yaklaşım şu: ana karakterler ve en önemli replikler için seslendirme sanatçılarıyla çalışın. Ortam diyaloglarını, varyasyonları ve aksi hâlde sessiz kalacak ya da aşırı pahalıya mal olacak tüm küçük replikleri kapsamak için Qwen3-TTS veya OpenVoice kullanın.
Dünya Modelleri ve Oyun Simülasyonu
İşlerin gerçekten tuhaf ve gerçekten heyecan verici hâle geldiği yer burası. Bu modeller statik varlıklar üretmiyor. Oyun hissi veren deneyimler üretiyorlar.
🎮 Oasis'i Oyna: Yapay Zekâyla Üretilen MinecraftOyun motoru olmadan, yalnızca yapay zekâ tahminiyle gerçek zamanlı dünya üretimi
| Model | Kuruluş | Yayımlanma | Ne Yapıyor | Durum | Kare başına maliyet |
|---|---|---|---|---|---|
| DIAMOND | Araştırma | 2024 | Difüzyon dünya modeli, Atari simülasyonu | Açık ağırlıklar | ~$0.001 |
| Oasis | Decart/Etched | Eki 2024 | Gerçek zamanlı Minecraft üretimi | 500M ağırlıkları açık | ~$0.002 |
| MineWorld | Microsoft | Nis 2025 | Gerçek zamanlı Minecraft, açık Oasis alternatifi | MIT | ~$0.002 |
| Hunyuan-GameCraft | Tencent | Ağu 2025 | Etkileşimli oyun videosu, klavye/fare denetimi | Tencent Community | ~$0.005 |
| GameGen-X | Araştırma | 2024 | Açık dünya video üretimi | Açık kod + veri kümesi | ~$0.005 |
| NVIDIA Cosmos | NVIDIA | Eki 2025 | Fiziksel yapay zekâ simülasyonu (Predict2.5) | NVIDIA Open Model License | ~$0.01 |
| Matrix-Game 3.0 | Skywork | Mar 2026 | Gerçek zamanlı 720p etkileşimli dünyalar, uzun vadeli bellek | Açık ağırlıklar | ~$0.005 |
| Genie 2 | DeepMind | Ara 2024 | Görsellerden etkileşimli 3D | Yayımlanmadı | Yok |
| Genie 3 | DeepMind | Ağu 2025 | Gerçek zamanlı 720p dünyalar, komutla tetiklenebilen olaylar | Kapalı (Project Genie) | Yok |
Araştırmalara göz atın: DIAMOND proje sayfası ↗ · Cosmos blogu ↗
Deneyin: Oasis canlı demosu ↗ · Genie 2 örnekleri ↗
Bunu neden önemsemelisiniz?
DIAMOND, oyun yapay zekâsı hakkındaki düşünme biçiminizi değiştiren bir şeyi kanıtladı. Bir aracıyı tamamen üretilmiş bir dünyanın içinde eğitebilirsiniz. Eğitim için gerçek bir oyun motoruna gerek yoktur. Yapay zekâ, bir difüzyon modelinin hayalinde oynar ve ardından öğrendiklerini gerçek oyuna aktarır. Bunun sonuçları oldukça önemli.
Oasis, Minecraft benzeri bir dünyayı gerçek zamanlı çalıştırıyor. Kare kare. Oyun motoru, dokular veya önceden hazırlanmış varlıklar yok. Yalnızca sırada ne olacağını tahmin eden bir transformer var. Bu bir kavram kanıtı, ancak nereye varabileceğini düşünün. 500M parametreli sürüm şimdiden açık.
GameGen-X, açık dünya oyun videoları için en büyük veri kümesini yayımladı. Kendi modellerinizi eğitmek veya mevcut modelleri oyun benzeri içerik üretmek üzere ince ayarlamak istiyorsanız başlangıç noktanız burası.
NVIDIA Cosmos, robotik ve otonom araçlar için geliştirildi ancak dünya temel modelleri oyunlarda da işe yarıyor. Fiziği, nesne sürekliliğini ve uzamsal ilişkileri anlıyorlar. Güncel açık seri, Ekim 2025'te ticari kullanıma ve türev çalışmalara izin veren NVIDIA Open Model License kapsamında yayımlanan Cosmos-Predict2.5'tir.
Hunyuan-GameCraft (Tencent, Ağustos 2025), doğrudan oyunlara en çok benzeyen açık dünya modelidir. 100'den fazla AAA oyundan alınmış bir milyondan fazla kayıtla eğitildi ve klavye ile fare girdilerini ortak bir denetim alanında birleştiriyor; böylece yalnızca izlediğiniz değil, gerçekten yönettiğiniz etkileşimli oyun videoları üretiyor. Hunyuan3D ile aynı Tencent Community License'ı ve dolayısıyla aynı AB, Birleşik Krallık ve Güney Kore kısıtlamalarını taşıyor; bu bölgelerde yayımlamadan önce koşulları kontrol edin. MineWorld (Microsoft, MIT), Oasis'in tamamen serbest muadilidir: indirip oyun motoru olmadan çalıştırabileceğiniz gerçek zamanlı bir Minecraft dünya modeli.
Genie 3 (DeepMind, Ağustos 2025'te duyuruldu), dikkat çekmeye değer sıçramadır: gerçek zamanlı etkileşime sahip ilk dünya modeli olarak birkaç dakika boyunca tutarlılığını koruyan, 24 fps'de gezilebilir 720p dünyalar üretiyor; ayrıca hava durumunu değiştiren veya komut üzerine nesneler ekleyen “komutla tetiklenebilir dünya olayları” sunuyor. Ocak 2026'da ABD'deki Google AI Ultra abonelerine Project Genie adıyla açıldı. Ağırlıkları hâlâ kapalı olsa da oynanabilir, üretilmiş dünyaların nereye doğru ilerlediğini gösteriyor.
Matrix-Game 3.0 (Skywork, Mart 2026), Genie'ye verilen açık yanıttır. Gerçek zamanlı olarak 40 fps'de 720p yayın yapan ve dakikalar süren diziler boyunca sahne tutarlılığını koruyan, bellek destekli etkileşimli bir dünya modelidir. Damıtılmış 5B sürümü gerçek zamanlı çıkarımı üstlenirken daha büyük 2x14B MoE sürümü kaliteyi yükseltiyor ve ağırlıklar Hugging Face'te Apache 2.0 kapsamında bulunuyor. DeepMind'i beklemek yerine bugün oynanabilir, üretilmiş dünyaları denemek istiyorsanız gerçekten indirebileceğiniz model bu.
Pratik oyun geliştirme açısından bunlar bugün hâlâ araştırma araçlarıdır. Ancak yapay zekâ destekli içerik, prosedürel üretim üzerinde çalışıyorsanız veya yalnızca tüm bunların nereye gittiğini düşünüyorsanız araştırmanın ön cephesi burasıdır.
Büyük Dil Modelleri
LLM'ler diyaloglara, görev üretimine ve oyun mantığına güç verir. Açık seçenekler artık GPT-4 ile gerçekten rekabet ediyor. İki yıl önce durum böyle değildi.
| Model | Kuruluş | Yayımlanma | Boyut | En Uygun Olduğu Alan | Lisans | 1.000 token başına maliyet |
|---|---|---|---|---|---|---|
| DeepSeek-V3 | DeepSeek | Ara 2024 | 671B MoE (37B etkin) | Akıl yürütme, genel kullanım | Serbest | ~$0.02 |
| DeepSeek-R1 | DeepSeek | Oca 2025 | V3 tabanlı | Düşünce zinciri | Serbest | ~$0.03 |
| DeepSeek-V3.2 | DeepSeek | Ara 2025 | Seyrek dikkat (DSA) | Akıl yürütme + araç kullanımı | MIT | ~$0.02 |
| DeepSeek-V4 | DeepSeek | Nis 2026 | 1.6T MoE (49B etkin) | Öncü akıl yürütme, 1M bağlam | MIT | ~$0.02 |
| GLM-5 | Zhipu / Z.ai | Şub 2026 | 744B MoE (40B etkin) | Kodlama, aracılı çalışma, araç kullanımı | MIT | ~$0.02 |
| GLM-5.2 | Zhipu / Z.ai | Haz 2026 | 753B MoE | Kodlama, aracılar, 1M bağlam | MIT | ~$0.02 |
| GPT-OSS | OpenAI | Ağu 2025 | 120B / 20B MoE | Akıl yürütme, araç kullanımı, cihaz üzerinde çalışma | Apache 2.0 | ~$0.01 |
| Kimi K2 | Moonshot | 2025 | 1T MoE (32B etkin) | Aracılı çalışma, kodlama | Değiştirilmiş MIT | ~$0.02 |
| Kimi K3 | Moonshot | Tem 2026 | 2.8T MoE (896 uzmandan 16'sı etkin) | Öncü aracılı çalışma, kodlama, 1M bağlam, görüntü | Kimi K3 License | ~$0.03 |
| Hy3 | Tencent | Tem 2026 | 295B MoE (21B etkin) | Akıl yürütme, aracılı kodlama, 256K bağlam | Apache 2.0 | ~$0.02 |
| Gemma 3 | 2025 | 1B-27B | Cihaz üzerinde çalışma, 140 dil, görüntü | Gemma | ~$0.01 | |
| Gemma 4 | Nis 2026 | E2B ile 31B arası (26B-A4B MoE) | Cihaz üzerinde çalışma, 140'tan fazla dil, görüntü + ses, 256K | Apache 2.0 | ~$0.01 | |
| Qwen3 | Alibaba | 2025 | 235B MoE (22B etkin) | Çok dillilik, kod | Apache 2.0 | ~$0.01 |
| Qwen3.5 / 3.6 / 3.8 | Alibaba | Şub-Ağu 2026 | 0.8B'den 2.4T-A95B'ye | Çok modlu, aracılı, Qwen-Max sınıfı açık amiral gemisi | Apache 2.0 | ~$0.02 |
| Mistral Small 4 | Mistral | Mar 2026 | 119B MoE (6B etkin) | Akıl yürütme + görüntü + aracılı kodlama, 256K | Apache 2.0 | ~$0.01 |
| Qwen3-Coder | Alibaba | 2025 | 480B MoE (35B etkin) | Aracılı kodlama, 256K bağlam | Apache 2.0 | ~$0.02 |
| Llama 4 | Meta | 2025 | Çeşitli | Aracılar, 10M'ye kadar bağlam | Llama Community | ~$0.01 |
| Muse Glimmer 30B | Meta | Ağu 2026 | ~30B yoğun | Cihaz üzerindeki aracılar, görüntü, 128K+ bağlam | Apache 2.0 | ~$0.01 |
| Qwen3-VL | Alibaba | 2025 | 2B-235B | Görüntü + dil | Apache 2.0 | ~$0.02 |
| InternVL3 | Shanghai AI Lab | 2025 | 1B-78B | Görüntü, OCR, kullanıcı arayüzü konumlandırma | MIT | ~$0.02 |
Başlayın: HuggingFace'te Qwen3-8B ↗ · HuggingFace'te DeepSeek-V3 ↗ · HuggingFace'te GLM-5 ↗
Oyun geliştirmek için
Qwen3, çoğu oyun kullanımında pratik seçimdir. Apache 2.0 lisansı sayesinde entegrasyonunuz size aittir. Yerelleştirmeyi düşünüyorsanız önemli olan güçlü çok dilli desteğe sahiptir. Yapılandırılmış talimatları takip etmede başarılıdır. 7B ve 14B sürümleri tüketici sınıfı GPU'larda yerel olarak çalışır.
Qwen3.5, 3.6 ve 3.8, Apache 2.0 serisini 2026 boyunca sürdürdü. Qwen3.5 (16 Şubat 2026), 397B-A17B MoE ile öne çıktı ve ardından yoğun 27B, 9B ve 4B sürümlerini sundu. Qwen3.6 (Nisan), aynı aileyi kararlılık için ayarladı ve 35B-A3B sürümü yerel kullanımın ideal noktasıdır: token başına yalnızca 3B etkin parametreyle 35B'lik bilgi sunar, dolayısıyla tek bir 24 GB kartta çok hızlı çalışır. Qwen3.8 (12-14 Ağustos 2026) büyük sürümdür; Qwen3.8 deposunda, 27B yoğun modelin yanında 2.4T-A95B amiral gemisi olarak açık yayıma sunulan ilk Qwen-Max sınıfı model şeklinde tanımlanır. Her ikisi de 262K bağlamla Apache 2.0 lisanslıdır.
DeepSeek-V3, çoğu kıyaslamada GPT-4 ile aynı seviyeye ulaşır veya onu geçer. Mimarisi zekice tasarlanmıştır: toplam 671B parametreye rağmen token başına yalnızca 37B parametre etkinleşir. Ciddi donanıma, yani birden fazla GPU'ya ihtiyacınız vardır ancak API bağımlılığı olmadan öncü düzeyde kalite sunar.
DeepSeek-V3.2 (Aralık 2025), akıl yürütmeyi ve araç kullanımını tek modelde birleştiriyor ve daha düşük maliyetli uzun bağlam çıkarımı için DeepSeek Sparse Attention'ı (DSA) sunuyor. En üst akıl yürütme kıyaslamalarını hedefleyen, yüksek hesaplama gereksinimli bir Speciale sürümü de bulunuyor. Oyun mantığı ve diyalog için V3'e kıyasla daha güçlü ve daha yetenekli bir aracılı alternatiftir.
DeepSeek-V4 (Nisan 2026), açık modellerin sınırını yeniden ileri taşıdı. V4-Pro, token başına yalnızca 49B'si etkin olan 1.6T parametreli bir MoE; 1 milyon tokenlık bağlam penceresine ve seçilebilir akıl yürütme modlarına sahip ve bunların tümü MIT lisansı altında. V4-Flash sürümü (toplam 284B, etkin 13B), tam bir GPU kümesi gerektirmeyen bir pakette 1M bağlamı koruyor. Bugün karmaşık görev mantığı veya uzun oyun durumu bağlamı için açık bir model seçiyorsanız ulaşılabilen en üst nokta burası.
GLM-5 (Zhipu AI, Şubat 2026), kodlama ve aracılı çalışmalar için yenilmesi gereken açık modeldir; GLM-5.2 yenilemesi de araç kullanımı ve uzun vadeli planlama puanlarını kapalı modellerin öncü seviyesine yaklaştırdı. Token başına 40B'si etkin olan 744B parametreli bir MoE, 200K tokenlık bağlam ve MIT lisansı sunuyor. GLM-5.2, 17 Haziran 2026'da 1M tokenlık bağlama sahip 753B MoE olarak yayımlandı; bölgesel kısıtlama olmadan MIT lisansını korudu. Aynı taban üzerinde eğitim sonrası yenileme olan GLM-5.3 ise daha sonra ağırlıkları Hugging Face'te, MIT yerine Z.ai'ın kendi GLM-5.3 lisansı altında yayımlanarak geldi; bu nedenle en yeni sürümü kendiniz barındıracaksanız lisans metnini kontrol edin. Z.ai, halka açık ilk temel model şirketidir ve barındırılan API'sini oldukça rekabetçi biçimde fiyatlandırır (bir milyon girdi tokenı başına yaklaşık $1.40); ancak kendiniz barındırmayı tercih ederseniz ağırlıklar Hugging Face'te bulunuyor. Oyununuz görev betikleme, araç çağıran aracılar veya kodla çalışan sistemler için bir LLM'e dayanıyorsa GLM-5, tamamen denetiminizde olan güçlü bir OpenAI alternatifidir. GPT-OSS (OpenAI, Ağustos 2025), OpenAI'ın ilk açık ağırlıklı model sürümüdür ve bu rehberin temasına tam olarak uyar. gpt-oss-120b modeli, tek bir 80 GB GPU üzerinde yaklaşık o4-mini seviyesinde akıl yürütür ve araç çağırır; gpt-oss-20b ise 16 GB'lık bir tüketici ekran kartında çalışır. Her ikisi de Apache 2.0 lisanslıdır. NPC mantığı veya araç kullanan ajanlar için kendi sunucunuzda barındırabileceğiniz Batılı bir laboratuvar modeli istiyorsanız aradığınız model budur.
Kimi K2 (Moonshot), GLM-5 ve DeepSeek'in yanında yer alan diğer açık ajan tabanlı ağır sıklettir. 32B aktif parametreye sahip, 1 trilyon parametreli bir MoE modelidir; kodlama ve araç kullanımı için yoğun biçimde ayarlanmıştır. Değiştirilmiş MIT lisansı yalnızca aylık 100 milyon kullanıcıyı aşan ürünlere kısıtlamalar eklediğinden bağımsız geliştiriciler için fiilen MIT lisanslıdır. Bir ajanın çok sayıda adımı kapsayan planlar yapması gerektiğinde bunu tercih edin.
Kimi K3 (Moonshot, Temmuz 2026), şimdiye kadar duyurulmuş en büyük açık ağırlıklı modeldir ve kendisinden önceki tüm açık modellerden daha fazla kapalı model cephesine yaklaşır. Token başına yalnızca yaklaşık 50B aktif parametreye (896 uzmandan 16'sı), 1M token bağlama ve yerel görüntü desteğine sahip, 2,8 trilyon parametreli bir MoE modelidir. Kimi Delta Attention ve Attention Residuals adlı iki yeni dikkat tasarımı üzerine kurulmuştur. Moonshot'ın temmuz ayındaki testlerinde, kodlama ve ajan tabanlı görevlerde dönemin Claude Opus ve GPT-5.5 sürümlerini geride bırakıp yalnızca en üst düzey tescilli modellerin gerisinde kalıyordu; ancak bu hedefler eylül ayında Claude Fable 5.1 ve GPT-6 Astra ile yeniden ileri taşındı. Ağırlıklar 27 Temmuz 2026'da MXFP4 biçiminde, MIT yerine Kimi K3 Lisansı altında Hugging Face'e yüklendi. Çoğu kullanım için izin vericidir; ancak herhangi bir 12 aylık dönemde geliri $20 milyonu aşan bir hizmet olarak model işletmesinin Moonshot ile ayrı bir anlaşma yapması gerekir. Aylık 100 milyondan fazla kullanıcısı veya aylık $20 milyondan fazla geliri olan ürünlerin de arayüzde "Kimi K3" ibaresini göstermesi gerekir. 2,8T parametreli bir modeli kendi sunucunuzda barındırmak hâlâ çok düğümlü bir GPU kümesi gerektirir; bu nedenle çoğu ekip modele API üzerinden, milyon giriş tokenı başına $3 ve milyon çıkış tokenı başına $15 karşılığında erişecektir. Gerçekten kendiniz çalıştırabileceğiniz ajanlar için K2, Moonshot'ın pratik seçeneği olmaya devam ediyor; ancak K3, üst düzeyde "açık" kavramının ne anlama gelebileceğini yeniden tanımlıyor.
Gemma 3 (Google), oyuncunun donanımında çalıştırmanız veya geniş ölçekte yerelleştirmeniz gerektiğinde en uygun seçenektir. 1B, 4B, 12B ve 27B boyutlarında sunulduğundan 8 GB'lık bir ekran kartından başlayarak ölçeklenir, 140 dili destekler ve fonksiyon çağrısı yapar. 4B ve üzeri sürümleri görüntüleri de işleyebildiği için küçük bir görüntü modeli olarak da kullanılabilir. Gemma lisansı ticari kullanıma izin verir.
Gemma 4 (Google, 2 Nisan 2026), yeni projelerde onun yerini alıyor ve lisans meselesini kesin olarak çözüyor: model kartına göre ailenin tamamı Apache 2.0 lisanslıdır. Telefonlar ve dizüstü bilgisayarlar için E2B ve E4B, bir 12B, 4B'den az aktif parametreye sahip bir 26B-A4B MoE ve yoğun bir 31B modeliyle sunulur. Küçük modellerde 128K, geri kalanlarda 256K bağlam; tüm boyutlarda yerel görüntü girişi, küçük modellerde ses desteği ve 140'tan fazla dil sunar. Ekran görüntüsüne de bakması gereken cihaz içi bir NPC beyni için 26B-A4B doğru seçimdir.
Meta'nın Llama serisi fiilen duraklatılmış durumda. Llama 4 (Nisan 2025) hâlâ son Llama'dır ve Nisan 2026'da Meta Superintelligence Labs, onun halefi Muse Spark'ı kapalı bir model olarak piyasaya sürdü. Meta, Ağustos 2026'da 128K+ bağlama sahip ve 24 GB'lık bir karta sığan 4 bitlik derlemeleri bulunan, Apache 2.0 lisanslı, yaklaşık 30B parametreli yoğun çok modlu bir model olan Muse Glimmer 30B ile kısmen geri döndü. Güçlü bir yerel ajan modelidir; ancak Llama 5'i bekliyorsanız artık beklemeyi bırakın ve onun yerine Qwen, Gemma 4 veya Glimmer arasından seçim yapın.
Hy3 (Tencent, Temmuz 2026), Apache 2.0 lisanslı diğer büyük yeniliktir. Model kartına göre 21B aktif parametreye ve 256K bağlama sahip bir 295B MoE modelidir. Temmuz sürümü, nisan önizlemesindeki bölgesel kısıtlamaları kaldırdı; dolayısıyla Tencent'ın Hunyuan3D ve GameCraft lisanslarının aksine AB, Birleşik Krallık ve Güney Kore'de kullanılabilir.
Qwen3-Coder (Alibaba), çoğu kullanımda eski DeepSeek-Coder serisinin yerini alan, kodlamaya özel açık modeldir. 35B aktif parametreye ve 256K yerel bağlama sahip (1M'ye genişletilebilir), Apache 2.0 lisanslı bir 480B MoE modelidir ve ajan tabanlı kodlama testlerinde Claude-Sonnet sınıfındadır. Oyununuz kod üretiyor veya çalıştırıyorsa açık modellerde ulaşılabilecek en üst seviye budur. Avrupa'nın Mistral ailesi, kendi sunucunuzda barındırabileceğiniz sağlam bir alternatiftir: kodlama için Devstral ve akıl yürütme, görüntü ve ajan tabanlı kodlamayı 256K bağlamlı tek bir Apache 2.0 modelinde birleştiren, 6B aktif parametreye sahip 119B MoE modeli Mistral Small 4 (16 Mart 2026).
Qwen3-VL, Apache 2.0 kapsamında 2B'den 235B'ye kadar yoğun ve MoE boyutlarıyla görüntü anlama yeteneği ekler. Ekran görüntülerini analiz etmesi, oyuncuların çizdiği içerikleri anlaması veya kamera girdisini işlemesi gereken oyunlar için kullanışlıdır. 8B sürümü tek bir GPU'da çalışır. InternVL3 (Shanghai AI Lab, MIT), özellikle OCR ve kullanıcı arayüzünde konumlandırma konusunda başarılı olan diğer güçlü açık görüntü-dil seçeneğidir; araçlarınızın oyun arayüzlerini okuması gerekiyorsa bu önemlidir. Mistral'ın Pixtral 12B modeli (Apache 2.0) ise ticari kullanım açısından güvenli ve daha hafif bir seçenektir.
Bulut çağrıları olmadan gerçek zamanlı yanıt veren cihaz içi NPC'ler ve karakterler için şu anda en pratik yol, NVIDIA ACE üzerinden Qwen3-8B kullanmaktır. Oyununuzla birlikte oyuncunun donanımında çalışır.
Yardımcı Modeller
Bunlar doğrudan içerik üretmez, ancak iş akışlarınızın çalışmasını sağlar.
SAM 2, görüntü ve videolardaki her nesneyi segmentlere ayırır. Bir kez tıklayın, kusursuz bir maske elde edin
| Model | Kuruluş | Yayınlanma | Yaptığı İş |
|---|---|---|---|
| SAM 2 | Meta | Ağu 2024 | Görüntü ve videolardaki her şeyi segmentlere ayırır |
| Depth Pro | Apple | Eki 2024 | Tek bir görüntüden metrik derinlik üretir |
| gsplat | Nerfstudio | 2024+ | CUDA hızlandırmalı Gaussian splatting |
SAM 2, videodaki nesneleri gerçek zamanlı olarak segmentlere ayırır. Bir şeye tıklayın ve kusursuz bir maske elde edin. Rotoskopi, kompozitleme veya görüntülerden oyun varlığı olarak kullanılacak nesneleri çıkarmak için kullanışlıdır. SAM 2'yi deneyin ↗
Apple'ın Depth Pro modeli, tek görüntülerden bir saniyeden kısa sürede metrik derinlik haritaları üretir. Bu da pek çok olanağın önünü açar: 2D çizimleri paralaks efektleriyle 2.5D'ye dönüştürmek, 3D yeniden yapılandırma için derinlik verileri üretmek ve düz görüntülerden normal haritalar oluşturmak. HuggingFace'te Depth Pro ↗
gsplat, Gaussian splatting'in hızlı uygulamasıdır. İster fotogrametri ister ortam taramalarıyla oyunlar için gerçek ortamlar yakalıyor olun, bunu uygulanabilir hâle getiren kütüphane budur.
Gerçekte Ne Kullanırdım?
Bugün bir oyun projesine başlıyorsanız mantıklı teknoloji yığını şöyle:
Dokular ve sprite'lar: FLUX.1 [schnell], Apache 2.0, hızlı yineleme, yayınlanabilir kalite
Konsept çizimleri: Stil kontrolü için LoRA'larla SD 3.5 Large
3D varlıklar: Dokulu mesh'ler için Hunyuan3D 2.1 veya TRELLIS.2; bir fotoğraftan başlıyorsanız SAM 3D, ardından temizlik için Blender
Otomatik rigleme: Mixamo'ya güvenmek yerine oluşturulan mesh'lere iskelet ve skin eklemek için UniRig veya NVIDIA SOMA-X (ikisi de açık)
Ses efektleri: Stable Audio'nun açık Small-SFX modeli; yerel olarak çalışır ve ticari kullanım lisansına sahiptir
Müzik: Prototipler için ACE-Step, ardından nihai prodüksiyon için bir besteciyle çalışın
Seslendirme: Ses klonlama ve ortam diyalogları için Qwen3-TTS (Apache 2.0), bir repliğin gerçek duyguya ihtiyaç duyduğu durumlarda Chatterbox (MIT), önemli replikler için seslendirme sanatçıları
NPC diyalogları: Yerel olarak Qwen3.6-35B-A3B, Gemma 4 26B-A4B veya Muse Glimmer 30B; karmaşık akıl yürütme ve araç kullanımı için kendi sunucunuzda barındırılabilen bir bulut LLM'si (GLM-5.2, DeepSeek-V4 veya Kimi K3)
Video (ara sahneler): Yerel olarak Mochi 1 veya Wan 2.2 5B; nihai kalite gerektiğinde bulutta LTX-2.5 veya HunyuanVideo-1.5
Tüm bunlarla ilgili asıl mesele şu: yaygın hata, yapay zekâyı her şey için kullanmaya çalışmaktır. Bunlar ikame değil, araçtır. Yineleme, varyasyonlar ve geçici varlıklar gibi zahmetli kısımları kısaltırlar; böylece zamanınızı gerçekten önemli olan yaratıcı kararlara ayırabilirsiniz. Oyununuzu size özgü kılan kısımlara.
Donanım Gerçeklik Kontrolü
Bunları çalıştırmak için gerçekte neye ihtiyacınız olduğu konusunda dürüst olalım:
8 GB VRAM (RTX 3060, 4060): SD 1.5/SDXL, Wan 2.1 small, AudioGen, Fish Speech, küçük LLM'ler (7B kuantize). Bu, oyuncu dizüstü bilgisayarı seviyesidir ve başlangıç için yeterlidir.
12 GB VRAM (RTX 3080, 4070): SD 3.5, FLUX schnell, Mochi 1, MusicGen, TripoSR, Qwen 14B kuantize. İşlerin rahatlamaya başladığı seviye budur. Kullanışlı modellerin çoğu burada çalışır.
24 GB VRAM (RTX 3090, 4090): Modellerin çoğu tam hassasiyette, InstantMesh, daha büyük LLM'ler ve 2026 yerel ajan sınıfı: Qwen3.6-35B-A3B, 4 bit Gemma 4 31B, 4 bit Muse Glimmer 30B. Bu iş akışını ciddi biçimde kullanacaksanız ideal noktadır.
48-80 GB VRAM (A100, H100): HunyuanVideo, LTX-2, DeepSeek-V3, prodüksiyon ölçeğinde üretim. Kurumsal donanım. Bunu satın almaz, kiralarsınız.
RunPod, Lambda Labs veya Modal'daki bulut sunucularında A100'lerin maliyeti saatte $2-4'tır. Ara sıra kullanım için bu, donanım satın almaktan daha ucuzdur. Nihai kaliteye ihtiyacınız olduğunda sunucuyu başlatın, işiniz bitince kapatın.
Bu rehberdeki maliyet tahminleri hakkında: Üretim başına maliyetler, bulut GPU'larında saati yaklaşık ~$2-3 (A100) veya yaklaşık ~$0.40 (RTX 4090) olan, kendi sunucunuzda barındırılan çıkarım işlemlerini varsayar. Gerçek maliyetler donanıma, optimizasyona ve toplu işlem boyutlarına göre değişir. Bunlar planlama için yaklaşık rakamlardır; dolayısıyla sizin sonuçlarınız farklılık gösterebilir.
2026'daki Yenilikler
Yakın zamanda yayınlananlar: LTX-2 ve LTX-2.3, yerel 4K desteğiyle açık ve senkronize ses-video üretimi getirdi. Microsoft'ın TRELLIS.2 modeli (Aralık 2025), açık görüntüden 3D'ye dönüşümün lideri oldu; Meta'nın SAM 3D modeli (Kasım 2025) ise tek fotoğraftan 3D yeniden yapılandırmayı uygulanabilir hâle getirdi. Görüntü üretiminde FLUX.2, FLUX.1'in yerini aldı ve NVIDIA'nın SOMA-X modeli açık otomatik rigleme ile yeniden hedeflemeyi kullanıma sundu. 2026'nın ilk yarısında da tempo düşmedi: Qwen3-TTS (Ocak), ses klonlamaya gerçek bir Apache 2.0 yuvası kazandırdı; Zhipu'nun GLM-5 modeli (Şubat), MIT lisansı altında 744B parametreli açık bir kodlama ve ajan modeli sundu; Skywork'ün Matrix-Game 3.0 modeli (Mart), gerçek zamanlı ve etkileşimli bir dünya modelini açık ağırlıklarla yayınladı; DeepSeek-V4 (Nisan), MIT lisansı altında açık LLM'leri 1M token bağlama taşıdı; Stable Audio 3.0 (Mayıs), lisanslı verilerle eğitilmiş üç açık ses modeli yayınladı ve Ideogram ilk açık ağırlıklı görüntü modelini (Haziran) çıkardı. Ardından temmuz ayında Moonshot, 2,8T parametreli açık ağırlıklı Kimi K3'ü duyurdu ve ağırlıkları 27 Temmuz'da Kimi K3 Lisansı altında yayınlandı. Aynı ay Tencent, 295B parametreli Hy3'ü Apache 2.0'a geçirdi; bundan birkaç hafta önce Z.ai, GLM-5.2'yi MIT lisansı altında yayınlamıştı (17 Haziran). Ağustos ayı da açık modeller açısından yoğundu: Alibaba, Qwen3.8'i (2,4T-A95B amiral gemisi ve 27B yoğun model, Apache 2.0) yayınladı; Meta, Muse Glimmer 30B'yi Apache 2.0 kapsamında sundu; MiniMax, 33B parametreli H3 video ağırlıklarını açtı ve Lightricks, LTX-2.5'i yayınladı. Yılın önceki döneminde Google'ın Gemma 4'ü (Nisan, Apache 2.0) ve Mistral Small 4 (Mart, Apache 2.0), cihaz içi model sınıfını yeniden tanımlamıştı.
İzlenmesi gereken eğilim: En üst düzey laboratuvarlar, önceki sürümleri açık olsa bile en yeni modellerini giderek daha fazla yalnızca API üzerinden sunuyor. Wan, 2.5 sürümünde kapandı ve 3.0'a (Ağustos 2026) kadar kapalı kaldı; Qwen-Image 2.0'da, Hunyuan3D ise 2.5'te kapandı. Meta'nın Llama halefi Muse Spark, daha küçük Muse Glimmer ağustos ayında yeniden açılmadan önce Nisan 2026'da kapalı olarak piyasaya sürüldü. Black Forest Labs, FLUX 3'ü önce API'si üzerinden sunuyor ve açık FLUX 3 Dev'i 2026'nın ilerleyen dönemleri için vaat ediyor. Skywork ise şubat ayında ağırlıkları yayınlamadan SkyReels V4'ü duyurdu. Açık ekosistem hâlâ canlı ve hızla gelişiyor; ancak "en yeni sürüm açıktır" varsayımı artık güvenli değil. Bu nedenle bir model üzerine iş akışı kurmadan önce ağırlıkların erişilebilirliğini kontrol edin.
Gidişat açık: kapalı modellerde bulunan her yetenek, 6-12 ay sonra açık modellerde ortaya çıkıyor. Soru, açık modellerin yeterince iyi olup olmayacağı değil. Çoğu kullanım için zaten yeterince iyiler. Asıl soru, ne kadar hızlı varsayılan seçenek hâline gelecekleri.
Bunun üreticiler için anlamı şu: Eskiden kurumsal bütçeler veya aylık abonelikler gerektiren araçlar artık basitçe... çalıştırabileceğiniz şeylere dönüşüyor. Kendi donanımınızda. Başka hiç kimseden izin almadan.
Değişim bu. Ulaşmaya çalıştığımız şey bu.
Sık Sorulan Sorular
Oyun varlıkları üretmek için en iyi açık kaynaklı yapay zekâ modeli hangisidir?
Varlık türüne bağlıdır. 3D modeller için Hunyuan3D, 2026'nın en güçlü açık seçeneğidir. 2D çizimler ve dokularda kalite açısından FLUX öndedir. Ses efektleri ve müzikte ise açık ses modelleri arayı hızla kapattı. Oyunlar çok sayıda varlık türüne ihtiyaç duyduğu için tek bir "en iyi" model yoktur; bu nedenle çoğu üretici tek bir modele güvenmek yerine birkaç modeli zincir hâlinde kullanır.
Açık kaynaklı yapay zekâ modelleri kapalı API'lerin yerini alacak kadar iyi mi?
2026'da oyun varlığı çalışmalarının çoğu için evet. Açık modeller artık görüntü, 3D ve ses üretiminde kapalı API'lerle aynı seviyeye ulaşıyor. Ayrıca bunları çağrı başına ücret veya beklenmedik fiyat değişiklikleri olmadan kendi donanımınızda çalıştırabilirsiniz. Kapalı modeller, uzun biçimli video gibi birkaç öncü görevde hâlâ önde; ancak aradaki fark genellikle 6 ila 12 ay içinde kapanıyor.
Bu üretken yapay zekâ modellerini kendi GPU'mda çalıştırabilir miyim?
Birçoğunu evet. Görüntü ve ses modelleri, RTX 4090 gibi tek bir tüketici GPU'sunda rahatça çalışır. Daha büyük video ve 3D modelleri daha fazla VRAM ister ve çoğu zaman A100 sınıfı bir bulut GPU'suna ihtiyaç duyar. Yukarıdaki donanım bölümü, işe girişmeden önce planlama yapabilmeniz için her modelin neye ihtiyaç duyduğunu listeler.
2026'nın en iyi açık kaynaklı frontier modeli hangisi?
Eylül 2026 itibarıyla açık frontier modeller arasındaki yarış dört model arasında geçiyor ve yanıt, hangi modeli çalıştırabildiğinize bağlı. Kimi K3 (2.8T MoE) en büyük model ve kapalı liderlere en yakın puanları alıyor, ancak Kimi K3 Lisansı büyük hizmet olarak model işletmeleri için ek koşullar getiriyor. DeepSeek-V4-Pro (1.6T, 49B aktif) ve Qwen3.8-2.4T-A95B bu ölçekte sırasıyla MIT ve Apache 2.0 ile en temiz lisanslara sahip. GLM-5.2 (753B, MIT) ise kodlama ve ajan görevlerinde uzman. Bunların hiçbiri tek bir GPU'ya sığmıyor; dolayısıyla kendi altyapınızda barındıracağınız modeller arasında gerçek anlamda "en iyi" seçenekler bir alt kademede: Qwen3.6-35B-A3B, Gemma 4 31B veya Muse Glimmer 30B.
Açık ve kapalı en iyi frontier görüntü üretme modelleri hangileri?
Açık: Ticari kullanıma uygun oyun görselleri için FLUX.2 [klein] 4B (Apache 2.0, bir saniyeden kısa sürede üretim), okunabilir metne ihtiyaç duyduğunuzda Qwen-Image-2512 (Apache 2.0), lisansı kullanımınıza uygunsa en yüksek kalite için FLUX.2 [dev] veya Chroma1-HD. Kapalı: FLUX.2 [pro] ve yalnızca API üzerinden sunulan Qwen-Image-2.0'ın yanı sıra, Kling'in kılavuzuna göre en fazla 10 referans görüntü destekleyen Kling IMAGE 3.0 ve xAI'ın Grok Imagine Image 2.0 modeli gibi 2026'da çıkan seçenekler. FLUX 3'ün görüntü modeli şimdilik BFL'nin API'sinin arkasında bulunuyor; açık bir Dev sürümünün ise 2026'nın ilerleyen dönemlerinde yayımlanacağı vaat ediliyor. Oyun geliştirme için açık modeller zaten yeterince iyi olduğundan kapalı modeller çoğunlukla kullanım kolaylığı sağlıyor.
Hangi açık ağırlıklı video modelleri tam ticari dağıtıma izin veriyor ve hangi lisansları kullanıyor?
Gelir sınırı olmadan kurumsal ölçekte ticari olarak dağıtabileceğiniz açık bir video modeline ihtiyacınız varsa güvenli seçenekler Wan 2.2 (5B ve 14B MoE varyantları dâhil Apache 2.0), Mochi 1 (Apache 2.0), Step-Video-T2V (MIT) ve CogVideoX 2B'dir (Apache 2.0). LTX-2 ve LTX-2.5, yıllık geliri $10M altında olan işletmeler için ticari kullanıma ücretsizdir; bu eşiğin üzerinde ise ücretli bir anlaşma gerektirir. Bu, Lightricks'in gerçekten sunduğu "erişim satın alma" yoludur. MiniMax H3, MiniMax H3 Topluluk Lisansı kapsamında açıktır ancak ABD, AB, Birleşik Krallık ve Güney Kore'deki kullanıcıların önce başvurmasını ister. HunyuanVideo ise bölgesel istisnalar içeren Tencent topluluk lisansını kullanır; bu nedenle karar vermeden önce her iki lisansı da okuyun. Wan 2.5'ten 3.0'a kadar olan sürümlerin, Veo'nun, Kling'in ve Seedance'in herkese açık ağırlıkları yoktur. Referans video modelleri kılavuzumuz, barındırılan seçenekleri karşılaştırıyor.
2026'da oyun varlıkları ve ortamları için hangi üretken yapay zekâyı kullanmalıyım?
Tek bir model aramak yerine birkaç uzman modeli zincirleyin. Nesneler ve karakterler için FLUX.2 klein veya Qwen-Image ile oluşturduğunuz bir konsepti Hunyuan3D 2.1 ya da TRELLIS.2 üzerinden geçirin ve UniRig ile rigleyin. Ortamlar için bir skybox veya HDRI üretin (skybox oluşturucumuz bunu tarayıcıda yapar), araziyi prosedürel yöntemlerle ya da arazi üretme kılavuzumuzda gösterildiği gibi bir difüzyon geçişiyle oluşturun ve yapay zekâ doku oluşturucuları kılavuzumuzda ele alındığı üzere bir görüntü modeli ile PBR çıkarıcı kullanarak dokulandırın. Ses efektleri Stable Audio 3.0 Small-SFX'ten, müzik ACE-Step'ten, seslendirmeler ise Qwen3-TTS veya Chatterbox'tan gelebilir. Eylül 2026 itibarıyla bu zincirdeki her model açık ve ticari kullanıma uygundur.
2026'da yerel olarak çalıştırılabilecek en iyi LLM hangisi?
Önce VRAM kapasitenize göre seçim yapın. 8GB için Qwen3.5-4B veya Gemma 4 E4B. 16GB için gpt-oss-20b (Apache 2.0, 16GB için tasarlandı) veya Gemma 4 12B. 24GB için çoğu kişinin çalıştırması gereken çok yönlü model Qwen3.6-35B-A3B'dir; görsel destekli ajan görevleri için 4 bit Muse Glimmer 30B, en güçlü yoğun modeli istediğinizde ise kuantize Gemma 4 31B kullanılabilir. Bunun üzerinde DeepSeek-V4-Flash (284B, 13B aktif), bir iş istasyonunda 1M token bağlam elde etmenin en küçük yoludur. Bu modellerin tümü Apache 2.0 veya MIT lisanslıdır ve Ollama ya da LM Studio her birini tek komutla çalıştırabilir.
Yapay zekâyla üretilmiş varlıkları ticari bir oyunda kullanmak yasal mı?
Kendi çalıştırdığınız açık kaynaklı modeller için genellikle evet, ancak bu durum modelin lisansına ve eğitim verileriyle ilgili varsayımlarınıza bağlıdır. Her zaman ilgili modelin lisansını kontrol edin ve platformunuz gerektiriyorsa yapay zekâyla üretilmiş içerikleri açıklayın. Bu konuyu nasıl ele aldığımızı öğrenmek için yapay zekâyla üretilmiş içerik politikamıza bakın.
Ek Okumalar
- Yapay zekâ tartışmaları, güven ve yapay zekâ sonrası ekonomi: oyunlarda yapay zekâ konusundaki yaklaşımımız
- Yapay zekâyla üretilmiş içerik politikası: yapay zekâ kullanımını nasıl açıkladığımız
- Referans Görüntü Desteğine Sahip En İyi Yapay Zekâ Video Modelleri: barındırılan video modellerinin karşılaştırması
- En İyi Yapay Zekâ 3D Model Oluşturucuları: barındırılan Meshy, Tripo ve Rodin ile açık modellerin karşılaştırması
- 2026'da Web Oyunları Teknoloji Yığını: oyunlar için WebGL, WebGPU ve Wasm
- Tarayıcıda 3D Açık Dünya Teknolojileri: yapay zekâyla üretilmiş 3D varlıkları tarayıcı dünyalarında kullanma
- Tarayıcı Tabanlı Açık Dünyalar İçin Arazi Üretimi: difüzyon tabanlı arazi sentezi
- Ücretsiz Oyun Varlıkları Nerede Bulunur?: yapay zekâyla üretimin yanında geleneksel varlık kaynakları
- Ajan tabanlı yapay zekâ kodlama araçları: yalnızca varlık üretmek için değil, oyun kodu yazmak için de yapay zekâ
Üretim modellerinin çıktıları oynanabilir olduğunda daha eğlencelidir.