Yapay zeka sunucusu, makine öğrenmesi modellerinin eğitildiği (training), ince ayar yapıldığı (fine-tuning) ve çalıştırıldığı (inference) GPU donanımlı bir sunucudur. Saatlik faturalanan bulut GPU'ları uzun süreli işlerde hızla pahalılaşır; kendi kiralık GPU sunucunuzda sabit maliyetle 7/24 deney yaparsınız.
Hangi AI İş Yükleri Çalışır?
LLM Çalıştırma (Inference)
Llama, Mistral, Qwen gibi açık modelleri Ollama veya vLLM ile kendi sunucunuzda barındırırsınız. Verileriniz üçüncü taraf API'lere gitmez; KVKK hassasiyeti olan kurumlar için kritik avantajdır.
Fine-Tuning ve Eğitim
LoRA/QLoRA ile açık modelleri kendi verinizle özelleştirebilir, klasik ML modellerinizi (PyTorch, TensorFlow) GPU hızında eğitebilirsiniz. İnce ayar ve eğitim, çıkarıma göre belirgin şekilde daha fazla VRAM ister; vGPU paketlerimiz 3 GB VRAM'e kadar çıkar ve bu üst sınırdır; daha büyük modellerin eğitimi için kendi ekran kartınızı barındırabileceğiniz fiziksel sunucu kiralamanız gerekir.
Görüntü ve Ses
Whisper ile ses tanıma, görsel ön işleme ve video analiz hatları standart paketlerde verimli çalışır. Stable Diffusion ve özellikle Flux gibi görsel üretim modelleri ise tipik olarak 6 GB ve üzeri VRAM ister; vGPU paketleri bu seviyeyi karşılamaz, fiziksel sunucu kiralamak gerekir.
Donanım Neden Önemli?
AI iş yüklerinde üç darboğaz vardır: GPU VRAM'i (model boyutunu belirler), sistem RAM'i ve disk hızı (veri kümelerinin yükleme hızı). Sunucularımız RTX 6000 sınıfı GPU'lar, DDR5 RAM ve Gen4/Gen5 NVMe disklerle bu üç darboğazı birden çözer. Kabaca ölçü olarak 7 milyar parametreli modeller 8-16 GB, 70 milyar parametreli modeller quantization ile yaklaşık 48 GB VRAM ister. vGPU paketlerimiz 512 MB ile 3 GB VRAM arasındadır ve küçük model çıkarımı ile GPU hızlandırmalı işler için tasarlanmıştır. 3 GB bizim üst sınırımızdır; daha yüksek VRAM gereken projelerde kendi ekran kartınızı takabileceğiniz fiziksel sunucu kiralama yolu izlenir.
Bulut API mi, Kendi Sunucunuz mu?
Düşük hacimli kullanımda hazır API'ler pratiktir; ancak sürekli inference, veri gizliliği gereksinimi veya yoğun deney süreci varsa kendi GPU sunucunuz hem daha ekonomik hem daha kontrollüdür. Sabit aylık maliyetle sınırsız istek işlersiniz.
Saatlik bulut GPU maliyetlerine takılmadan, sabit fiyatlı GPU sunucunuzla dilediğiniz kadar deney yapın.
Yapay Zeka İş Yükleri İçin Paketler ve Fiyatlar
Aşağıdaki paketler RTX 6000 üzerinden ayrılmış vGPU dilimleridir. VRAM 3 GB ile sınırlı olduğu için büyük dil modellerinin eğitimi (training) veya 7 milyar parametre üzeri modellerin çalıştırılması bu paketlerle mümkün değildir; küçük model çıkarımı ve GPU hızlandırmalı işler için uygundur. Giriş paketi 512 MB VRAM ile yapay zeka iş yüklerine yetmediği için listeye alınmamıştır.
| Paket | vCPU / RAM | GPU / VRAM | Önerilen Kullanım | Aylık | |
|---|---|---|---|---|---|
| vGPU Pro | 4 Core / 8 GB | 1 GB VRAM | Gömme (embedding) modelleri, konuşma tanıma, görsel ön işleme | 1.861,20 TL | Satın Al |
| vGPU Max | 6 Core / 12 GB | 2 GB VRAM | Küçük dil modelleri (1-3B) ile çıkarım, görsel iyileştirme | 2.568,46 TL | Satın Al |
| vGPU Ultra | 8 Core / 16 GB | 3 GB VRAM | Sürekli çalışan çıkarım servisleri, API arkası GPU işleri | 3.350,16 TL | Satın Al |
Tüm GPU seçeneklerini GPU sunucu kiralama sayfasından karşılaştırabilirsiniz. Büyük model eğitimi ve 3 GB üzeri VRAM gerektiren projeler vGPU paketleriyle çalışmaz; bu iş yükleri için fiziksel sunucu kiralama gerekir. Fiyatlar aylık ödemeye aittir ve KDV hariçtir. Tüm paketlerde 1 Gigabit hat, sınırsız trafik ve tam root yetkisi bulunur; kurulum ücretsizdir. Tüm Ryzen VDS paketlerini karşılaştırabilir, ihtiyacınızı sunucu gereksinim hesaplayıcısıyla belirleyebilirsiniz.
Sık Sorulan Sorular
Hangi GPU'lar mevcut?
Standart paketlerimiz RTX 6000 sınıfı kartlardan ayrılmış 512 MB ile 3 GB arasında vGPU dilimleri sunar. 3 GB bizim vGPU üst sınırımızdır; daha yüksek VRAM gereken iş yükleri için fiziksel sunucu kiralayıp kendi ekran kartınızı barındırmanız gerekir.
CUDA ve sürücüler kurulu geliyor mu?
Talebinize göre NVIDIA sürücüleri, CUDA ve Docker (nvidia-container-toolkit) kurulu teslim edebiliriz.
70B model çalıştırabilir miyim?
vGPU paketlerimizle hayır; bu paketlerde en fazla 3 GB VRAM verilir. 70 milyar parametreli bir model quantized (GGUF/AWQ) hâlde bile yaklaşık 48 GB VRAM ister, tam hassasiyette ise çoklu GPU gerekir. Bu ölçekte bir iş yükü için fiziksel sunucu kiralayıp kendi ekran kartınızı barındırmanız gerekir.
Verilerim güvende mi?
Sunucu tamamen size aittir; verileriniz üçüncü taraf API'lere gitmez, Tier III veri merkezinde Türkiye'de barındırılır.
Saatlik mi aylık mı?
Aylık sabit fiyatla sunulur; uzun eğitim ve sürekli inference senaryolarında saatlik bulut GPU'lardan belirgin şekilde ekonomiktir.
