Araçlar Merkezi
VRAM hesabından maliyet karşılaştırmasına, hız yarışından model önerisine, yerel AI kararlarınız için ihtiyacınız olan her şey burada. Hesap açmaya, kurulum yapmaya gerek yok.
Öğren rehberlerinden gelen araç bağlantıları
Kurs ve rehberlerdeki çalışma zamanı linkleri burada sabit anchor'lara iner. Böylece `/araclar#ollama` gibi eski ve yeni iç linkler kullanıcıyı boş sayfaya düşürmez.
VRAM Hesaplayıcı
Model + quantization + bağlam boyutuna göre kaç GB VRAM gerektiğini saniyeler içinde hesaplayın.
Maliyet Karşılaştırıcı
API fiyatı, kur, elektrik ve tam sistem sepeti varsayımlarıyla yerel ve bulut maliyetini karşılaştırın.
Token Hız Yarışı
Sabit hız varsayımlarıyla örnek animasyon. Model çalıştırılmaz; gerçek performans veya satın alma karşılaştırması değildir.
Quantization Danışmanı
Donanımınıza göre Q4, Q5, Q8 veya FP16, hangi quantization seviyesi sizin için en iyi denge?
Model Önerici
Kullanım amacı, dil tercihi ve donanım bilgisine göre size en uygun yerel modeli birkaç soruda bulun.
GPU Seçici
Bellek ve donanım özelliklerine göre adayları seçin; mağazadan aldığınız tam sepet tutarını bütçenizle karşılaştırın.
Token Maliyet Hesaplayıcı
Farklı modellerin API token maliyetlerini hesaplayın. Input/output token, aylık/yıllık projeksiyon ve 3 model yan yana karşılaştırma.
Quantizasyon Etki Analizi
FP16'dan Q2_K'ye tüm quantization seviyelerinin bellek, hız ve kalite etkisini interaktif olarak görün, "buna değer mi?" kararını verin.
Yerel AI Deployment Maliyet Hesaplayıcı
GPU, elektrik (TRY) ve kullanım süresine göre 1/3 yıllık TCO, "bulut API'ye göre kâra geçme noktası" ve net tasarruf analizi.
Aradığın araç yok mu?
İlk 100 üye listesine katıl; topluluk kanalı hazır olduğunda hangi aracın eksik olduğunu birlikte oylayacağız.
VRAM Hesaplayıcı
Modeliniz için gerekli VRAM'i hesaplayın ve donanım uyumluluğunu görün.
Bu konfigürasyon mevcut tüketici GPU'larında rahatlıkla çalışır.
Donanım Uyumluluğu
42 GPUYerel GPU mu, bulut API mı?
Günlük token kullanımını, API fiyatlarını, tam sistem sepetini ve elektrik varsayımını girin. Tahmini başabaş süresini ve beş yıllık senaryo farkını karşılaştırın.
Girdi ve çıktı token toplamı. Türkçe kelime/token oranı modele göre değişir.
Kod yardımcısı, çoklu adım akıl yürütme. API modeliyle kalite eşitliği varsayılmaz; aynı görevlerle ayrıca değerlendirin.
Örnek donanım seçimi. Model dosyası, bağlam ve çalışma motoru için bellek yeterliliğini ayrıca kontrol edin.
Sabit fiyat yazmıyoruz. Canlı mağaza sepetindeki toplamı gir: GPU tek başına sistem değildir.
Boşta 32W tüketim, çalışma anında 320W toplam.
36 aylık kümülatif maliyet
Yerel: GPU yatırımı + elektrik · Bulut: aylık API faturası
Karar: Sepet fiyatı gir
GPU tek başına çalışan sistem değildir. ROI için canlı mağaza sepetindeki GPU, RAM, PSU, kasa/PC, SSD, garanti, KDV ve kargo toplamını gir.
Kullanıcı varsayımlarıyla hesaplanan senaryo; güncel fiyat veya geri ödeme garantisi değildir · /benchmark/metodoloji
Token/saniye yarışı
Sabit, doğrulanmamış hızlarla örnek animasyon. Model çalıştırılmaz; model ve nicemleme seçimi ölçülmüş yeni hız üretmez. Satın alma veya sağlayıcı karşılaştırması için kullanmayın.
Ölçüm yapılmadı: Bağlam, toplu istek ve nicemleme için doğrulanmış koşum kaydı yoktur. Seçilen Q4_K_M yalnızca senaryo etiketidir. Gerçek ölçüm yöntemi: /benchmark/metodoloji· Model: Llama 3.1 8B
Q4 mu Q5 mi? , Doğru cevap senin GPU'na göre değişir.
Quantization seviyesi, VRAM tüketimi ve çıktı kalitesi arasındaki tradeoff'u gör. Tatlı noktayı (sweet spot) kendi modelin için bul.
- RTX 3060 12GB✓ rahat
- RTX 4060 Ti 16GB✓ rahat
- RTX 4090 24GB✓ rahat
- RTX 3090 24GB✓ rahat
- A100 40GB✓ rahat
Quantization, modelin ağırlıklarını daha az bit ile temsil eder. Q4 = 4-bit, Q8 = 8-bit, FP16 = 16-bit. Yarıya inerken VRAM yarıya iner ama kalite kaybı <%2, bu yüzden Q4_K_M ve Q5_K_M en çok kullanılan boyutlar.
3 soruda en iyi 3 modeli bul
Donanimin ne durumda?
VRAM kapasiteni sec ya da listeden GPU'unu bul.
Sana en uygun GPU'yu bulalım
Önce bellek ve donanım özellikleriyle adayları seç. Sonuç ekranında mağazadan aldığın tam sepet tutarını bu bütçeyle karşılaştır.
3 model karşılaştırması
Aynı input/output token miktarıyla GPT-4o, Claude 3.5 Sonnet, Gemini 2.0 Flash, maliyet karşılaştırması
Seçilen model için girilen fiyatlar kullanılır. Diğer modellerin karşılaştırması örnek katalog fiyatlarıdır · Döviz: 39.50 ₺/$
FP16 baz bellek: 14.5GB (4.096 token baglam ile)
Diger seviyeler (+3)
Karar: Değer
Coğu kullanim senaryosunda fark yok. Performans artisi net.
En popüler quantizasyon. %70 bellek tasarrufu, kabul edilebilir kalite kaybı.
70B modelleri tek GPU'ya sığdırmak için standart seçim. Çoğu LLM benchmarkında rekabetçi.
Tum seviyeler, 7B icin tahmini VRAM
Veri: llama.cpp benchmarklari + TheBloke GGUF dokumantasyonu · Kalite metrikleri MMLU/Perplexity uzerinden
TDP: 285W. Elektrik hesabında bu nominal değer kullanılır; ölçülmüş tam sistem tüketimi değildir.
GPU + RAM + PSU + kasa/PC + SSD + garanti + KDV + kargo toplamını mağazadan gir. YerelAI sabit donanım fiyatı tutmaz.
Seçilen dağılımla 1M toplam token: ₺14,81. API ile yerel modelin kalitesi veya üretim kapasitesi eşit varsayılmaz.
Girdi ve çıktı tokenlarının toplamı; aşağıdaki pay bu toplamı ikiye ayırır.
Girdi %50, çıktı %50.
TDP × süre varsayımıyla günlük 2.28 kWh. Gerçek tüketim yük ve donanıma bağlıdır; sistemin diğer parçaları dahil değildir.
Başlangıçtaki 2.8 TL/kWh örnektir; güncel tarife iddiası değildir. Faturanızdaki vergi dahil birim fiyatı girin.
Sonuç: Tam sepet girişi gerekli
NVIDIA RTX 4070 Ti tek başına sistem değildir. GPU + RAM + PSU + kasa/PC + SSD + garanti + KDV + kargo toplamını mağaza sepetinden gir; başabaş hesabı ancak o zaman gösterilir.
36 aylık kümülatif maliyet tahmini (TRY)
Grafik için mağazadan kontrol ettiğiniz tam sistem sepetini girin; GPU, RAM, PSU, kasa ve diğer parçaları birlikte hesaplayın.
Tarihli örnek API ve kur değerleri düzenlenebilir; elektrik birim fiyatı ve sepet tutarı kullanıcı varsayımlarıdır. Her ay 30 gün, bir yıl 12 ay kabul edilir; grafik ve yıllık toplamlar aynı dönemi kullanır. Yerel maliyet yalnızca girilen sepet ile GPU TDP’sinden hesaplanan elektriği içerir; sistemin diğer parçalarının tüketimi, bakım ve yenileme dahil değildir. Seçilen GPU, token miktarını belirtilen sürede üretebileceği veya API modeliyle aynı kalitede sonuç vereceği anlamına gelmez.