Yerel Dil Modelleri
Settings → Agentic ekranından indirilebilen yerel Ollama metin üretim modellerinin kataloğu, en iyi oldukları alana göre gruplandırılmıştır.
"Yerel LLM" Ne Anlama Gelir
Yerel Dil Modelleri, bilgisayarınızda kurulu ve çalışan ayrı bir sunucu süreci olan Ollama üzerinden çalışır. Tarayıcı İçi modellerin aksine, çıkarım (inference) tarayıcı sekmesinin kendi içinde gerçekleşmez — tarayıcı, 127.0.0.1 üzerinden HTTP ile Ollama sunucusuyla konuşur ve Ollama modeli bilgisayarınızın tüm CPU/GPU kaynaklarını kullanarak çalıştırır.
Ollama bağımsız bir uygulama olduğu için model indirmeleri, depolama ve GPU hızlandırma tamamen Ollama'nın kendisi tarafından yönetilir — tarayıcı sekmesi ya da TotalApp sunucusu tarafından değil. Bu nedenle model boyutları Tarayıcı İçi modellerden çok daha büyük olabilir (birkaç GB yaygındır) ve modeller, tarayıcı önbelleğinden bağımsız olarak yeniden başlatmalar arasında diskte kalıcı olarak durur.
Nereden yapılandırılır
Settings → Agentic → Writer Engine ekranına gidin, Ollama'yı seçin, ardından aşağıda açıklanan yerleşik indirme listesinden bir model seçin — ya da Ollama CLI üzerinden herhangi bir modeli doğrudan çekin, otomatik olarak görünecektir. TotalApp'in Ollama ile nasıl entegre çalıştığı için Ollama Entegrasyonu sayfasına, ayarların tam referansı için Agentic Ayarları sayfasına bakın. Anlamsal Arama tarafından kullanılan embedding modelleri için ise Embedding Modelleri sayfasına bakın — metin üretim ve embedding modelleri ayrı yapılandırılır. Ollama kurulu değil mi? Tamamen tarayıcı sekmesi içinde çalışan, kurulum gerektirmeyen bir alternatif için Tarayıcı İçi Modeller sayfasına bakın.
Altyapı Teknolojisi
Bu motor, llama.cpp üzerine kurulu bağımsız bir yerel sunucu uygulaması olan Ollama ile konuşur:
- Modeller GGUF formatında indirilir — Ollama'nın llama.cpp'nin sıkıştırılmış ağırlıkları etrafında kurduğu kendi model paketleme biçimi.
- Çalışma zamanı: llama.cpp, HTTP üzerinden erişilebilen yerel bir sunucu süreci olarak çalışır (varsayılan olarak
127.0.0.1:11434) — tarayıcı sekmesinin içinde değil, bu sayede bir JS motorunun bellek sınırları olmadan bilgisayarınızın tüm CPU/GPU gücünü kullanabilir.
Ayrı bir uygulama kurmak istemiyorsanız Tarayıcı İçi Modeller (ONNX) veya Tarayıcı İçi Modeller (WebGPU) sayfalarına bakın.
Genel Amaçlı ve Dengeli Modeller
Günlük chat, özetleme, metin yazma gibi temel işlerde hız ve kalite dengesi en iyi olan modeller:
| Model | Boyut | En uygun kullanım |
|---|---|---|
mistral:latest | ~4.4 GB | Sektör standardı, çok kararlı ve güvenilir bir genel amaçlı model. |
llama3.3:latest | ~5.1 GB | Meta'nın amiral gemisi. Ollama kullanan herkesin ilk arayacağı, Türkçe performansı da yüksek olan temel model. |
gemma2:latest | ~9.6 GB | Google'ın yeni nesil, genel yetenekleri ve dil becerisi oldukça yüksek modeli. |
Muhakeme ve İleri Düzey Modeller
Kod yazma, karmaşık matematik, mantık yürütme (reasoning) ve derin analiz gerektiren işler için:
| Model | Boyut | En uygun kullanım |
|---|---|---|
deepseek-r1:7b | ~4.7 GB | Akıl yürütme (thinking) döngüsüne sahip, problem çözme yeteneği çok yüksek popüler model. |
qwen2.5:latest | ~23.9 GB | Yüksek parametreli, büyük veri işleme ve kurumsal görevler için tam bir canavar (ancak güçlü bilgisayar ister). |
phi4:latest | ~9.1 GB | Microsoft'un özellikle bilimsel, matematiksel ve mantıksal muhakeme gerektiren senaryolar için optimize ettiği çok güçlü modeli. |
Hafif ve Jet Hızlı Modeller
Düşük donanımlı (ekran kartsız) bilgisayarlarda veya çok hızlı/basit arka plan görevlerinde çalışmak için:
| Model | Boyut | En uygun kullanım |
|---|---|---|
llama3.2:1b | ~1.3 GB | Meta'nın ultra hafif modeli. Bilgisayarı hiç yormadan, yerel cihazlarda jet hızında temel metin işleri yapmak için harikadır. |
llama3.2:latest | ~2.0 GB | 1B modelinin biraz daha büyük kardeşi; günlük yerel kullanım için yine de hafif. |
phi3:latest | ~2.2 GB | RAM/CPU tüketmeden temel komutları anlayabilen kompakt bir model. |
Boyutlarla ilgili not
Gösterilen boyutlar, her modelin varsayılan Ollama derlemesi için (genellikle Q4 sıkıştırma) yaklaşık, yuvarlanmış indirme boyutlarıdır — gerçek disk kullanımı Ollama sürümleri arasında hafifçe değişebilir.
Kategoriye Göre Model Seçimi
Genel Amaçlı
mistral, llama3.3, gemma2 — günlük sohbet, özetleme ve yazı işleri için en güvenli varsayılan seçim.
Muhakeme ve İleri Düzey
deepseek-r1, qwen2.5, phi4 — kod, matematik ve çok adımlı mantıksal muhakeme için en iyisi; karşılığında hız ve disk alanından ödün verilir.
Hafif ve Mikro
llama3.2:1b, llama3.2, phi3 — düşük donanımlı makineler veya hızlı, basit arka plan görevleri için en iyisi.
Bir Model İndirme
Alternatif olarak, herhangi bir modeli bilgisayarınızda doğrudan Ollama CLI üzerinden çekebilirsiniz (örn. ollama pull llama3.3) — bu durumda model, yerleşik indirme listesinin yanında Settings açılır menüsünde otomatik olarak görünür.
SSS
mistral veya llama3.3'tür.