TotalApp Docs

Yerel Dil Modelleri

Settings → Agentic ekranından indirilebilen yerel Ollama metin üretim modellerinin kataloğu, en iyi oldukları alana göre gruplandırılmıştır.

"Yerel LLM" Ne Anlama Gelir

Yerel Dil Modelleri, bilgisayarınızda kurulu ve çalışan ayrı bir sunucu süreci olan Ollama üzerinden çalışır. Tarayıcı İçi modellerin aksine, çıkarım (inference) tarayıcı sekmesinin kendi içinde gerçekleşmez — tarayıcı, 127.0.0.1 üzerinden HTTP ile Ollama sunucusuyla konuşur ve Ollama modeli bilgisayarınızın tüm CPU/GPU kaynaklarını kullanarak çalıştırır.

Ollama bağımsız bir uygulama olduğu için model indirmeleri, depolama ve GPU hızlandırma tamamen Ollama'nın kendisi tarafından yönetilir — tarayıcı sekmesi ya da TotalApp sunucusu tarafından değil. Bu nedenle model boyutları Tarayıcı İçi modellerden çok daha büyük olabilir (birkaç GB yaygındır) ve modeller, tarayıcı önbelleğinden bağımsız olarak yeniden başlatmalar arasında diskte kalıcı olarak durur.

Nereden yapılandırılır

Settings → Agentic → Writer Engine ekranına gidin, Ollama'yı seçin, ardından aşağıda açıklanan yerleşik indirme listesinden bir model seçin — ya da Ollama CLI üzerinden herhangi bir modeli doğrudan çekin, otomatik olarak görünecektir. TotalApp'in Ollama ile nasıl entegre çalıştığı için Ollama Entegrasyonu sayfasına, ayarların tam referansı için Agentic Ayarları sayfasına bakın. Anlamsal Arama tarafından kullanılan embedding modelleri için ise Embedding Modelleri sayfasına bakın — metin üretim ve embedding modelleri ayrı yapılandırılır. Ollama kurulu değil mi? Tamamen tarayıcı sekmesi içinde çalışan, kurulum gerektirmeyen bir alternatif için Tarayıcı İçi Modeller sayfasına bakın.

Altyapı Teknolojisi

Bu motor, llama.cpp üzerine kurulu bağımsız bir yerel sunucu uygulaması olan Ollama ile konuşur:

  • Modeller GGUF formatında indirilir — Ollama'nın llama.cpp'nin sıkıştırılmış ağırlıkları etrafında kurduğu kendi model paketleme biçimi.
  • Çalışma zamanı: llama.cpp, HTTP üzerinden erişilebilen yerel bir sunucu süreci olarak çalışır (varsayılan olarak 127.0.0.1:11434) — tarayıcı sekmesinin içinde değil, bu sayede bir JS motorunun bellek sınırları olmadan bilgisayarınızın tüm CPU/GPU gücünü kullanabilir.

Ayrı bir uygulama kurmak istemiyorsanız Tarayıcı İçi Modeller (ONNX) veya Tarayıcı İçi Modeller (WebGPU) sayfalarına bakın.

Genel Amaçlı ve Dengeli Modeller

Günlük chat, özetleme, metin yazma gibi temel işlerde hız ve kalite dengesi en iyi olan modeller:

ModelBoyutEn uygun kullanım
mistral:latest~4.4 GBSektör standardı, çok kararlı ve güvenilir bir genel amaçlı model.
llama3.3:latest~5.1 GBMeta'nın amiral gemisi. Ollama kullanan herkesin ilk arayacağı, Türkçe performansı da yüksek olan temel model.
gemma2:latest~9.6 GBGoogle'ın yeni nesil, genel yetenekleri ve dil becerisi oldukça yüksek modeli.

Muhakeme ve İleri Düzey Modeller

Kod yazma, karmaşık matematik, mantık yürütme (reasoning) ve derin analiz gerektiren işler için:

ModelBoyutEn uygun kullanım
deepseek-r1:7b~4.7 GBAkıl yürütme (thinking) döngüsüne sahip, problem çözme yeteneği çok yüksek popüler model.
qwen2.5:latest~23.9 GBYüksek parametreli, büyük veri işleme ve kurumsal görevler için tam bir canavar (ancak güçlü bilgisayar ister).
phi4:latest~9.1 GBMicrosoft'un özellikle bilimsel, matematiksel ve mantıksal muhakeme gerektiren senaryolar için optimize ettiği çok güçlü modeli.

Hafif ve Jet Hızlı Modeller

Düşük donanımlı (ekran kartsız) bilgisayarlarda veya çok hızlı/basit arka plan görevlerinde çalışmak için:

ModelBoyutEn uygun kullanım
llama3.2:1b~1.3 GBMeta'nın ultra hafif modeli. Bilgisayarı hiç yormadan, yerel cihazlarda jet hızında temel metin işleri yapmak için harikadır.
llama3.2:latest~2.0 GB1B modelinin biraz daha büyük kardeşi; günlük yerel kullanım için yine de hafif.
phi3:latest~2.2 GBRAM/CPU tüketmeden temel komutları anlayabilen kompakt bir model.

Boyutlarla ilgili not

Gösterilen boyutlar, her modelin varsayılan Ollama derlemesi için (genellikle Q4 sıkıştırma) yaklaşık, yuvarlanmış indirme boyutlarıdır — gerçek disk kullanımı Ollama sürümleri arasında hafifçe değişebilir.

Kategoriye Göre Model Seçimi

Genel Amaçlı

mistral, llama3.3, gemma2 — günlük sohbet, özetleme ve yazı işleri için en güvenli varsayılan seçim.

Muhakeme ve İleri Düzey

deepseek-r1, qwen2.5, phi4 — kod, matematik ve çok adımlı mantıksal muhakeme için en iyisi; karşılığında hız ve disk alanından ödün verilir.

Hafif ve Mikro

llama3.2:1b, llama3.2, phi3 — düşük donanımlı makineler veya hızlı, basit arka plan görevleri için en iyisi.

Bir Model İndirme

1. Settings → Agentic
2. Writer Engine (Ollama)
3. Listeden model seçin
4. İndirin ve seçin

Alternatif olarak, herhangi bir modeli bilgisayarınızda doğrudan Ollama CLI üzerinden çekebilirsiniz (örn. ollama pull llama3.3) — bu durumda model, yerleşik indirme listesinin yanında Settings açılır menüsünde otomatik olarak görünür.

SSS

Bu metin üretim modelleri embedding modelleriyle aynı mı?
Hayır. Bu sayfa sohbet ve içerik üretimi (Writer Engine) için kullanılan Ollama modellerini kapsar. Anlamsal Arama sıralaması için kullanılan embedding modelleri ayrı bir kategoridir ve kendi indirme listesine sahiptir; bkz. Embedding Modelleri.
Emin değilsem hangi modelle başlamalıyım?
Günlük yazı ve sohbet görevlerinin çoğu için güvenli, güvenilir genel amaçlı varsayılanlar mistral veya llama3.3'tür.
Bu modelleri yerel çalıştırmak için GPU gerekli mi?
Kesinlikle gerekli değil — Hafif ve Mikro modeller yalnızca CPU'lu makinelerde kabul edilebilir şekilde çalışacak şekilde tasarlanmıştır. Muhakeme kategorisindeki daha büyük modeller GPU olmadan belirgin şekilde daha yavaş olacaktır.
Birden fazla model indirebilir miyim?
Evet. Birkaçını indirip Writer Engine model açılır menüsünden istediğiniz zaman aralarında geçiş yapabilirsiniz.