AI Model Yönlendirme (Routing) El Kitabı — 25 Eylül 2026
Model filoları ve rol eşleştirmeleri 25 Eylül 2026 tarihli editoryal rota örnekleridir. Her modelin bugün hesabınızda mevcut olduğu veya aynı isimle API’ye çağrılabildiği anlamına gelmez. Burada yeni bir VG karşılaştırma testi raporlanmıyor. Gerçek model kimliğini, fiyatı ve bağlam limitini sağlayıcıdan kontrol edip kendi görev örneklerinizde ölçün.
Amaç: Ürün vizyonu, araştırma, mimari tasarım, orkestrasyon, kodlama, kullanıcı arayüzü (UI), kök neden hata ayıklama, test, kod inceleme ve otonom ajan (agent) operasyonları için pratik model seçimi.
Varsayılan Birincil Ortam: Windows üzerinde Codex + Claude Code + Ollama Cloud/Local; diğer tüm model ve API'ler opsiyonel alternatifler ve eskalasyon katmanları olarak konumlandırılmıştır.
Bu doküman pazardaki her model uç noktasının sıradan bir listesi değildir. 25 Eylül 2026 tarihi itibarıyla yazılım, ürün geliştirme ve otonom ajan mimarilerinde değerlendirilmeye değer model ailelerinin güncel ve pratik bir sahadan derlenmiş kataloğudur. Anlık model sürümleri (snapshot), kotalar, fiyatlandırmalar ve barındırılan bağlam (context) limitleri değişkenlik gösterebilir. Kıyaslama (benchmark) puanları görev ve harness bağımlı olduğu için bilinçli olarak tek bir mutlak sıralama ölçütü olarak kullanılmamıştır.
1. Yönetici Özeti — Gerçekte Çalıştıracağım Model Filosu
Amaç sürekli manuel model seçmekle vakit kaybetmek yerine, işi fikirden doğrulanmış sürüme taşımaksa şu operasyonel hiyerarşiyi uygulayın:
| Rol / Görev | Birincil Model | Normal Efor | Eskalasyon / Alternatif |
|---|---|---|---|
| Baş Stratejist / En Zor & Belirsiz Problem | GPT-6 Astra | High | Fable 5.1 High/XHigh, Grok 4.7 High/XHigh |
| Ana Orkestratör (Supervisor) | Claude Opus 5.5 | Medium | Kimi K3 High, Fable 5.1 High |
| Ürün Yapısı / Bilgi Mimarisi (IA) | Claude Opus 5.5 | High | Astra High, Fable 5.1 High, Kimi K3 High |
| Yazılım Mimarı | Claude Opus 5.5 | High | Fable 5.1 High/XHigh, Astra High, GLM-5.3 Max |
| Günlük Rutin Geliştirme (Implementation) | GPT-6 Sol | Medium | Sonnet 5 High, DeepSeek V4.1 Flash High |
| Hızlı / Düşük Maliyetli Kapsamlı İşler | GPT-6 Luna | Low/Medium | Qwen 3.8 Flash Medium, DeepSeek V4.1 Flash High |
| Zorlu Kodlama / Büyük Refactoring | Opus 5.5 | High/XHigh | Fable 5.1 XHigh, Kimi K3 Max, GLM-5.3 Max |
| Kullanıcı Arayüzü (UI) / Görsel Kodlama | GLM-5.3 Flash | High | Step 3.7 Flash High, Gemini 3.8 Flash High, Kimi K3 High |
| Ekran Görüntüsünden Koda / Görsel Hata Ayıklama | GLM-5.3 Flash | High/Max | Step 3.7 Flash High, Gemini 3.8 Flash High, MiMo V2.6 Flash |
| Düşük Maliyetli Paralel Kodlama İşçisi | DeepSeek V4.1 Flash | High | Qwen 3.8 Flash, Kimi K2.8, GLM-5.3 Flash |
| Açık / Bulut Kıdemli Yazılımcı (Senior) | GLM-5.3 | High/Max | Kimi K3 Max, DeepSeek V4.1 Flash Max |
| Uzun Süreli Açık Kaynak Ajan (Long Agent) | Kimi K3 | High/Max | MiniMax M3, Nemotron 3 Ultra, GLM-5.3 |
| Kök Neden Hata Ayıklayıcısı (Root-Cause) | Opus 5.5 | High/XHigh | Fable 5.1, Astra High, Kimi K3 Max |
| Kod İnceleyici (Code Reviewer) | Opus 5.5 | High | Fable 5.1 High, Astra High, GLM-5.3 Max |
| Güvenlik & Güvenilirlik İncelemesi | Fable 5.1 / Opus 5.5 | High/XHigh | Astra High/XHigh, GLM-5.3 Max |
| Tarayıcı / Bilgisayar Kullanımı (Computer-Use) QA | GPT-6 Astra | High | Gemini 3.8 Flash High, MiniMax M3, Step 3.7 Flash High |
| Yerel / Gizli (Private) Genel Model | Qwen 3.8 27B | Medium/XHigh | MiMo V2.6 Distill-Qwen-9B, Mistral Medium 3.5 |
| Nihai Sürüm Kabulü (Release Acceptance) | Astra High + Bağımsız Opus High İncelemesi | High | Kritik sistemlerde Fable ek kontrolü |
Mevcut Aboneliklerinizde En Çok Önem Taşıyan 6 Model
Mümkün olan en yalın yönlendiriciyi (router) kurmak istiyorsanız şu 6 modelle başlayın:
- GPT-6 Astra (High): Strateji, belirsizlik, nihai entegrasyon, bilgisayar/tarayıcı QA.
- Claude Opus 5.5 (Medium/High): Ana orkestratör, mimari, kök neden analizi, bağımsız kod incelemesi.
- GPT-6 Sol (Medium): Varsayılan üretim geliştiricisi (default builder).
- GPT-6 Luna (Low/Medium): Ucuz, sınırları belirli mekanik işler ve testler.
- DeepSeek V4.1 Flash (High): Ollama Cloud üzerinden çok ucuz paralel kodlama işçisi.
- GLM-5.3 Flash (High): Ollama Cloud üzerinden arayüz (UI) ve görsel geliştirme işçisi.
Ardından Kimi K3, GLM-5.3 tam sürüm, Sonnet 5 ve duruma göre Fable 5.1'i uzmanlaşmış alternatif ve eskalasyon katmanı olarak ekleyin.
2. Akıl Yürütme (Reasoning) ve Efor Seviyelerinin Normalizasyonu
Farklı sağlayıcılar farklı efor anahtarları kullanır. Bir sağlayıcıdaki high seçeneğini diğerindekiyle sayısal veya operasyonel olarak asla eşdeğer tutmayın.
Dahili router mimarisinde şu standartlaştırılmış ölçeği kullanın:
| Dahili Seviye | Anlamı | Tipik İş Türü |
|---|---|---|
| E0 — Off/None | Planlı akıl yürütme bütçesi yok | Biçimlendirme, deterministik dönüşümler, önemsiz metin düzenlemeleri |
| E1 — Low | Hızlı ve sınırları belirli mantık yürütme | Veri çıkarma, boilerplate üretimi, basit testler, ufak yamalar |
| E2 — Medium | Dengeli varsayılan | Standart kodlama, olağan planlama, rutin hata ayıklama |
| E3 — High | Derin odaklanma | Mimari tasarım, karmaşık kodlama, UI mantığı, zorlu hata ayıklama |
| E4 — XHigh/Deep | Uzun soluklu derin muhakeme | Büyük taşımalar (migration), kök neden tespiti, güvenlik analizi, uzun ajanlar |
| E5 — Max | İstisnai / Aşırı karmaşık | Çözülememiş en zor görevler, ikinci göz soruşturması; asla günlük varsayılan değildir |
Sağlayıcılara göre doğrulanan kontroller
Kontrol tarihi: 4 Ekim 2026. Arayüzdeki efor etiketi ile API parametresi aynı şey olmayabilir. Uygulama, model ve uç noktanın desteklediği seçenekleri kullanın.
| Ortam | Kontrol ve kapsam | Kaynak |
|---|---|---|
| OpenAI / Codex | model_reasoning_effort: modelin bildirdiği seviyeler; belgede low, medium, high, xhigh, max ve ultra örnekleri var. Sabit tüm-model listesi değil. | Codex yapılandırma referansı |
| Claude Fable 5.1, Opus 5.5, Sonnet 5 | output_config.effort: low, medium, high, xhigh, max. Opus 5.5 varsayılanı medium; desteklenen diğer modellerde high. Kapsam model bazında kontrol edilmeli. | Claude effort |
| DeepSeek / Responses ve Chat Completions | Responses: reasoning.effort none/low/high/max; Chat Completions: düşünme açık/kapalı ve reasoning_effort low/high/max. Aynı alanı her API biçimine kopyalamayın. | DeepSeek thinking mode |
| Gemini 3.8 Flash / 3.1 Pro Preview | thinking_level: low, medium, high. Flash varsayılanı medium; Pro Preview high. | Gemini thinking |
| Diğer sağlayıcılar ve Ollama rotaları | Aşağıdaki model kataloğunda verilen eforlar VG yönlendirme önerisidir. Bu kontrolde tüm uç noktaların native seçenekleri doğrulanmadı. Desteklenmeyen seviyeyi göndermek yerine model kataloğu ve bir araç çağırma testiyle doğrulayın. | Ollama / Codex profili |
Altın Kural
Her şeyi körü körüne "Max" seviyesine ayarlamayın. Max seviyesi daha yavaştır, kotanızı hızla tüketir ve çoğu zaman gereksiz keşif döngülerine yol açar. Kabul testlerinizden güvenle geçen en düşük seviyeyle başlayın, sadece başarısızlık durumunda eskalasyona gidin.
3. Kapsamlı Pratik Model Kataloğu
OpenAI / Codex
GPT-6 Astra
- Statü: Birincil frontier eskalasyon modeli
- En Uygun Roller: Strateji, belirsiz ürün gereksinimleri, sistemler arası mantık, nihai entegrasyon, bilgisayar/tarayıcı otomasyonu, kritik kabul incelemeleri
- VG efor profili (destekleniyorsa): Low / Medium / High / XHigh / Max
- Öneri: Normalde High; kritik derin sorunlarda XHigh; Max sadece ciddi bir başarısızlıktan sonra
- Boşa Harcamayın: Şablon kod, sıradan CRUD, toplu veri dönüşümü, basit test üretimi
- Alternatifler: Fable 5.1, Opus 5.5, Grok 4.7, Kimi K3 Max
GPT-6 Sol
- Statü: Birincil günlük geliştirici (default builder)
- En Uygun Roller: Standart kodlama, backend, API'ler, refactoring, ajan uygulamaları, hata ayıklama, DevOps, plan icrası
- VG efor profili (destekleniyorsa): None / Low / Medium / High / XHigh / Max
- Öneri: İşlerin %80'inde Medium; zorlu uygulama ve hata ayıklamada High; XHigh çok nadiren
- Alternatifler: Sonnet 5, DeepSeek V4.1 Flash, Kimi K3, GLM-5.3
GPT-6 Luna
- Statü: Birincil düşük maliyetli hızlı işçi
- En Uygun Roller: Veri çıkarma, tekrarlayan düzenlemeler, basit testler, fikstürler, kod araması, dokümantasyon dönüşümleri
- VG efor profili (destekleniyorsa): None / Low / Medium / High / XHigh / Max
- Öneri: Mekanik işlerde Low; net tarif edilmiş koordineli işlerde Medium
- Dikkat: Problem tam olarak tanımlanmadıkça ana mimarınız yapmayın.
Anthropic / Claude Code
Claude Fable 5.1
- Statü: Premium eskalasyon / Uzun ufuklu zorlu görev modeli
- En Uygun Roller: En zor otonom ajan işleri, derin yazılım mantığı, kritik mimari incelemesi, uzun süreli otonom süreçler
- VG efor profili (destekleniyorsa): Low / Medium / High / XHigh / Max (Varsayılan: High)
- Öneri: High; uzun süreli zorlu kodlama/ajan görevlerinde XHigh; Max sadece istisnai durumlarda
- Kullanım İlkesi: Opus High/XHigh yetersiz kaldığında devreye sokun.
Claude Opus 5.5
- Statü: Birincil orkestratör / mimar / kod inceleyici
- En Uygun Roller: Orkestrasyon, dev kod tabanlarında mantık yürütme, yazılım mimarisi, kök neden hata ayıklama, büyük refactoring, kod inceleme
- VG efor profili (destekleniyorsa): Low / Medium / High / XHigh / Max (Varsayılan: Medium)
- Öneri: Orkestrasyon yaparken Medium; mimari, inceleme ve hata ayıklamada High; büyük taşımalarda XHigh
- VG Stratejisi: Opus 5.5 Medium'u ana orkestratör olarak tutun; ancak kendisi ağır mühendisliğe başladığında High'a yükseltin.
Claude Sonnet 5
- Statü: Güçlü, hızlı geliştirme ve alt-ajan (subagent) modeli
- En Uygun Roller: Kodlama, alt-ajanlar, repo görevleri, rutin ajan akışları
- VG efor profili (destekleniyorsa): Low / Medium / High / XHigh / Max (Varsayılan: High)
- Öneri: High; gecikme ve kota kritikse Medium
Claude Haiku 4.5
- Statü: 4 Ekim 2026’da resmî yaşam döngüsü sayfasında Active. “Not sooner than October 15, 2026” en erken tarih sınırıdır; kesin emeklilik duyurusu değildir.
- Tavsiye: Yeni sistemlerde Luna, Qwen Flash veya DeepSeek Flash tercih edin.
Moonshot / Kimi
Kimi K3
- Statü: Üst segment açık/bulut alternatifi; Ollama kurulumu için kritik
- En Uygun Roller: Uzun ufuklu kodlama, devasa repo bağlamı (Ollama kimi-k3:cloud katalogunda 1M; 4 Ekim 2026), orkestrasyon, çok modlu kod/ürün görevleri
- VG efor profili (destekleniyorsa): Low / High / Max (Varsayılan: High)
- Erişim: Ollama Cloud üzerinde
kimi-k3:cloud - Öneri: Uzun bağlamlı orkestrasyonda Opus'a; açık model kodlamasında GLM-5.3'e karşı ilk alternatifinizdir.
Kimi K2.8 Preview
- Statü: Güçlü rutin kodlama alternatifi
- Öneri: Rutin işlerde High; zorlu görevlerde Max.
Kimi K2.7 Code HighSpeed
- Statü: Hız odaklı uzman; gecikmeye duyarlı etkileşimli kodlama döngülerinde tercih edilir.
DeepSeek
DeepSeek V4.1 Flash
- Statü: Birincil ucuz, yüksek yetenekli kodlama işçisi
- En Uygun Roller: Paralel kodlama, standart geliştirme, testler, hata ayıklama, alt-ajan görevleri
- Erişim: Ollama Cloud üzerinde
deepseek-v4.1-flash:cloud - VG efor profili (destekleniyorsa): None / Low / High / Max (Varsayılan: High)
- Öneri: Normalde High; basit toplu işlerde Low; izole zor kodlamada Max. Eski V4 Flash yerine mutlaka V4.1 Flash kullanın.
DeepSeek V4 Pro
- Statü: İkincil zor akıl yürütme seçeneği; V4.1 Flash verimliliği nedeniyle çoğu zaman Pro'dan daha avantajlıdır.
Z.ai / GLM
GLM-5.3
- Statü: Birincil açık/bulut kıdemli yazılımcı (Senior Coder)
- En Uygun Roller: Uzun soluklu kodlama, mimari uygulama, güvenlik analizi, büyük refactoring
- Erişim: Ollama Cloud üzerinde
glm-5.3:cloud - VG efor profili (destekleniyorsa): Low / High / Max (Varsayılan: Max)
- Öneri: Normalde High; mimari ve refactoring işlerinde Max.
GLM-5.3 Flash
- Statü: Birincil arayüz (UI/Frontend) ve görsel kodlama işçisi
- En Uygun Roller: UI geliştirme, ekran görüntüsünden koda dökme (screenshot-to-code), görsel iterasyon, hızlı ajan döngüleri
- Erişim: Ollama Cloud üzerinde
glm-5.3-flash:cloud - Öneri: Normalde High; ekran görüntüsü ve zorlu arayüz hatalarında Max. Bu model ücretli filomuzda varsayılan UI işçisi olarak kalmalıdır.
Alibaba / Qwen
Qwen 3.8 Max
- Statü: Güçlü genel mühendislik alternatifi (Mühendislik ölçeğinde görevler, uzun ufuklu ajanlar, araç kullanımı).
- Öneri: Rutinde Medium; zorlu görevlerde XHigh.
Qwen 3.8 Flash
- Statü: Düşük maliyetli çok modlu alt-ajan işçisi; Luna ve DeepSeek Flash alternatifi.
Qwen 3.8 27B Local
- Statü: Bu katalogdaki en pratik yerel ve gizli (private) aday
- En Uygun Roller: Şirket içi gizli repolar, internete çıkamayan kod tabanları, yerel araç kullanımı
- Ollama Boyutu: Q4 paketlemesinde ~18 GB; 256K bağlam sınıfı
- Öneri: Rutinde Medium; zor yerel işlerde XHigh.
Diğer Önemli Aileler (Özet)
- Gemini 3.8 Flash: Çok modlu araştırma, 1M girdi bağlamı, tarayıcı ve PDF anlama görevlerinde standart tercih.
- MiniMax M3: Ollama Cloud üzerinde (
minimax-m3:cloud) katalogda 512K bağlam; model mimarisinin 1M kapasitesi her barındırılan uç noktanın aynı limiti verdiğini göstermez. Model, ve bilgisayar/arayüz otomasyonunda güçlü uzun ajan. - Step 3.7 Flash: Ekran görüntüsünden saf HTML/CSS/React üretme konusunda GLM-5.3 Flash'a en ciddi alternatif.
- Mistral Medium 3.5: Büyük donanıma sahip yerel sunucularda 256K bağlamlı açık genel model.
- Nemotron 3 Ultra: Ollama Cloud üzerinde kurumsal araştırma ve derin araç çağırma zincirlerinde güçlü seyrek (sparse) model.
4. Görev Görev Yönlendirme (Routing) Matrisi
Bu matrisi doğrudan bir router algoritmasına veya config dosyasına dönüştürebilirsiniz:
| Görev Türü | Birincil Model | Efor Seviyesi | İkinci Tercih | Düşük Maliyetli / Açık Alternatif |
|---|---|---|---|---|
| Ürün / İş Fikri Üretimi | Astra | High | Fable 5.1 High | Kimi K3 High/Max |
| Fırsat Keşfi / Yeni Sentezler | Astra | High/XHigh | Grok 4.7 High/XHigh | Kimi K3 Max |
| Derin Pazar Araştırması | Astra | High | Fable / Gemini 3.8 High | Kimi K3 High |
| Fikri Çürütme (Red-Teaming) | Opus 5.5 | High | Fable High | GLM-5.3 Max |
| Gereksinimleri Netleştirme | Opus 5.5 | Medium | Sol Medium | Kimi K3 High |
| PRD / Fonksiyonel Şartname | Opus 5.5 | High | Sol High | Kimi K3 High |
| Ürün Yapısı / Bilgi Mimarisi | Opus 5.5 | High | Fable/Astra High | Kimi K3 High |
| Kullanıcı Yolculukları / Akışlar | Opus 5.5 | High | Astra High | Gemini 3.8 High |
| UX Ürün Düşüncesi | Astra | Medium/High | Fable High | Gemini 3.8 High |
| Sistem Mimarisi | Opus 5.5 | High | Fable/Astra High | GLM-5.3 Max / Kimi K3 Max |
| Yazılım Mimarisi | Opus 5.5 | High | Fable XHigh | GLM-5.3 Max |
| API / Şema Sınırları | Opus 5.5 | High | Sol High | DeepSeek V4.1 High |
| Orkestratör / Süpervizör | Opus 5.5 | Medium | Fable High | Kimi K3 High / Nemotron |
| Hedefi Alt Görevlere Bölme | Opus 5.5 | Medium | Sol Medium | Luna Medium / Kimi K3 High |
| Hangi Ajanın Çalışacağına Karar Verme | Opus 5.5 | Medium | Kimi K3 High | Nemotron / MiniMax M3 |
| Günlük Standart Kodlama | Sol | Medium | Sonnet 5 High | DeepSeek V4.1 High |
| Backend / API Geliştirme | Sol | Medium | Sonnet 5 High | DeepSeek / Qwen Flash |
| Veritabanı Taşımaları (Migration) | Sol | High | Opus High | DeepSeek High |
| Küçük Kod Yamaları | Luna | Low/Medium | Sol Low | Qwen Flash Medium |
| Şablon / Kazan Dairesi Kod (Boilerplate) | Luna | Low | DeepSeek Low | MiMo Flash / Qwen Flash |
| Büyük Özellik Geliştirme | Sol | Medium/High | Opus High | Kimi K3 High / GLM-5.3 High |
| Büyük Kod Deposu Refactoring | Opus 5.5 | High/XHigh | Fable XHigh | Kimi K3 Max / GLM-5.3 Max |
| Çatı (Framework) Değişimi | Opus 5.5 | XHigh | Fable XHigh | Kimi K3 Max |
| Rutin Hata Ayıklama (Debug) | Sol | Medium/High | Sonnet 5 High | DeepSeek High |
| İnatçı / Tekrarlayan Hatalar | Opus 5.5 | High | Astra High | Kimi K3 Max |
| Kök Neden Hata Ayıklama | Opus 5.5 | High/XHigh | Fable XHigh | GLM-5.3 Max |
| Test Senaryosu Üretimi | Luna | Low/Medium | DeepSeek High | Qwen Flash / MiMo Distill |
| Fikstür ve Mock Veri Üretimi | Luna | Low | DeepSeek Low | Qwen Flash |
| Başarısız Testleri Teşhis Etme | Sol | High | Opus High | DeepSeek Max |
| Kod İnceleme (Code Review) | Opus 5.5 | High | Fable High | GLM-5.3 Max / Kimi K3 Max |
| Güvenlik / Güvenilirlik Denetimi | Fable / Opus | High/XHigh | Astra High/XHigh | GLM-5.3 Max |
| DevOps / CI-CD Hatları | Sol | Medium/High | Opus High | DeepSeek High / Step Medium |
| Terminal / Sunucu Sorun Giderme | Sol | High | Opus High | GLM-5.3 High |
| UI Kavramı / Hiyerarşi | Astra | Medium/High | Opus High | Gemini 3.8 High |
| UI Bileşenlerini Kodlama | GLM-5.3 Flash | High | Sonnet 5 High | Step 3.7 High |
| Ekran Görüntüsü → Kod | GLM-5.3 Flash | High/Max | Step 3.7 High | Gemini 3.8 High / MiMo Flash |
| Görsel UI Hata Ayıklama | GLM-5.3 Flash | High/Max | Step 3.7 High | MiniMax M3 / Gemini 3.8 High |
| Tarayıcı / Masaüstü Kullanımı QA | Astra | High | Gemini 3.8 High | MiniMax M3 / Step 3.7 High |
| Çok Modlu Doküman / PDF Analizi | Gemini 3.8 Flash | High | Astra High | Kimi K3 / MiMo Pro |
| Ses / Video Ağırlıklı Ajan İşi | Gemini 3.8 / MiMo | High / Thinking | Kimi K3 | Qwen Omni Flash |
| Dokümantasyon Üretimi | Luna | Low/Medium | Sol Low | Qwen Flash |
| Bilgi Tabanı Özetleme | Luna | Medium | Gemini 3.8 Medium | Qwen Flash |
| Uzun Süreli Otonom Kodlama | Fable / Opus | XHigh | Astra XHigh | Kimi K3 Max / GLM-5.3 Max |
| Uzun Süreli Açık Kaynak Ajan | Kimi K3 | Max | GLM-5.3 Max | Nemotron / MiniMax M3 |
| Düşük Maliyetli Paralel Alt-Ajan | Luna | Low/Medium | DeepSeek High | Qwen Flash / K2.8 |
| Gizli / Yerel Repo Geliştirme | Qwen 3.8 27B | Medium/XHigh | MiMo Distill 9B | Mistral Medium 3.5 (Donanım yeterse) |
| Nihai Sürüm Onayı ve Kabul | Astra | High | Bağımsız Opus High | Kritik sistemlerde Fable High |
5. Fikirden Bitmiş Ürüne Uçtan Uca İş Akışı
Varsayılan üretim zinciriniz şu şekilde akmalıdır:
KULLANICI HEDEFİ
│
▼
GPT-6 Astra (High)
Strateji / Fırsatlar / Belirsizliklerin Giderilmesi
│
▼
Claude Opus 5.5 (High)
Ürün Yapısı + Fonksiyonel Gereksinimler
│
▼
Claude Opus 5.5 (High)
Sistem ve Yazılım Mimarisi
│
▼
Claude Opus 5.5 (Medium)
Ana Orkestratör: Görevleri Böler ve İşçileri Yönlendirir
│
├── GPT-6 Sol (Medium) ─────────── Ana uygulama ve backend
├── Claude Sonnet 5 (High) ─────── Hızlı repo görevleri / alt-ajanlar
├── DeepSeek V4.1 Flash (High) ─── Ucuz paralel kodlama işçisi
├── GPT-6 Luna (Low/Medium) ────── Testler / fikstürler / dönüşümler
├── GLM-5.3 Flash (High) ───────── UI / Görsel bileşen kodlama
├── Kimi K3 (High/Max) ─────────── Dev bağlam (1M) veya uzun açık ajanlar
└── Qwen 3.8 27B (Medium/XHigh) ── Yerel ve gizli şirket içi kodlar
│
▼
Claude Opus 5.5 (High)
Bağımsız Kod İncelemesi / Kök Neden Doğrulaması
│
▼
GPT-6 Astra (High)
Ürün Seviyesinde Kabul + Tarayıcı/Masaüstü QA
│
▼
NİHAİ SÜRÜM & YAYINLAMA
Önemli İlke: Geliştirici Kendi Kendini İncelememelidir!
Asla bir modelin kendi ürettiği kodu tek başına onaylamasına izin vermeyin. Zorunlu bağımsız inceleme eşleşmeleri:
| Kodu Yazan (Builder) | İnceleyen (Reviewer) |
|---|---|
| GPT-6 Sol | Claude Opus 5.5 |
| Claude Sonnet 5 | Claude Opus 5.5 / GPT-6 Astra |
| DeepSeek V4.1 Flash | GPT-6 Sol / Claude Opus 5.5 |
| GLM-5.3 Flash | Opus 5.5 + Gerektiğinde Astra/Gemini ile görsel kabul |
| Kimi K3 | Claude Opus 5.5 / GPT-6 Astra |
| Claude Opus 5.5 | GPT-6 Astra / Claude Fable 5.1 |
| GPT-6 Astra | Claude Opus 5.5 (Çapraz sorgulama geçişi) |
| Qwen Local | Gizlilik politikası izin veriyorsa Sol/Opus bulut incelemesi |
6. Mevcut Abonelikleriniz İçin Önerilen Ön Tanımlar (YAML)
Codex / OpenAI Konfigürasyonu
codex:
default_builder:
model: GPT-6 Sol
effort: medium
cheap_worker:
model: GPT-6 Luna
effort: low
escalate_to: medium
hard_problem:
model: GPT-6 Astra
effort: high
final_acceptance:
model: GPT-6 Astra
effort: high
emergency_escalation:
model: GPT-6 Astra
effort: xhigh
rule: "Yalnızca ciddi bir High denemesinden sonra veya kritik güvenlik denetimlerinde devreye girer"
Claude Code Konfigürasyonu
claude_code:
orchestrator:
model: Claude Opus 5.5
effort: medium
architect:
model: Claude Opus 5.5
effort: high
senior_debugger:
model: Claude Opus 5.5
effort: high
escalate_to: xhigh
reviewer:
model: Claude Opus 5.5
effort: high
implementation_subagent:
model: Claude Sonnet 5
effort: high
premium_escalation:
model: Claude Fable 5.1
effort: high
escalate_to: xhigh
rule: "Yalnızca Opus yetersiz kaldığında veya görev olağandışı uzun/kritik olduğunda devreye girer"
Ollama Cloud Konfigürasyonu
ollama_cloud:
cheap_coding_worker:
model: deepseek-v4.1-flash:cloud
effort: high
open_senior_coder:
model: glm-5.3:cloud
effort: high
escalate_to: max
visual_ui_worker:
model: glm-5.3-flash:cloud
effort: high
escalate_to: max
long_context_agent:
model: kimi-k3:cloud
effort: high
escalate_to: max
alternative_long_agent:
model: minimax-m3:cloud
effort: "thinking on / harness budget"
orchestration_research_alternative:
model: nemotron-3-ultra:cloud
effort: "thinking on / derin bütçe yalnızca haklı durumlarda"
Ollama Local (Yerel Donanım)
ollama_local:
practical_private_default:
model: Qwen 3.8 27B
effort: medium
escalate_to: xhigh
lightweight_local_worker:
model: MiMo V2.6 Distill-Qwen-9B
effort: "thinking on"
large_local_optional:
model: Mistral Medium 3.5
effort: high
rule: "Yalnızca RAM/VRAM kapasitesi yeterliyse çalıştırın"
7. Temel Router Kuralları
Tek bir modele takılıp kalmak yerine şu deterministik mantığı işletin:
Kural A — Belirsizlik Derecesi
- Düşük Belirsizlik + Mekanik İş: Luna / Qwen Flash / DeepSeek Flash.
- Normal Mühendislik Görevi: Sol / Sonnet / DeepSeek.
- Yüksek Belirsizlik: Opus 5.5.
- Yüksek Belirsizlik + Geniş İş/Ürün Etkisi: Astra.
Kural B — Kapsam (Scope)
- Tek dosya / Tek fonksiyon: Düşük maliyetli işçi (Luna / DeepSeek).
- Tek modül / Belirli bir özellik: Sol / Sonnet / DeepSeek.
- Çoklu modül / Mimari sınırlar: Opus / Kimi / GLM tam sürüm.
- Tüm ürün / Sistemler arası entegrasyon: Astra / Opus / Fable.
Kural C — Başarısızlık Eskalasyonu
1. Deneme: Göreve uygun en ekonomik model
↓ başarısız
2. Deneme: Daha güçlü model veya daha yüksek akıl yürütme (reasoning)
↓ başarısız
3. Deneme: Yalnızca eforu artırmakla kalmayın, MODEL AİLESİNİ DEĞİŞTİRİN
↓ başarısız
Kök Neden İncelemesi: Opus 5.5 / Fable 5.1 / Astra
Önemli: Bir ajanın aynı bozuk yaklaşımı 10 kez üst üste denemesine asla izin vermeyin.
Kural D — Hatanın Maliyeti
- Kozmetik / Kolay Geri Alınabilir: Ucuz işçi.
- Standart Üretim Kodu: Sol / DeepSeek + Otomatik Testler.
- Veri Taşıma / Kimlik Doğrulama / Yetkilendirme / Faturalama: Zorunlu Opus High İncelemesi.
- Güvenlik / Geri Dönüşsüz İşlemler / Canlı Yayına Çıkış: Bağımsız Frontier İncelemesi (Astra / Fable).
Kural E — Modalite (Veri Biçimi)
- Yalnızca Metin ve Kod: Sol / Opus / DeepSeek / GLM / Kimi.
- Ekran Görüntüsü / UI: GLM Flash / Step / Gemini.
- Tarayıcı / Bilgisayar Kullanımı: Astra / Gemini / MiniMax / Step.
- Ses / Video: Gemini / MiMo / Kimi / Qwen Omni.
Kural F — Gizlilik & KVKK
- Mutlak Şirket İçi / Veri Dışarı Çıkamaz: Qwen 3.8 27B (Hafif işlerde MiMo Distill).
- Buluta İzin Verilen Kodlar: Yukarıdaki rotalanmış filo.
8. Max / XHigh Efor Ne Zaman Kullanılmalı — Ne Zaman Kullanılmamalı?
Doğru Max / XHigh Kullanım Alanları
- Gelecekteki birçok modülü etkileyecek kritik mimari kararlar.
- Dev bir kod deposunda kapsamlı çerçeve veya altyapı taşımaları.
- Çoklu denemelerden sonra çözülememiş inatçı kök neden hataları.
- Kritik güvenlik denetimleri ve canlıya geçiş kabulü.
- 30-60 dakikalık uzun ufuklu otonom yazılım görevleri.
- Yıkıcı veya geri dönüşü olmayan operasyonların son onayı.
Yanlış Max / XHigh Kullanım Alanları (Kaynak İsrafı)
- Değişken adı değiştirme (rename variable).
- Şablon ve standart CRUD kodları yazma.
- Sıradan birim testleri (unit tests) üretme.
- CSS boşluk veya renk ince ayarları (padding, margin).
- Log dosyalarından basit metin veya hata satırı ayıklama.
- JSON veya YAML dosyalarını yeniden biçimlendirme.
- Zaten açık olan koddan dokümantasyon üretme.
Özet: Basit işlerde en üst modeli Max seviyesinde çalıştırmak "daha güvenli yazılım" sağlamaz; yalnızca kaynak ve kota israfıdır.
9. Artık Birincil Varsayılan Yapmayacağım Model Aileleri
Bu modeller hala eski sistemlerde bulunabilir ancak 25 Eylül 2026 itibarıyla router varsayılanı olarak değiştirilmelidir:
| Eski Nesil Model | Artık Tercih Edilen | Değişim Gerekçesi |
|---|---|---|
| DeepSeek V4 Flash | DeepSeek V4.1 Flash | 10 Eylül sürüm notu: deepseek-flash → V4.1 Flash; eski V4 Flash adları geçici olarak yönlendirilir |
| Claude Opus 5 | Claude Opus 5.5 | Çok daha üstün mimari sentez ve araç çağırma kabiliyeti |
| Claude Fable 5 | Claude Fable 5.1 | Güncel uzun ufuklu eskalasyon sürümü |
| Gemini 3.6 / 3.7 Flash | Gemini 3.8 Flash | Güncel, kararlı ve ana akım çok modlu Flash modeli |
| GLM 5.2 | GLM-5.3 / 5.3 Flash | Çok daha güçlü kodlama ve UI anlama yeteneği |
| MiniMax M2 / M2.5 | MiniMax M3 | Model mimarisi en çok 1M; Ollama Cloud katalogunda 512K (4 Ekim 2026). Performansı kendi kabul testinizde ölçün. |
| Haiku 4.5 | Luna / Qwen Flash / DeepSeek | Haiku 4.5 kontrol tarihinde Active; resmî yaşam döngüsü kesin emeklilik tarihi bildirmiyor |
| Qwen 3.6 / 3.7 | Qwen 3.8 Ailesi | Güncel nesil |
10. Pratik Senaryo Reçeteleri
Reçete A: “Bir fikrim var ama tam olarak ne inşa edeceğimi bilmiyorum”
- Astra High: Yönleri üretir, alternatif iş modellerini araştırır.
- Opus High: Fikirleri yapılandırır ve çürütme (red-team) testine tabi tutar.
- Astra High: Stratejik belirsizlikleri çözer.
- İnsan (Yönetici): Nihai hedefi seçer.
- Opus: Ana orkestratör görevini üstlenir.
Reçete B: “Bu uygulamayı sıfırdan inşa et”
- Opus High: Gereksinimler + Sistem Mimarisi.
- Sol Medium: Ana uygulama omurgası ve API'ler.
- GLM-5.3 Flash High: Kullanıcı arayüzü (UI).
- DeepSeek High + Luna Low/Medium: Paralel testler ve mekanik görevler.
- Opus High: Entegrasyon ve bağımsız kod incelemesi.
- Astra High: Tarayıcı üzerinden ürün seviyesinde kabul testi.
Reçete C: “Proje zaten çok büyük ve kritik bir yerinde patlıyor”
- Opus High: Repo haritasını çıkarır, olası kök nedenleri listeler.
- Opus XHigh (Gerekirse): Düzeltici mimariyi tasarlar.
- Sol / DeepSeek / Kimi İşçileri: Sınırları net düzeltmeleri uygular.
- Opus High: Değişiklikleri ve yan etkileri doğrular.
- Astra High: Tüm testler geçtikten sonra uçtan uca kabul onayı verir.
Reçete D: “Kullanıcı arayüzünü (UI) çok daha üst seviyeye taşı”
- Astra Medium/High: UX hiyerarşisi ve problem tanımı.
- Opus High: Ekran, durum ve bileşen mimarisi.
- GLM-5.3 Flash High/Max: Görsel olarak uygular ve ekran görüntüsüyle iterasyon yapar.
- Step 3.7 / Gemini 3.8 High: Gerekirse bağımsız görsel ikinci görüş sunar.
- Opus High: Sürdürülebilirlik ve erişilebilirlik (a11y) denetimi yapar.
Reçete E: “Çok sayıda ajanı en düşük maliyetle paralel çalıştır”
- Opus Medium: Yalnızca süpervizör / koordinatör olarak kalır.
- DeepSeek V4.1 Flash High: Kodlama alt-işçilerini yönetir.
- Luna Low/Medium: Mekanik işleri üstlenir.
- GLM Flash High: UI işlerini yapar.
- Kimi K3 High/Max: Sadece devasa bağlam gerektiren zorlu işlerde devreye girer.
- Opus: Her şeyi kendisi yapmak yerine yalnızca istisnaları çözer.
11. Nihai Özet ve Tek Satırlık Zihinsel Model
En büyük hata, 30 modelden oluşan dev bir menü yaratıp her işlemde bir insanın karar vermesini beklemektir. Rolleri tanımlayın ve rolleri modellere eşleyin:
Astra neyin önemli olduğuna karar verir → Opus kurgular ve orkestre eder → Sol inşa eder → DeepSeek ve Luna ucuz paralel işleri yapar → GLM Flash arayüzü çıkarır → Kimi ve GLM tam sürüm zor açık ajan işlerini üstlenir → Opus bağımsız inceler → Astra bitmiş ürünü kabul eder.
Bu mimari; model seçimini tam zamanlı bir mesaiye dönüştürmeden, global yapay zekâ pazarının en ileri imkanlarından en yüksek verim ve en düşük maliyetle faydalanmanızı sağlar.
Kaynak Belgesi: AI Model Routing Handbook — Virtual Goods (VG) AI Engineering Edition.
Kurulumdan önce iki kontrol
Codex / Ollama araç çağırma doğrulaması ile yürütmeyi; AI uygulama ve pilot kapsamı ile gerçek iş kabul kriterlerini netleştirin.
Bağlam limiti için Ollama context length; model durumu için Claude yaşam döngüsü. Kontrol: 4 Ekim 2026.