← vg.com.tr / Kaynaklar
VG SAHA NOTLARI · 25 EYLÜL 2026 · GÜNCEL SÜRÜM

Yazılım Mimarları, Mühendislik Liderleri ve Otonom Ajan Geliştiricileri İçin Model Yönlendirme Rehberi.

AI Model Yönlendirme (Routing) El Kitabı — 25 Eylül 2026

Model filoları ve rol eşleştirmeleri 25 Eylül 2026 tarihli editoryal rota örnekleridir. Her modelin bugün hesabınızda mevcut olduğu veya aynı isimle API’ye çağrılabildiği anlamına gelmez. Burada yeni bir VG karşılaştırma testi raporlanmıyor. Gerçek model kimliğini, fiyatı ve bağlam limitini sağlayıcıdan kontrol edip kendi görev örneklerinizde ölçün.

Amaç: Ürün vizyonu, araştırma, mimari tasarım, orkestrasyon, kodlama, kullanıcı arayüzü (UI), kök neden hata ayıklama, test, kod inceleme ve otonom ajan (agent) operasyonları için pratik model seçimi.

Varsayılan Birincil Ortam: Windows üzerinde Codex + Claude Code + Ollama Cloud/Local; diğer tüm model ve API'ler opsiyonel alternatifler ve eskalasyon katmanları olarak konumlandırılmıştır.

Bu doküman pazardaki her model uç noktasının sıradan bir listesi değildir. 25 Eylül 2026 tarihi itibarıyla yazılım, ürün geliştirme ve otonom ajan mimarilerinde değerlendirilmeye değer model ailelerinin güncel ve pratik bir sahadan derlenmiş kataloğudur. Anlık model sürümleri (snapshot), kotalar, fiyatlandırmalar ve barındırılan bağlam (context) limitleri değişkenlik gösterebilir. Kıyaslama (benchmark) puanları görev ve harness bağımlı olduğu için bilinçli olarak tek bir mutlak sıralama ölçütü olarak kullanılmamıştır.


1. Yönetici Özeti — Gerçekte Çalıştıracağım Model Filosu

Amaç sürekli manuel model seçmekle vakit kaybetmek yerine, işi fikirden doğrulanmış sürüme taşımaksa şu operasyonel hiyerarşiyi uygulayın:

Rol / Görev Birincil Model Normal Efor Eskalasyon / Alternatif
Baş Stratejist / En Zor & Belirsiz Problem GPT-6 Astra High Fable 5.1 High/XHigh, Grok 4.7 High/XHigh
Ana Orkestratör (Supervisor) Claude Opus 5.5 Medium Kimi K3 High, Fable 5.1 High
Ürün Yapısı / Bilgi Mimarisi (IA) Claude Opus 5.5 High Astra High, Fable 5.1 High, Kimi K3 High
Yazılım Mimarı Claude Opus 5.5 High Fable 5.1 High/XHigh, Astra High, GLM-5.3 Max
Günlük Rutin Geliştirme (Implementation) GPT-6 Sol Medium Sonnet 5 High, DeepSeek V4.1 Flash High
Hızlı / Düşük Maliyetli Kapsamlı İşler GPT-6 Luna Low/Medium Qwen 3.8 Flash Medium, DeepSeek V4.1 Flash High
Zorlu Kodlama / Büyük Refactoring Opus 5.5 High/XHigh Fable 5.1 XHigh, Kimi K3 Max, GLM-5.3 Max
Kullanıcı Arayüzü (UI) / Görsel Kodlama GLM-5.3 Flash High Step 3.7 Flash High, Gemini 3.8 Flash High, Kimi K3 High
Ekran Görüntüsünden Koda / Görsel Hata Ayıklama GLM-5.3 Flash High/Max Step 3.7 Flash High, Gemini 3.8 Flash High, MiMo V2.6 Flash
Düşük Maliyetli Paralel Kodlama İşçisi DeepSeek V4.1 Flash High Qwen 3.8 Flash, Kimi K2.8, GLM-5.3 Flash
Açık / Bulut Kıdemli Yazılımcı (Senior) GLM-5.3 High/Max Kimi K3 Max, DeepSeek V4.1 Flash Max
Uzun Süreli Açık Kaynak Ajan (Long Agent) Kimi K3 High/Max MiniMax M3, Nemotron 3 Ultra, GLM-5.3
Kök Neden Hata Ayıklayıcısı (Root-Cause) Opus 5.5 High/XHigh Fable 5.1, Astra High, Kimi K3 Max
Kod İnceleyici (Code Reviewer) Opus 5.5 High Fable 5.1 High, Astra High, GLM-5.3 Max
Güvenlik & Güvenilirlik İncelemesi Fable 5.1 / Opus 5.5 High/XHigh Astra High/XHigh, GLM-5.3 Max
Tarayıcı / Bilgisayar Kullanımı (Computer-Use) QA GPT-6 Astra High Gemini 3.8 Flash High, MiniMax M3, Step 3.7 Flash High
Yerel / Gizli (Private) Genel Model Qwen 3.8 27B Medium/XHigh MiMo V2.6 Distill-Qwen-9B, Mistral Medium 3.5
Nihai Sürüm Kabulü (Release Acceptance) Astra High + Bağımsız Opus High İncelemesi High Kritik sistemlerde Fable ek kontrolü

Mevcut Aboneliklerinizde En Çok Önem Taşıyan 6 Model

Mümkün olan en yalın yönlendiriciyi (router) kurmak istiyorsanız şu 6 modelle başlayın:

  1. GPT-6 Astra (High): Strateji, belirsizlik, nihai entegrasyon, bilgisayar/tarayıcı QA.
  2. Claude Opus 5.5 (Medium/High): Ana orkestratör, mimari, kök neden analizi, bağımsız kod incelemesi.
  3. GPT-6 Sol (Medium): Varsayılan üretim geliştiricisi (default builder).
  4. GPT-6 Luna (Low/Medium): Ucuz, sınırları belirli mekanik işler ve testler.
  5. DeepSeek V4.1 Flash (High): Ollama Cloud üzerinden çok ucuz paralel kodlama işçisi.
  6. GLM-5.3 Flash (High): Ollama Cloud üzerinden arayüz (UI) ve görsel geliştirme işçisi.

Ardından Kimi K3, GLM-5.3 tam sürüm, Sonnet 5 ve duruma göre Fable 5.1'i uzmanlaşmış alternatif ve eskalasyon katmanı olarak ekleyin.


2. Akıl Yürütme (Reasoning) ve Efor Seviyelerinin Normalizasyonu

Farklı sağlayıcılar farklı efor anahtarları kullanır. Bir sağlayıcıdaki high seçeneğini diğerindekiyle sayısal veya operasyonel olarak asla eşdeğer tutmayın.

Dahili router mimarisinde şu standartlaştırılmış ölçeği kullanın:

Dahili Seviye Anlamı Tipik İş Türü
E0 — Off/None Planlı akıl yürütme bütçesi yok Biçimlendirme, deterministik dönüşümler, önemsiz metin düzenlemeleri
E1 — Low Hızlı ve sınırları belirli mantık yürütme Veri çıkarma, boilerplate üretimi, basit testler, ufak yamalar
E2 — Medium Dengeli varsayılan Standart kodlama, olağan planlama, rutin hata ayıklama
E3 — High Derin odaklanma Mimari tasarım, karmaşık kodlama, UI mantığı, zorlu hata ayıklama
E4 — XHigh/Deep Uzun soluklu derin muhakeme Büyük taşımalar (migration), kök neden tespiti, güvenlik analizi, uzun ajanlar
E5 — Max İstisnai / Aşırı karmaşık Çözülememiş en zor görevler, ikinci göz soruşturması; asla günlük varsayılan değildir

Sağlayıcılara göre doğrulanan kontroller

Kontrol tarihi: 4 Ekim 2026. Arayüzdeki efor etiketi ile API parametresi aynı şey olmayabilir. Uygulama, model ve uç noktanın desteklediği seçenekleri kullanın.

OrtamKontrol ve kapsamKaynak
OpenAI / Codexmodel_reasoning_effort: modelin bildirdiği seviyeler; belgede low, medium, high, xhigh, max ve ultra örnekleri var. Sabit tüm-model listesi değil.Codex yapılandırma referansı
Claude Fable 5.1, Opus 5.5, Sonnet 5output_config.effort: low, medium, high, xhigh, max. Opus 5.5 varsayılanı medium; desteklenen diğer modellerde high. Kapsam model bazında kontrol edilmeli.Claude effort
DeepSeek / Responses ve Chat CompletionsResponses: reasoning.effort none/low/high/max; Chat Completions: düşünme açık/kapalı ve reasoning_effort low/high/max. Aynı alanı her API biçimine kopyalamayın.DeepSeek thinking mode
Gemini 3.8 Flash / 3.1 Pro Previewthinking_level: low, medium, high. Flash varsayılanı medium; Pro Preview high.Gemini thinking
Diğer sağlayıcılar ve Ollama rotalarıAşağıdaki model kataloğunda verilen eforlar VG yönlendirme önerisidir. Bu kontrolde tüm uç noktaların native seçenekleri doğrulanmadı. Desteklenmeyen seviyeyi göndermek yerine model kataloğu ve bir araç çağırma testiyle doğrulayın.Ollama / Codex profili

Altın Kural

Her şeyi körü körüne "Max" seviyesine ayarlamayın. Max seviyesi daha yavaştır, kotanızı hızla tüketir ve çoğu zaman gereksiz keşif döngülerine yol açar. Kabul testlerinizden güvenle geçen en düşük seviyeyle başlayın, sadece başarısızlık durumunda eskalasyona gidin.


3. Kapsamlı Pratik Model Kataloğu

OpenAI / Codex

GPT-6 Astra

GPT-6 Sol

GPT-6 Luna


Anthropic / Claude Code

Claude Fable 5.1

Claude Opus 5.5

Claude Sonnet 5

Claude Haiku 4.5


Moonshot / Kimi

Kimi K3

Kimi K2.8 Preview

Kimi K2.7 Code HighSpeed


DeepSeek

DeepSeek V4.1 Flash

DeepSeek V4 Pro


Z.ai / GLM

GLM-5.3

GLM-5.3 Flash


Alibaba / Qwen

Qwen 3.8 Max

Qwen 3.8 Flash

Qwen 3.8 27B Local


Diğer Önemli Aileler (Özet)


4. Görev Görev Yönlendirme (Routing) Matrisi

Bu matrisi doğrudan bir router algoritmasına veya config dosyasına dönüştürebilirsiniz:

Görev Türü Birincil Model Efor Seviyesi İkinci Tercih Düşük Maliyetli / Açık Alternatif
Ürün / İş Fikri Üretimi Astra High Fable 5.1 High Kimi K3 High/Max
Fırsat Keşfi / Yeni Sentezler Astra High/XHigh Grok 4.7 High/XHigh Kimi K3 Max
Derin Pazar Araştırması Astra High Fable / Gemini 3.8 High Kimi K3 High
Fikri Çürütme (Red-Teaming) Opus 5.5 High Fable High GLM-5.3 Max
Gereksinimleri Netleştirme Opus 5.5 Medium Sol Medium Kimi K3 High
PRD / Fonksiyonel Şartname Opus 5.5 High Sol High Kimi K3 High
Ürün Yapısı / Bilgi Mimarisi Opus 5.5 High Fable/Astra High Kimi K3 High
Kullanıcı Yolculukları / Akışlar Opus 5.5 High Astra High Gemini 3.8 High
UX Ürün Düşüncesi Astra Medium/High Fable High Gemini 3.8 High
Sistem Mimarisi Opus 5.5 High Fable/Astra High GLM-5.3 Max / Kimi K3 Max
Yazılım Mimarisi Opus 5.5 High Fable XHigh GLM-5.3 Max
API / Şema Sınırları Opus 5.5 High Sol High DeepSeek V4.1 High
Orkestratör / Süpervizör Opus 5.5 Medium Fable High Kimi K3 High / Nemotron
Hedefi Alt Görevlere Bölme Opus 5.5 Medium Sol Medium Luna Medium / Kimi K3 High
Hangi Ajanın Çalışacağına Karar Verme Opus 5.5 Medium Kimi K3 High Nemotron / MiniMax M3
Günlük Standart Kodlama Sol Medium Sonnet 5 High DeepSeek V4.1 High
Backend / API Geliştirme Sol Medium Sonnet 5 High DeepSeek / Qwen Flash
Veritabanı Taşımaları (Migration) Sol High Opus High DeepSeek High
Küçük Kod Yamaları Luna Low/Medium Sol Low Qwen Flash Medium
Şablon / Kazan Dairesi Kod (Boilerplate) Luna Low DeepSeek Low MiMo Flash / Qwen Flash
Büyük Özellik Geliştirme Sol Medium/High Opus High Kimi K3 High / GLM-5.3 High
Büyük Kod Deposu Refactoring Opus 5.5 High/XHigh Fable XHigh Kimi K3 Max / GLM-5.3 Max
Çatı (Framework) Değişimi Opus 5.5 XHigh Fable XHigh Kimi K3 Max
Rutin Hata Ayıklama (Debug) Sol Medium/High Sonnet 5 High DeepSeek High
İnatçı / Tekrarlayan Hatalar Opus 5.5 High Astra High Kimi K3 Max
Kök Neden Hata Ayıklama Opus 5.5 High/XHigh Fable XHigh GLM-5.3 Max
Test Senaryosu Üretimi Luna Low/Medium DeepSeek High Qwen Flash / MiMo Distill
Fikstür ve Mock Veri Üretimi Luna Low DeepSeek Low Qwen Flash
Başarısız Testleri Teşhis Etme Sol High Opus High DeepSeek Max
Kod İnceleme (Code Review) Opus 5.5 High Fable High GLM-5.3 Max / Kimi K3 Max
Güvenlik / Güvenilirlik Denetimi Fable / Opus High/XHigh Astra High/XHigh GLM-5.3 Max
DevOps / CI-CD Hatları Sol Medium/High Opus High DeepSeek High / Step Medium
Terminal / Sunucu Sorun Giderme Sol High Opus High GLM-5.3 High
UI Kavramı / Hiyerarşi Astra Medium/High Opus High Gemini 3.8 High
UI Bileşenlerini Kodlama GLM-5.3 Flash High Sonnet 5 High Step 3.7 High
Ekran Görüntüsü → Kod GLM-5.3 Flash High/Max Step 3.7 High Gemini 3.8 High / MiMo Flash
Görsel UI Hata Ayıklama GLM-5.3 Flash High/Max Step 3.7 High MiniMax M3 / Gemini 3.8 High
Tarayıcı / Masaüstü Kullanımı QA Astra High Gemini 3.8 High MiniMax M3 / Step 3.7 High
Çok Modlu Doküman / PDF Analizi Gemini 3.8 Flash High Astra High Kimi K3 / MiMo Pro
Ses / Video Ağırlıklı Ajan İşi Gemini 3.8 / MiMo High / Thinking Kimi K3 Qwen Omni Flash
Dokümantasyon Üretimi Luna Low/Medium Sol Low Qwen Flash
Bilgi Tabanı Özetleme Luna Medium Gemini 3.8 Medium Qwen Flash
Uzun Süreli Otonom Kodlama Fable / Opus XHigh Astra XHigh Kimi K3 Max / GLM-5.3 Max
Uzun Süreli Açık Kaynak Ajan Kimi K3 Max GLM-5.3 Max Nemotron / MiniMax M3
Düşük Maliyetli Paralel Alt-Ajan Luna Low/Medium DeepSeek High Qwen Flash / K2.8
Gizli / Yerel Repo Geliştirme Qwen 3.8 27B Medium/XHigh MiMo Distill 9B Mistral Medium 3.5 (Donanım yeterse)
Nihai Sürüm Onayı ve Kabul Astra High Bağımsız Opus High Kritik sistemlerde Fable High

5. Fikirden Bitmiş Ürüne Uçtan Uca İş Akışı

Varsayılan üretim zinciriniz şu şekilde akmalıdır:

KULLANICI HEDEFİ
       │
       ▼
GPT-6 Astra (High)
Strateji / Fırsatlar / Belirsizliklerin Giderilmesi
       │
       ▼
Claude Opus 5.5 (High)
Ürün Yapısı + Fonksiyonel Gereksinimler
       │
       ▼
Claude Opus 5.5 (High)
Sistem ve Yazılım Mimarisi
       │
       ▼
Claude Opus 5.5 (Medium)
Ana Orkestratör: Görevleri Böler ve İşçileri Yönlendirir
       │
       ├── GPT-6 Sol (Medium) ─────────── Ana uygulama ve backend
       ├── Claude Sonnet 5 (High) ─────── Hızlı repo görevleri / alt-ajanlar
       ├── DeepSeek V4.1 Flash (High) ─── Ucuz paralel kodlama işçisi
       ├── GPT-6 Luna (Low/Medium) ────── Testler / fikstürler / dönüşümler
       ├── GLM-5.3 Flash (High) ───────── UI / Görsel bileşen kodlama
       ├── Kimi K3 (High/Max) ─────────── Dev bağlam (1M) veya uzun açık ajanlar
       └── Qwen 3.8 27B (Medium/XHigh) ── Yerel ve gizli şirket içi kodlar
       │
       ▼
Claude Opus 5.5 (High)
Bağımsız Kod İncelemesi / Kök Neden Doğrulaması
       │
       ▼
GPT-6 Astra (High)
Ürün Seviyesinde Kabul + Tarayıcı/Masaüstü QA
       │
       ▼
NİHAİ SÜRÜM & YAYINLAMA

Önemli İlke: Geliştirici Kendi Kendini İncelememelidir!

Asla bir modelin kendi ürettiği kodu tek başına onaylamasına izin vermeyin. Zorunlu bağımsız inceleme eşleşmeleri:

Kodu Yazan (Builder) İnceleyen (Reviewer)
GPT-6 Sol Claude Opus 5.5
Claude Sonnet 5 Claude Opus 5.5 / GPT-6 Astra
DeepSeek V4.1 Flash GPT-6 Sol / Claude Opus 5.5
GLM-5.3 Flash Opus 5.5 + Gerektiğinde Astra/Gemini ile görsel kabul
Kimi K3 Claude Opus 5.5 / GPT-6 Astra
Claude Opus 5.5 GPT-6 Astra / Claude Fable 5.1
GPT-6 Astra Claude Opus 5.5 (Çapraz sorgulama geçişi)
Qwen Local Gizlilik politikası izin veriyorsa Sol/Opus bulut incelemesi

6. Mevcut Abonelikleriniz İçin Önerilen Ön Tanımlar (YAML)

Codex / OpenAI Konfigürasyonu

codex:
  default_builder:
    model: GPT-6 Sol
    effort: medium

  cheap_worker:
    model: GPT-6 Luna
    effort: low
    escalate_to: medium

  hard_problem:
    model: GPT-6 Astra
    effort: high

  final_acceptance:
    model: GPT-6 Astra
    effort: high

  emergency_escalation:
    model: GPT-6 Astra
    effort: xhigh
    rule: "Yalnızca ciddi bir High denemesinden sonra veya kritik güvenlik denetimlerinde devreye girer"

Claude Code Konfigürasyonu

claude_code:
  orchestrator:
    model: Claude Opus 5.5
    effort: medium

  architect:
    model: Claude Opus 5.5
    effort: high

  senior_debugger:
    model: Claude Opus 5.5
    effort: high
    escalate_to: xhigh

  reviewer:
    model: Claude Opus 5.5
    effort: high

  implementation_subagent:
    model: Claude Sonnet 5
    effort: high

  premium_escalation:
    model: Claude Fable 5.1
    effort: high
    escalate_to: xhigh
    rule: "Yalnızca Opus yetersiz kaldığında veya görev olağandışı uzun/kritik olduğunda devreye girer"

Ollama Cloud Konfigürasyonu

ollama_cloud:
  cheap_coding_worker:
    model: deepseek-v4.1-flash:cloud
    effort: high

  open_senior_coder:
    model: glm-5.3:cloud
    effort: high
    escalate_to: max

  visual_ui_worker:
    model: glm-5.3-flash:cloud
    effort: high
    escalate_to: max

  long_context_agent:
    model: kimi-k3:cloud
    effort: high
    escalate_to: max

  alternative_long_agent:
    model: minimax-m3:cloud
    effort: "thinking on / harness budget"

  orchestration_research_alternative:
    model: nemotron-3-ultra:cloud
    effort: "thinking on / derin bütçe yalnızca haklı durumlarda"

Ollama Local (Yerel Donanım)

ollama_local:
  practical_private_default:
    model: Qwen 3.8 27B
    effort: medium
    escalate_to: xhigh

  lightweight_local_worker:
    model: MiMo V2.6 Distill-Qwen-9B
    effort: "thinking on"

  large_local_optional:
    model: Mistral Medium 3.5
    effort: high
    rule: "Yalnızca RAM/VRAM kapasitesi yeterliyse çalıştırın"

7. Temel Router Kuralları

Tek bir modele takılıp kalmak yerine şu deterministik mantığı işletin:

Kural A — Belirsizlik Derecesi

Kural B — Kapsam (Scope)

Kural C — Başarısızlık Eskalasyonu

1. Deneme: Göreve uygun en ekonomik model
        ↓ başarısız
2. Deneme: Daha güçlü model veya daha yüksek akıl yürütme (reasoning)
        ↓ başarısız
3. Deneme: Yalnızca eforu artırmakla kalmayın, MODEL AİLESİNİ DEĞİŞTİRİN
        ↓ başarısız
Kök Neden İncelemesi: Opus 5.5 / Fable 5.1 / Astra

Önemli: Bir ajanın aynı bozuk yaklaşımı 10 kez üst üste denemesine asla izin vermeyin.

Kural D — Hatanın Maliyeti

Kural E — Modalite (Veri Biçimi)

Kural F — Gizlilik & KVKK


8. Max / XHigh Efor Ne Zaman Kullanılmalı — Ne Zaman Kullanılmamalı?

Doğru Max / XHigh Kullanım Alanları

Yanlış Max / XHigh Kullanım Alanları (Kaynak İsrafı)

Özet: Basit işlerde en üst modeli Max seviyesinde çalıştırmak "daha güvenli yazılım" sağlamaz; yalnızca kaynak ve kota israfıdır.


9. Artık Birincil Varsayılan Yapmayacağım Model Aileleri

Bu modeller hala eski sistemlerde bulunabilir ancak 25 Eylül 2026 itibarıyla router varsayılanı olarak değiştirilmelidir:

Eski Nesil Model Artık Tercih Edilen Değişim Gerekçesi
DeepSeek V4 Flash DeepSeek V4.1 Flash 10 Eylül sürüm notu: deepseek-flash → V4.1 Flash; eski V4 Flash adları geçici olarak yönlendirilir
Claude Opus 5 Claude Opus 5.5 Çok daha üstün mimari sentez ve araç çağırma kabiliyeti
Claude Fable 5 Claude Fable 5.1 Güncel uzun ufuklu eskalasyon sürümü
Gemini 3.6 / 3.7 Flash Gemini 3.8 Flash Güncel, kararlı ve ana akım çok modlu Flash modeli
GLM 5.2 GLM-5.3 / 5.3 Flash Çok daha güçlü kodlama ve UI anlama yeteneği
MiniMax M2 / M2.5 MiniMax M3 Model mimarisi en çok 1M; Ollama Cloud katalogunda 512K (4 Ekim 2026). Performansı kendi kabul testinizde ölçün.
Haiku 4.5 Luna / Qwen Flash / DeepSeek Haiku 4.5 kontrol tarihinde Active; resmî yaşam döngüsü kesin emeklilik tarihi bildirmiyor
Qwen 3.6 / 3.7 Qwen 3.8 Ailesi Güncel nesil

10. Pratik Senaryo Reçeteleri

Reçete A: “Bir fikrim var ama tam olarak ne inşa edeceğimi bilmiyorum”

  1. Astra High: Yönleri üretir, alternatif iş modellerini araştırır.
  2. Opus High: Fikirleri yapılandırır ve çürütme (red-team) testine tabi tutar.
  3. Astra High: Stratejik belirsizlikleri çözer.
  4. İnsan (Yönetici): Nihai hedefi seçer.
  5. Opus: Ana orkestratör görevini üstlenir.

Reçete B: “Bu uygulamayı sıfırdan inşa et”

  1. Opus High: Gereksinimler + Sistem Mimarisi.
  2. Sol Medium: Ana uygulama omurgası ve API'ler.
  3. GLM-5.3 Flash High: Kullanıcı arayüzü (UI).
  4. DeepSeek High + Luna Low/Medium: Paralel testler ve mekanik görevler.
  5. Opus High: Entegrasyon ve bağımsız kod incelemesi.
  6. Astra High: Tarayıcı üzerinden ürün seviyesinde kabul testi.

Reçete C: “Proje zaten çok büyük ve kritik bir yerinde patlıyor”

  1. Opus High: Repo haritasını çıkarır, olası kök nedenleri listeler.
  2. Opus XHigh (Gerekirse): Düzeltici mimariyi tasarlar.
  3. Sol / DeepSeek / Kimi İşçileri: Sınırları net düzeltmeleri uygular.
  4. Opus High: Değişiklikleri ve yan etkileri doğrular.
  5. Astra High: Tüm testler geçtikten sonra uçtan uca kabul onayı verir.

Reçete D: “Kullanıcı arayüzünü (UI) çok daha üst seviyeye taşı”

  1. Astra Medium/High: UX hiyerarşisi ve problem tanımı.
  2. Opus High: Ekran, durum ve bileşen mimarisi.
  3. GLM-5.3 Flash High/Max: Görsel olarak uygular ve ekran görüntüsüyle iterasyon yapar.
  4. Step 3.7 / Gemini 3.8 High: Gerekirse bağımsız görsel ikinci görüş sunar.
  5. Opus High: Sürdürülebilirlik ve erişilebilirlik (a11y) denetimi yapar.

Reçete E: “Çok sayıda ajanı en düşük maliyetle paralel çalıştır”

  1. Opus Medium: Yalnızca süpervizör / koordinatör olarak kalır.
  2. DeepSeek V4.1 Flash High: Kodlama alt-işçilerini yönetir.
  3. Luna Low/Medium: Mekanik işleri üstlenir.
  4. GLM Flash High: UI işlerini yapar.
  5. Kimi K3 High/Max: Sadece devasa bağlam gerektiren zorlu işlerde devreye girer.
  6. Opus: Her şeyi kendisi yapmak yerine yalnızca istisnaları çözer.

11. Nihai Özet ve Tek Satırlık Zihinsel Model

En büyük hata, 30 modelden oluşan dev bir menü yaratıp her işlemde bir insanın karar vermesini beklemektir. Rolleri tanımlayın ve rolleri modellere eşleyin:

Astra neyin önemli olduğuna karar verir → Opus kurgular ve orkestre eder → Sol inşa eder → DeepSeek ve Luna ucuz paralel işleri yapar → GLM Flash arayüzü çıkarır → Kimi ve GLM tam sürüm zor açık ajan işlerini üstlenir → Opus bağımsız inceler → Astra bitmiş ürünü kabul eder.

Bu mimari; model seçimini tam zamanlı bir mesaiye dönüştürmeden, global yapay zekâ pazarının en ileri imkanlarından en yüksek verim ve en düşük maliyetle faydalanmanızı sağlar.


Kaynak Belgesi: AI Model Routing Handbook — Virtual Goods (VG) AI Engineering Edition.

Kurulumdan önce iki kontrol

Codex / Ollama araç çağırma doğrulaması ile yürütmeyi; AI uygulama ve pilot kapsamı ile gerçek iş kabul kriterlerini netleştirin.

Bağlam limiti için Ollama context length; model durumu için Claude yaşam döngüsü. Kontrol: 4 Ekim 2026.

Virtual Goods (VG) — AI Transformation & Implementation Partner