Přeskočit na obsah

Lekce 02.10: Výběr modelu: Flash vs. Pro vs. Sonnet (Choosing A Model)

⏱️ 3 min čtení Lekce 02.10

🧠 Mentální model & teoretický rozbor

V éře moderního AI inženýrství neexistuje „jeden model na všechno“. Efektivní softwarový inženýr přemýšlí o modelech jako o sadě specializovaných nástrojů v dílně:

┌─────────────────────────────────────────────────────────────────────────┐
│ TĚŽKÁ VÁHA: Gemini 2.5/3.8 Pro (Thinking) / Claude 3.7 Sonnet (Thinking)│
│ Cena: Vyšší | Rychlost: Střední (uvažování) | Inteligence: Maximální │
│ Použití: Architektura, komplexní byznys logika, refaktor více modulů │
├─────────────────────────────────────────────────────────────────────────┤
│ LEHKÁ VÁHA: Gemini 2.5/3.8 Flash / Claude 3.5 Haiku │
│ Cena: Minimální (1/10) | Rychlost: Blesková | Inteligence: Solidní │
│ Použití: Subagenti, vyhledávání v souborech, generování testovacích dat │
└─────────────────────────────────────────────────────────────────────────┘

Pokud používáte těžkou váhu na hledání souborů na disku, pálíte peníze i čas. Pokud používáte lehkou váhu na refaktoring jádra aplikace, zanesete do projektu nekvalitní kód a chyby.


🏢 Realistický scénář z praxe

Projektový tým potřebuje provést audit 200 konfiguračních souborů a zjistit, které z nich obsahují zastaralé verze závislostí:

  • Špatná strategie: Pustit hlavní uvažující model (Gemini Pro / Claude 3.7 Sonnet) na postupné čtení všech 200 souborů. (Trvání: 10 minut, vysoká spotřeba tokenů).
  • Inženýrská strategie: Vyvolat subagenta běžícího na Gemini Flash (nebo Haiku), který během 20 sekund projde všech 200 souborů, vyfiltruje 6 problematických a předá je hlavnímu modelu k provedení samotného refaktoru. (Trvání: 45 sekund, zlomek ceny).

💻 Konkrétní ukázky kódu & promptů

Konfigurace a přepínání modelů v praxi:

Terminál
# V Antigravity CLI (agy):
# Nastavení modelu v sezení nebo konfiguraci settings.json
agy
# V Claude Code:
claude --model claude-3-5-haiku-20241022
claude --model claude-3-7-sonnet-20250219

Rozhodovací tabulka pro volbu modelu:

ÚkolPrimární volba (Gemini)Alternativa (Claude)Proč
Hledání výskytů proměnné v repozitářiGemini FlashClaude 3.5 HaikuJde o čisté filtrování textu, nevyžaduje uvažování
Tvorba Zod validačních schémat z SQLGemini ProClaude 3.5 / 3.7 SonnetVyžaduje přesné mapování datových typů
Refaktoring asynchronního front-endu s WebSocketsGemini Pro (Thinking)Claude 3.7 Sonnet (Thinking)Vyžaduje hlubokou analýzu race conditions
Generování 20 mock uživatelů pro testyGemini FlashClaude 3.5 HaikuTriviální generování dat

⚠️ Analýza selhání & Anti-patterns

Chyba: Ponechání slabého modelu na celou práci kvůli úspoře

Někteří vývojáři ve snaze ušetřit nastaví lehký model na veškeré kódování.

  • Model opakovaně selhává v komplexních testech.
  • Vývojář stráví 10 pokusů naváděním modelu.
  • Výsledek: Ve finále spotřebuje více tokenů a času, než kdyby použil Pro / Sonnet jednou a pořádně na první pokus!

🛠️ Inženýrský postup krok za krokem (Playbook)

  1. Výchozí volba: Nastavte si jako standardní pracovní kůň Gemini Pro nebo Gemini Flash High (resp. Claude 3.5/3.7 Sonnet).
  2. Delegování: Mechanické a vyhledávací operace delegujte na subagenty s modelem Flash.
  3. Eskalace: Těžké algoritmické oříšky řešte se zapnutým Extended Thinking.

🧪 Praktické cvičení (Hands-on Lab)

Úkol:

Porovnejte rychlost a kvalitu odpovědi rychlého a uvažujícího modelu na stejném úkolu.

Kroky:

  1. Zadejte agentovi: „Navrhni Zod validační schéma pro vnořený nákupní košík s kupóny a slevami.“
  2. Poznamenejte si rychlost odpovědi a hloubku edge cases.
  3. Poté vyzvěte model s instrukcí pro hluboké uvažování: „Použij hluboké uvažování a najdi v tomto schématu skryté slabiny týkající se manipulace s cenami a zápornými částkami.“
  4. Porovnejte rozdíl v inženýrské hloubce.