Lekce 02.10: Výběr modelu: Flash vs. Pro vs. Sonnet (Choosing A Model)
🧠 Mentální model & teoretický rozbor
V éře moderního AI inženýrství neexistuje „jeden model na všechno“. Efektivní softwarový inženýr přemýšlí o modelech jako o sadě specializovaných nástrojů v dílně:
┌─────────────────────────────────────────────────────────────────────────┐│ TĚŽKÁ VÁHA: Gemini 2.5/3.8 Pro (Thinking) / Claude 3.7 Sonnet (Thinking)││ Cena: Vyšší | Rychlost: Střední (uvažování) | Inteligence: Maximální ││ Použití: Architektura, komplexní byznys logika, refaktor více modulů │├─────────────────────────────────────────────────────────────────────────┤│ LEHKÁ VÁHA: Gemini 2.5/3.8 Flash / Claude 3.5 Haiku ││ Cena: Minimální (1/10) | Rychlost: Blesková | Inteligence: Solidní ││ Použití: Subagenti, vyhledávání v souborech, generování testovacích dat │└─────────────────────────────────────────────────────────────────────────┘Pokud používáte těžkou váhu na hledání souborů na disku, pálíte peníze i čas. Pokud používáte lehkou váhu na refaktoring jádra aplikace, zanesete do projektu nekvalitní kód a chyby.
🏢 Realistický scénář z praxe
Projektový tým potřebuje provést audit 200 konfiguračních souborů a zjistit, které z nich obsahují zastaralé verze závislostí:
- Špatná strategie: Pustit hlavní uvažující model (Gemini Pro / Claude 3.7 Sonnet) na postupné čtení všech 200 souborů. (Trvání: 10 minut, vysoká spotřeba tokenů).
- Inženýrská strategie: Vyvolat subagenta běžícího na Gemini Flash (nebo Haiku), který během 20 sekund projde všech 200 souborů, vyfiltruje 6 problematických a předá je hlavnímu modelu k provedení samotného refaktoru. (Trvání: 45 sekund, zlomek ceny).
💻 Konkrétní ukázky kódu & promptů
Konfigurace a přepínání modelů v praxi:
# V Antigravity CLI (agy):# Nastavení modelu v sezení nebo konfiguraci settings.jsonagy
# V Claude Code:claude --model claude-3-5-haiku-20241022claude --model claude-3-7-sonnet-20250219Rozhodovací tabulka pro volbu modelu:
| Úkol | Primární volba (Gemini) | Alternativa (Claude) | Proč |
|---|---|---|---|
| Hledání výskytů proměnné v repozitáři | Gemini Flash | Claude 3.5 Haiku | Jde o čisté filtrování textu, nevyžaduje uvažování |
| Tvorba Zod validačních schémat z SQL | Gemini Pro | Claude 3.5 / 3.7 Sonnet | Vyžaduje přesné mapování datových typů |
| Refaktoring asynchronního front-endu s WebSockets | Gemini Pro (Thinking) | Claude 3.7 Sonnet (Thinking) | Vyžaduje hlubokou analýzu race conditions |
| Generování 20 mock uživatelů pro testy | Gemini Flash | Claude 3.5 Haiku | Triviální generování dat |
⚠️ Analýza selhání & Anti-patterns
Chyba: Ponechání slabého modelu na celou práci kvůli úspoře
Někteří vývojáři ve snaze ušetřit nastaví lehký model na veškeré kódování.
- Model opakovaně selhává v komplexních testech.
- Vývojář stráví 10 pokusů naváděním modelu.
- Výsledek: Ve finále spotřebuje více tokenů a času, než kdyby použil Pro / Sonnet jednou a pořádně na první pokus!
🛠️ Inženýrský postup krok za krokem (Playbook)
- Výchozí volba: Nastavte si jako standardní pracovní kůň Gemini Pro nebo Gemini Flash High (resp. Claude 3.5/3.7 Sonnet).
- Delegování: Mechanické a vyhledávací operace delegujte na subagenty s modelem Flash.
- Eskalace: Těžké algoritmické oříšky řešte se zapnutým Extended Thinking.
🧪 Praktické cvičení (Hands-on Lab)
Úkol:
Porovnejte rychlost a kvalitu odpovědi rychlého a uvažujícího modelu na stejném úkolu.
Kroky:
- Zadejte agentovi: „Navrhni Zod validační schéma pro vnořený nákupní košík s kupóny a slevami.“
- Poznamenejte si rychlost odpovědi a hloubku edge cases.
- Poté vyzvěte model s instrukcí pro hluboké uvažování: „Použij hluboké uvažování a najdi v tomto schématu skryté slabiny týkající se manipulace s cenami a zápornými částkami.“
- Porovnejte rozdíl v inženýrské hloubce.