Přeskočit na obsah

Lekce 01.2: Výběr plánu a modelu: Gemini vs. Claude (Choosing Your Plan and Model)

⏱️ 4 min čtení Lekce 01.2

🧠 Mentální model & teoretický rozbor

Volba AI modelu pro softwarové inženýrství se zásadně liší od výběru modelu pro běžný chat. Při kódování nerozhoduje květnatost jazyka, ale:

  1. Schopnost dodržovat systémová omezení (Instruction Adherence): Zda model skutečně dodrží zákaz úpravy určitého souboru nebo schéma databáze.
  2. Volání nástrojů (Tool Calling Precision): Schopnost přesně vygenerovat parametry pro volání bash příkazů, linteru nebo patchování souborů bez syntaktických chyb.
  3. Uvažování nad abstraktním AST a architekturou: Schopnost pochopit datové toky a typové vazby napříč desítkami souborů v projektu.
┌────────────────────────────────────────────────────────────────────────┐
│ GOOGLE GEMINI (Primární volba v Antigravity) │
│ • Gemini 2.5 / 3.8 Pro (Thinking): Architektura, těžké refaktory, │
│ analýza složitých race conditions a velkých monorepozitářů │
│ • Gemini 2.5 / 3.8 Flash: Blesková odezva, subagenti, audit, testy │
│ (obří kontextové okno 1M–2M tokenů, minimální cena) │
├────────────────────────────────────────────────────────────────────────┤
│ ANTHROPIC CLAUDE (Alternativní ekosystém v Claude Code) │
│ • Claude 3.7 Sonnet (Extended Thinking): Hloubková logika a architektura│
│ • Claude 3.5 Haiku: Rychlý grep, subagenti a drobné úpravy │
└────────────────────────────────────────────────────────────────────────┘

Plány a přístupy k modelům:

1. Ekosystém Google Gemini (Antigravity)

  • Google AI Studio API klíč (GEMINI_API_KEY): Založení na aistudio.google.com. Získáte přístup k nejnovějším modelům řady Gemini Flash a Pro. Pro běžný vývoj nabízí štědré bezplatné kvóty (Free Tier) i škálovatelný Pay-as-you-go režim.
  • Vertex AI (Google Cloud): Podnikové nasazení s garantovaným SLA, privátními VPC mantinely a nulovým trénováním na zákaznických datech.
  • Antigravity CLI / IDE: Nativní klientský harness, který se přihlašuje přes Google účet nebo API klíč a transparentně řídí volání modelů.

2. Ekosystém Anthropic (Claude Code)

  • Předplatné (Claude Pro / Team, $20–$30/měsíc): Pevná cena, snadné nastavení přes OAuth v prohlížeči. Nevýhoda: dynamické limity (při intenzivním běhu v terminálu můžete narazit na limit zpráv na 5 hodin).
  • Console API klíč (ANTHROPIC_API_KEY): Platba za přesně spotřebované tokeny bez časových oken.

🏢 Realistický scénář z praxe

Webový vývojář řeší asynchronní race-condition v Next.js aplikaci při souběžných platbách přes Webhook:

  • Pokud použije lehký model (Flash / Haiku): Model navrhne banální úpravu typu await new Promise(r => setTimeout(r, 1000)), která problém pouze zamaskuje a v produkci selže.
  • Pokud použije Gemini Pro (Thinking) nebo Claude 3.7 Sonnet: Model stráví 30–45 sekund v interním myšlenkovém řetězci, zanalyzuje databázové transakce v Prismě a navrhne izolovaný zámek SELECT FOR UPDATE nebo distribuovaný Redis mutex.

💻 Konkrétní ukázky konfigurace & promptů

Nastavení klíčů v prostředí Unix/macOS (~/.zshrc nebo ~/.bashrc):

Terminál
# 1. Primární: Google Gemini API klíč
export GEMINI_API_KEY="AIzaSy..."
# 2. Alternativa: Anthropic API klíč pro Claude Code
export ANTHROPIC_API_KEY="sk-ant-api03-..."

Spuštění kódovacího harnessu v terminálu:

Terminál
# Spuštění Antigravity CLI (hlavní nástroj kurzu)
agy
# Spuštění alternativy: Claude Code
claude --model claude-3-7-sonnet-20250219

[!TIP] Prompt Caching v praxi: Jak Gemini, tak Anthropic podporují automatické cachování systémových promptů a repozitářových pravidel (AGENTS.md / CLAUDE.md). Pokud pravidla neměníte, jejich opakované čtení v dalších tazích stojí pouze zlomek běžné sazby (často 10–25 % běžné ceny input tokenů).


⚠️ Analýza selhání & Anti-patterns

Chyba: Používání nejtěžšího uvažujícího modelu na mechanické úkoly

Pustit těžký Thinking model na úkol: „Přejmenuj proměnnou usr na user v souboru src/utils/format.ts:

  • Pomalé: Čekáte zbytečně 20–30 sekund na generování myšlenkového řetězce.
  • Drahé: Stojí 50x více než při použití lehkého modelu.
  • Anti-inženýrské: Na mechanické přejmenování proměnné slouží F2 v IDE nebo rychlý Flash model.

🛠️ Inženýrský postup krok za krokem (Playbook)

  1. Zvolte primárního tahouna pro běžné kódování: Pro běžné psaní testů, komponent a úpravu endpointů používejte Gemini Flash (nebo Claude 3.5 Sonnet) – získáte okamžitou odezvu bez čekání.
  2. Eskalujte na Thinking model pouze při záseku: Pokud test selhává i po dvou iteracích, zapněte vysoký reasoning budget a vyzvěte model: „Použij hluboké uvažování, zanalyzuj stack trace a zkontroluj asynchronní toky dat.“
  3. Subagenty vždy směrujte na rychlý model: Mechanické vyhledávání v desítkách souborů vždy delegujte na Flash model.

🧪 Praktické cvičení (Hands-on Lab)

Úkol:

Ověřte si dostupnost API klíče a vyzkoušejte odezvu modelu v terminálu.

Kroky:

  1. Zkontrolujte, zda máte v terminálu nastavenou proměnnou prostředí:
    Terminál
    echo $GEMINI_API_KEY
  2. Spusťte agy (nebo claude).
  3. Zeptejte se agenta na jeho identitu a aktuální model: „Jaký přesně model a konfiguraci uvažování aktuálně využívá toto sezení?“
  4. Sledujte rychlost první odpovědi.