Sari la conținut

Rutarea modelelor — Claude / GLM / Kimi

Acest conținut nu este încă disponibil în limba selectată.

Principiu: modelul potrivit pentru rolul potrivit. Claude orchestrează și face gate-uri de calitate; GLM produce volum ieftin (docs + frontend); Kimi rulează lung și autonom.

RolModelDe ce
Orchestrator (ATLAS), decizii arhitectură, review gateClaude (Opus)raționament, prinde ce ratează TDD; cost justificat doar la gate
Caiete de sarcini, planuri de testare, cursuri, proceduriGLM (5.2)volum mare de text structurat, context ~1M, cel mai bun raport preț/calitate
Frontend AngularGLMputernic pe web/frontend agentic, ieftin
Dezvoltare autonomă lungă, back .NET/Java, bucla run-until-greenKimi (K2.x)stabilitate pe mii de tool calls / sesiuni de ore, generalizare poliglotă

Backend-ul se setează prin variabile de mediu (endpoint Anthropic-compatibil). Trei tipare:

Implicit GLM (workhorse) — .claude/settings.local.json (vezi .example):

{ "env": {
"ANTHROPIC_BASE_URL": "https://api.z.ai/api/anthropic",
"ANTHROPIC_AUTH_TOKEN": "<cheia GLM>",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.2",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.2"
}}

Sesiune Kimi (rulări lungi de dev) — pornește Claude Code cu env-ul Kimi:

Terminal window
ANTHROPIC_BASE_URL=$KIMI_BASE_URL ANTHROPIC_AUTH_TOKEN=$KIMI_API_KEY \
ANTHROPIC_DEFAULT_OPUS_MODEL=$KIMI_MODEL ANTHROPIC_DEFAULT_SONNET_MODEL=$KIMI_MODEL claude

Sesiune Claude (orchestrare/review) — lasă env-ul de model gol și folosește login-ul Anthropic (Pro/Max) sau ANTHROPIC_API_KEY.

Pattern practic de lucru paralel (2 teamleaderi)

Section titled “Pattern practic de lucru paralel (2 teamleaderi)”
  • Terminal 1 — Claude (orchestrare + review): rulează /status, aprobă planuri, citește batch-urile de întrebări, pornește blocurile.
  • Terminal 2 — GLM (Bloc A & B): produce fundația + caietele de sarcini + cursuri.
  • Terminal 3 — Kimi (Bloc C): rulează run-until-green autonom pe taskurile de cod. Toate trei împart același .workplace/state și task-ledger.md, deci nu se calcă reciproc dacă fiecare lucrează pe blocul lui (folosiți git worktrees per bloc — vezi WORKFLOW.md).

Un task care eșuează de 2× pe modelul ieftin sau primește 2× CRITICAL la review → reasignează-l pe Claude pentru acel task. Vezi config/models.json.

Notă: numele exacte de modele (glm-5.2, kimi-k2.x) și endpoint-urile se schimbă des — verifică docs Z.ai / Moonshot la setup și actualizează config/.env.