Il kit developer è costruito su otto livelli: IDE, coding agent, gateway API, API per media, assistente trasversale, input vocale, prototipazione UI e comprensione codebase. Il punto chiave è non fermarsi all'autocomplete: Claude Code, ChatGPT Codex e Devin coprono task autonomi multi-step dove l'IDE da solo rallenta.
Claude Code resta il riferimento terminal-first: Sonnet 5.5 bilancia velocità e costo, Opus 5.5 copre i lavori software difficili e Fable 5.1 va usato solo quando gli eval giustificano il sovrapprezzo.
ChatGPT Codex è più interessante quando il lavoro deve restare nell'ecosistema OpenAI: GPT-6.1 Sol è il punto di partenza per coding e agenti, Luna per subtask semplici e verificabili.
Grok Build aggiunge un'opzione più recente da terminale con Grok 4.7 come modello predefinito: via API costa $2/$0,50/$6 sotto 200K token e $4/$1/$12 da 200K, quindi va testato sul proprio repository prima di sostituire un agente già in uso.
Devin entra quando un team vuole sessioni cloud asincrone, pull request, automazioni e più agenti su lavori indipendenti. GitHub Copilot resta forte nei team GitHub che vogliono model picker, limiti sugli AI Credits e audit delle sessioni.
OpenRouter e LiteLLM servono invece a provare, instradare e governare modelli diversi. fal.ai, Replicate e Runpod coprono API e infrastruttura per media generativi. Z.ai, Pi Agent, Kimi Code, Muse Code e DeepSeek Harness restano alternative tecniche da validare su costo, privacy e affidabilità.
Aqua Voice e Voicebox riducono il costo di inserire contesto tecnico; DeepWiki e Code Wiki aiutano a capire repository sconosciuti. Claude o ChatGPT restano utili per requisiti e comunicazione, mentre Claude Design, Stitch ed Emergent coprono prototipi e handoff verso il codice.