Skip to main content
Cambio de precios Google (julio 2026): Gemini 2.5 Flash pasó de 0.15/0.15/0.60 a 0.30/0.30/2.50 por 1M tokens (2–4× incremento). Para reemplazo económico, considera google/gemini-2.5-flash-lite (0.10/0.10/0.40) o el nuevo google/gemini-3.6-flash.

Frontier (recomendados)

Legacy (backward compat)

Estos siguen operativos por compat pero no se recomiendan para nuevas integraciones: Retirados en julio 2026: openai/gpt-4.1, openai/o4-mini, deepseek/deepseek-chat, deepseek/deepseek-reasoner, moonshot/kimi-k2, moonshot/moonshot-v1-128k, xai/grok-3, xai/grok-3-mini, xai/grok-4.

Cuándo usar cada uno

Tareas críticas

Claude Fable 5 o Claude Opus 5 o GPT-5.6 Sol. Top de su clase en razonamiento.

Producción a escala

Claude Sonnet 5. Balance precio/calidad — lo elegirías a ciegas si no supieras el resto.

Alto volumen / costo bajo

Gemini 2.5 Flash Lite, GPT-5.6 Luna o DeepSeek V4 Flash. Subdólar por 1M tokens.

Razonamiento (chain of thought)

DeepSeek V4 Pro, o3-mini o Grok 4.20 Reasoning. Diseñados para razonamiento estructurado.

Context muy largo (1M tokens)

Gemini 3.6 Flash / 2.5 Pro / 2.5 Flash o Grok 4.3 o Claude Fable/Opus/Sonnet 5. Procesan documentos enteros.

Código

Kimi K2.7 Code, Claude Sonnet 5 o Grok Build. Strong code performance.

Failover natural

Como todos los modelos comparten el mismo endpoint y SDK, failover entre providers es trivial: