Zendoric

Comparativa de modelos de IA — texto, imagen y vídeo

Los principales modelos de IA de EE.UU., Europa y China — generación de texto, imagen y vídeo — comparados por calidad (benchmarks de mercado), coste y si son open source, separando siempre modelos remotos (API) y locales (en tu hardware).

Datos a 2026-09-04 · investigación automática (Artificial Analysis, LMArena, precios oficiales) — verificar antes de decidir.

📊 Cómo se mide la calidad — tres índices

Mostramos la calidad de tres formas complementarias. Así se compone cada índice antes de ver las gráficas:

① Calidad de Zendoric (0-100) = media a tercios de SWE-bench-Pro (33% · desarrollo de software real, cotejado con el fabricante) + LMArena (33% · preferencia humana, Elo normalizado) + Terminal-Bench (33% · capacidad agéntica en terminal). Si a un modelo le falta una de las tres, su peso se reparte entre las presentes (se exigen al menos dos).

② AA Index (Artificial Analysis Intelligence Index, 0-100) = índice compuesto y más amplio (razonamiento, ciencia, código, matemáticas). Ofrece una segunda lectura: según cómo se mida, el orden de los fabricantes cambia.

③ Ciberseguridad (0-100) = capacidad en tareas cyber expert (protocolo duro «unguided pass@1»: vuln-research y explotación realista). Usamos una métrica no saturada (el top ronda 71, no 100, y deja ver el recorrido), no el Cybench «pass@k» que la frontera ya satura. Fuentes: UK AISI, NIST-CAISI, CVE-Bench. La encuadramos como capacidad y riesgo, no como ranking ofensivo; donde no hay eval directa se estima «est.».

📈 Evolución de la Calidad de Zendoric (fabricantes frontera)

Índice de calidad (0-100) de los fabricantes punteros (su mejor modelo), últimos 24 meses. Línea punteada = calidad estimada por AA Index (labs sin SWE-bench-Pro). Se actualiza cada día.

Moonshot AIAnthropicOpenAIxAIGoogleZhipu AIAlibabaDeepSeekMicrosoftMistral AIMeta
27415569829624-1025-0125-0425-0725-1026-0126-0426-0726-09Kimi k1.5Kimi K2Kimi K2.6Kimi K3Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Fable 5.1o3GPT-5GPT-5.5GPT-5.6 SolGPT-6 Astra (est.)Grok 4Grok 4.3Grok 4.6 (est.)Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.8 Flash (est.)GLM-4.5GLM-5GLM-5.2GLM-5.3-Flash (est.)Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-Thinking-1Large 3Mistral Large 3 (est.)Llama 4Llama 4 Maverick (est.)

📈 Evolución del AA Index (fabricantes frontera)

AA Index (Artificial Analysis Intelligence Index, 0-100) de los fabricantes punteros (su mejor modelo), últimos 24 meses. Es un índice compuesto y más amplio (razonamiento, ciencia, código, matemáticas) que nuestro índice. La serie histórica está reconstruida anclando la trayectoria de cada fabricante a su AA actual. Se actualiza cada día.

AnthropicOpenAIxAIMoonshot AIGoogleZhipu AIAlibabaDeepSeekMicrosoftMistral AIMeta
8203346587124-1025-0125-0425-0725-1026-0126-0426-0726-09Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Fable 5.1o3GPT-5GPT-5.5GPT-5.6 SolGPT-6 AstraGrok 4Grok 4.3Grok 4.6Kimi k1.5Kimi K2Kimi K2.6Kimi K3Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.8 FlashGLM-4.5GLM-5GLM-5.2GLM-5.3-FlashQwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-Thinking-1Large 3Mistral Large 3Llama 4Llama 4 Maverick

🛡️ Evolución en ciberseguridad (fabricantes frontera)

Índice de ciberseguridad (0-100) del mejor modelo de cada fabricante, últimos 24 meses. Métrica: tareas cyber EXPERT en protocolo duro «unguided pass@1» (sin pistas, un intento; vuln-research y explotación realista). La elegimos porque NO está saturada — el top ronda 71, no 100, así que discrimina y deja ver el recorrido (descartamos el Cybench «pass@k», donde la frontera ya hace ~100%). Fuentes: UK AISI (GPT-5.5 71,4 % vs Anthropic preview 68,6 %), NIST-CAISI, CVE-Bench. Confianza alta solo en OpenAI/Anthropic (medidos por AISI); el resto, imputado por proximidad → toda la serie va marcada «est.». Lo encuadramos como capacidad y RIESGO a gobernar, no como ranking ofensivo. Se actualiza cada día.

OpenAIAnthropicZhipu AIGoogleMoonshot AIMicrosoftAlibabaxAIDeepSeekMistral AIMeta
21324354657624-1025-0125-0425-0725-1026-0126-0426-0726-09o3GPT-5GPT-5.5GPT-5.6 SolGPT-5.6 Sol (est.)Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Mythos 5 (est.)GLM-4.5GLM-5GLM-5.2GLM-5.2 (est.)Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3 Pro (est.)Kimi k1.5Kimi K2Kimi K2.6Kimi K2.6 (est.)MAI-1MAI-1 (est.)Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-Max (est.)Grok 4Grok 4.3Grok 4.3 (est.)V3R1V3.2V4-ProDeepSeek V4-Pro (est.)Large 3Mistral Large 3 (est.)Llama 4Llama 4 (est.)

💰 Calidad de Zendoric frente a coste

Modelos punteros de los fabricantes con mejor calidad (un fabricante puede tener varios, p.ej. Anthropic: Opus 5, Opus 4.8 y Fable 5). Más ARRIBA = más calidad; más a la IZQUIERDA = más barato (eje log). Lo ideal, arriba-izquierda. Punto hueco = calidad estimada (AA Index). Color por fabricante.

OpenAIAnthropicGoogleMicrosoftMetaxAIMistral AIDeepSeekAlibabaMoonshot AIZhipu AI
Zona ideal264054688296$0.2$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log)Kimi K3Claude Fable 5.1Claude Fable 5Claude Mythos 5Claude Opus 5GPT-6 Astra (est.)GPT-5.6 SolClaude Opus 4.8GPT-5.5Claude Sonnet 5Grok 4Claude Sonnet 4.6Grok 4.6 (est.)Gemini 3.8 Flash (est.)GLM-5.3-Flash (est.)Gemini 3.7 Flash (est.)GPT-5.6 TerraGrok 4.5GLM-5.2GPT-5.6 LunaQwen3.7-MaxKimi K2.6DeepSeek V4-ProGemini 3 ProMAI-Thinking-1Mistral Large 3 (est.)Llama 4 Maverick (est.)Magistral (est.)

💰 AA Index frente a coste

Mismo formato que el de calidad/coste, pero el eje vertical es el AA Index. Más ARRIBA = más capacidad; más a la IZQUIERDA = más barato (eje log). Punto hueco = AA estimado (Terminal-Bench/SWE-Pro). Color por fabricante.

OpenAIAnthropicGoogleMicrosoftMetaxAIMistral AIDeepSeekAlibabaMoonshot AIZhipu AI
Zona ideal61932455871$0.2$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log)AA IndexClaude Fable 5.1Claude Opus 5GPT-6 AstraClaude Fable 5Claude Mythos 5Kimi K3GPT-5.6 SolClaude Opus 4.8GPT-5.5Claude Sonnet 5Claude Sonnet 4.6Grok 4Grok 4.6Gemini 3.8 FlashGLM-5.3-FlashGemini 3.7 FlashGrok 4.5GPT-5.6 TerraGPT-5.6 LunaGLM-5.2Qwen3.7-MaxDeepSeek V4-ProKimi K2.6Gemini 3 ProMAI-Thinking-1Mistral Large 3Llama 4 MaverickMagistral

🏁 Frontera eficiente — calidad frente a coste

Todos los modelos cloud con datos. Eje Y = AA Index; eje X = coste de salida, log e INVERTIDO: cuanto más a la DERECHA, más barato — la esquina superior derecha es la ideal. La línea verde une la frontera eficiente: modelos para los que no existe otro mejor y más barato a la vez; elegir fuera de esa línea solo se justifica por factores ajenos al precio (ecosistema, contexto, open source). Punto hueco = AA estimado. Pasa el ratón por un punto para ver el detalle.

Frontera eficiente (nadie es mejor y más barato a la vez)Resto de modelos
61932455871$0.2$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log · derecha = más barato)más eficiente ↗Claude Fable 5.1 — AA 66 · $50/1M tokensClaude Opus 5 — AA 63 · $25/1M tokensGPT-6 Astra — AA 61 · $50/1M tokensGrok 4.6 — AA 61 · $6/1M tokensClaude Fable 5 — AA 60 · $50/1M tokensClaude Mythos 5 — AA 60 · $50/1M tokensKimi K3 — AA 60 · $15/1M tokensGPT-5.6 Sol — AA 59 · $30/1M tokensGemini 3.8 Flash — AA 59 · $3.75/1M tokensGLM-5.3-Flash — AA 58 · $0.25/1M tokensClaude Opus 4.8 — AA 56 · $25/1M tokensGemini 3.7 Flash — AA 56 · $3.75/1M tokensGrok 4.5 — AA 56 · $6/1M tokensGPT-5.5 — AA 55 · $30/1M tokensGPT-5.6 Terra — AA 55 · $12/1M tokensClaude Sonnet 5 — AA 53 · $15/1M tokensGPT-5.6 Luna — AA 51 · $1.2/1M tokensGLM-5.2 — AA 51 · $2.2/1M tokensQwen3.7-Max — AA 46 · $6/1M tokensDeepSeek V4-Pro — AA 44 · $0.87/1M tokensKimi K2.6 — AA 43 · $2.5/1M tokensGemini 3 Pro — AA 40 · $10/1M tokensClaude Sonnet 4.6 — AA 37 · $15/1M tokensGrok 4 — AA 33 · $15/1M tokensMAI-Thinking-1 — AA 30 · $8/1M tokensMistral Large 3 — AA 16 · $6/1M tokensLlama 4 Maverick — AA 14 · $0.6/1M tokensMagistral — AA 11 · $1.5/1M tokensGLM-5.3-FlashDeepSeek V4-ProLlama 4 MaverickClaude Fable 5.1Claude Opus 5GPT-6 AstraGrok 4.6Claude Fable 5Claude Mythos 5Kimi K3GPT-5.6 SolGemini 3.8 FlashClaude Opus 4.8Gemini 3.7 FlashGrok 4.5GPT-5.5GPT-5.6 TerraClaude Sonnet 5GPT-5.6 LunaGLM-5.2Qwen3.7-MaxKimi K2.6Gemini 3 ProClaude Sonnet 4.6Grok 4MAI-Thinking-1Mistral Large 3Magistral

🏆 Calidad de Zendoric (desarrollo SW + arena + agéntica)

ModeloCalidad ZendoricSWE-bench-ProDeepSWELMArenaTerminal-BenchLiveCodeBenchGPQAARC-AGI-2
🇨🇳 Kimi K3Moonshot AI · China91.4—68.5148988.368.093.5—
🆕 🇺🇸 Claude Fable 5.1Anthropic · USA90.681.2—1504————
🇺🇸 Claude Fable 5Anthropic · USA90.180.369.71515—91.792.6—
🇺🇸 Claude Mythos 5Anthropic · USA89.380.0—150788.091.794.1—
🇺🇸 Claude Opus 5Anthropic · USA86.879.273.6149384.6———
🇺🇸 GPT-5.6 SolOpenAI · USA82.764.672.7148391.9—94.6—
🇺🇸 GPT-5.6 TerraOpenAI · USA77.963.469.6146687.4—92.9—
🇺🇸 Grok 4.5xAI · USA77.864.753.8147183.3—93.1—
🇨🇳 GLM-5.2Zhipu AI · China76.962.169.0147581.080.2787
🇺🇸 Claude Opus 4.8Anthropic · USA76.569.259.0145582.788.88414
🇺🇸 GPT-5.5OpenAI · USA76.358.667.0147582.7—8516
🇺🇸 Claude Sonnet 5Anthropic · USA74.763.253.8146180.4—8312
🇺🇸 Grok 4xAI · USA74.2—66.7143083.379.48416
🇺🇸 GPT-5.6 LunaOpenAI · USA73.762.767.2—84.7—92.3—
🇨🇳 Qwen3.7-MaxAlibaba · China72.660.657.5147569.791.6817
🇨🇳 Kimi K2.6Moonshot AI · China68.458.6—146066.789.6789
🇨🇳 DeepSeek V4-ProDeepSeek · China66.155.462.8145067.993.5829
🇺🇸 Gemini 3 ProGoogle · USA65.843.311.7150154.291.78415
🇺🇸 Claude Sonnet 4.6Anthropic · USA63.458.129.9143067.0—809
🇺🇸 MAI-Thinking-1Microsoft · USA49.452.8——46.087.784.2—
🇺🇸 Gemini 3.7 FlashGoogle · USA——65.31491————
🇺🇸 Llama 4 MaverickMeta · USA———1288—43.4705
🇪🇺 Mistral Large 3Mistral AI · Europa———1418—74726
🇪🇺 MagistralMistral AI · Europa—————70.8870.074
🇨🇳 GLM-5.3-FlashZhipu AI · China——63.41474————
🆕 🇺🇸 GPT-6 AstraOpenAI · USA——————96.0—
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USA——73.81494————
🆕 🇺🇸 Grok 4.6xAI · USA——66.7—————

Calidad de Zendoric = media a tercios de SWE-bench-Pro (desarrollo de SW) + LMArena (preferencia humana) + Terminal-Bench (capacidad agéntica), las tres con fuente fiable; si falta alguna se reparte su peso entre las presentes (mínimo dos; si no, «—»). LiveCodeBench y GPQA se muestran como referencia (orientativas, pueden estar incompletas) pero NO entran en el índice; ARC-AGI-2 (arcprize.org) mide progreso hacia AGI: los modelos puntúan MUY bajo → aún lejos de AGI. %, salvo LMArena (Elo).

💵 Economía (USD / 1M tokens)

ModeloInputCacheOutput
🇨🇳 Kimi K3Moonshot AI · China$3.0$0.3$15.0
🆕 🇺🇸 Claude Fable 5.1Anthropic · USA$10.0$0.25$50.0
🇺🇸 Claude Fable 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 Claude Mythos 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 Claude Opus 5Anthropic · USA$5.0$0.5$25.0
🇺🇸 GPT-5.6 SolOpenAI · USA$5.0$0.5$30.0
🇺🇸 GPT-5.6 TerraOpenAI · USA$2.0$0.2$12.0
🇺🇸 Grok 4.5xAI · USA$2.0$0.3$6.0
🇨🇳 GLM-5.2Zhipu AI · China$0.6$0.26$2.2
🇺🇸 Claude Opus 4.8Anthropic · USA$5.0$0.5$25.0
🇺🇸 GPT-5.5OpenAI · USA$5.0$0.5$30.0
🇺🇸 Claude Sonnet 5Anthropic · USAhasta 31 ago 2026 $2.0
desde 1 sep 2026 $3.0
hasta 31 ago 2026 $0.2
desde 1 sep 2026 $0.3
hasta 31 ago 2026 $10.0
desde 1 sep 2026 $15.0
🇺🇸 Grok 4xAI · USA$3.0$0.75$15.0
🇺🇸 GPT-5.6 LunaOpenAI · USA$0.2$0.02$1.2
🇨🇳 Qwen3.7-MaxAlibaba · China$1.2$0.25$6.0
🇨🇳 Kimi K2.6Moonshot AI · China$0.6$0.16$2.5
🇨🇳 DeepSeek V4-ProDeepSeek · China$0.28$0.03$0.87
🇺🇸 Gemini 3 ProGoogle · USA$1.25$0.31$10.0
🇺🇸 Claude Sonnet 4.6Anthropic · USA$3.0$0.3$15.0
🇺🇸 MAI-Thinking-1Microsoft · USA$2.0—$8.0
🇺🇸 Gemini 3.7 FlashGoogle · USA$0.75$0.07$3.75
🇺🇸 Llama 4 MaverickMeta · USA$0.2—$0.6
🇪🇺 Mistral Large 3Mistral AI · Europa$2.0$0.05$6.0
🇪🇺 MagistralMistral AI · Europa$0.5$0.01$1.5
🇨🇳 GLM-5.3-FlashZhipu AI · China$0.07$0.01$0.25
🆕 🇺🇸 GPT-6 AstraOpenAI · USA$10.0$1.0$50.0
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USA$0.75—$3.75
🆕 🇺🇸 Grok 4.6xAI · USA$2.0$0.5$6.0

Claude Sonnet 5: subida de tarifas programada (mismo modelo) — precio reducido hasta el 31 ago 2026 y tarifa estándar desde el 1 sep 2026.

🔓 Open source y variedad

ModeloOpen sourceLicenciaVariedad
🇨🇳 Kimi K3Moonshot AI · ChinaSíModified MITOpen-weight (pesos abiertos)
🆕 🇺🇸 Claude Fable 5.1Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Fable 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Mythos 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Opus 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.6 SolOpenAI · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.6 TerraOpenAI · USANoPropietarioPropietario (solo API)
🇺🇸 Grok 4.5xAI · USANoPropietarioPropietario (solo API)
🇨🇳 GLM-5.2Zhipu AI · ChinaSíMITOpen-weight (pesos abiertos)
🇺🇸 Claude Opus 4.8Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.5OpenAI · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Sonnet 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Grok 4xAI · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.6 LunaOpenAI · USANoPropietarioPropietario (solo API)
🇨🇳 Qwen3.7-MaxAlibaba · ChinaNoPropietarioPropietario (solo API)
🇨🇳 Kimi K2.6Moonshot AI · ChinaSíModified MITOpen-weight (pesos abiertos)
🇨🇳 DeepSeek V4-ProDeepSeek · ChinaSíMITOpen-weight (pesos abiertos)
🇺🇸 Gemini 3 ProGoogle · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Sonnet 4.6Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 MAI-Thinking-1Microsoft · USANoPropietarioPropietario (solo API)
🇺🇸 Gemini 3.7 FlashGoogle · USANoPropietarioPropietario (solo API)
🇺🇸 Llama 4 MaverickMeta · USASíLlama 4 CommunityOpen-weight (pesos abiertos)
🇪🇺 Mistral Large 3Mistral AI · EuropaSíApache-2.0Open-weight (pesos abiertos)
🇪🇺 MagistralMistral AI · EuropaSíApache-2.0Open-weight (pesos abiertos)
🇨🇳 GLM-5.3-FlashZhipu AI · ChinaSíMITOpen-weight (pesos abiertos)
🆕 🇺🇸 GPT-6 AstraOpenAI · USANoPropietarioPropietario (solo API)
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USANoPropietarioPropietario (solo API)
🆕 🇺🇸 Grok 4.6xAI · USANoPropietarioPropietario (solo API)

🖥️ Open source para tu hardware

Pequeños/medianos que corren en un equipo propio (portátil/PC/Mac). Calidad = Artificial Analysis Intelligence Index (0-100; calidad del output), la medida con mejor cobertura en modelos open pequeños (LMArena no lista los sub-32B). Memoria estimada en cuantización 4-bit (Q4) y 8-bit (Q8); en Apple Silicon es memoria UNIFICADA (RAM=VRAM).

ModeloCalidad (AA Index)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicencia
Qwen3.5 27BAlibaba4285.527B16 GB31 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 31BGoogle3984.331B19 GB36 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Qwen3.5 35B A3BAlibaba3784.235B21 GB40 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 26B A4BGoogle3182.326B16 GB30 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Nemotron-Cascade-2-30B-A3BNVIDIA2876.130B18 GB34 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)NVIDIA Open Model
gpt-oss-20bOpenAI2471.520B13 GB25 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 12BGoogle2278.812B8 GB15 GB≥8 GBSí (CPU lento · Mac 16 GB)Gemma
Gemma 4 E4BGoogle1958.64B4 GB6 GB≥8 GBSí (CPU/Mac, fluido)Gemma
Gemma 4 E2BGoogle1543.42B3 GB4 GB≥8 GBSí (CPU/Mac, fluido)Gemma

🗄️ Open source grande (servidor / multi-GPU)

Modelos open potentes pero que necesitan servidor o varias GPU. Calidad = LMArena Elo (preferencia humana sobre el output, fuente lmarena.ai), que sí cubre los modelos grandes. En MoE la memoria cuenta el total de parámetros (todos los expertos se cargan). Memoria estimada en cuantización 4-bit (Q4) y 8-bit (Q8); en Apple Silicon es memoria UNIFICADA (RAM=VRAM).

ModeloCalidad (LMArena)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicencia
GLM-5.2Zhipu AI147291.2400B222 GB442 GB3× 80 GB (servidor)No (servidor GPU)MIT
DeepSeek-V4-Pro-0813DeepSeek146590.11600B882 GB1762 GB12× 80 GB (servidor)No (servidor GPU)MIT
Kimi K2.6Moonshot AI146090.51100B606 GB1212 GB8× 80 GB (servidor)No (servidor GPU)Modified MIT
Qwen3.5-397B-A17BAlibaba145088.4397B220 GB438 GB3× 80 GB (servidor)No (servidor GPU)Apache-2.0
Llama 4 MaverickMeta142069.8400B222 GB442 GB3× 80 GB (servidor)No (servidor GPU)Llama 4 Community
Mistral Large 3Mistral AI141668.0675B373 GB744 GB5× 80 GB (servidor)No (servidor GPU)Apache-2.0
gpt-oss-120bOpenAI135280.1117B66 GB130 GB≥80 GBNo (servidor GPU)Apache-2.0

🎨 Generación de imagen

Los principales modelos de generación de IMAGEN, separados entre servicios remotos (pagas por imagen vía API) y modelos abiertos que puedes ejecutar en tu propio hardware.

☁️ Remotos (API / cloud)

ModeloCalidad (arena)Precio (por imagen)Notas
GPT Image 2OpenAI · USA1369 AA nº1 (era 1338); 2º MAI-Image-2.6-Prev 1350, gap 19; Reve 2.1 3º 1323. arena.ai 1382 nº1$0,211/img high 1024² (=$211/1K API OpenAI); fal.ai $0,005 low a $0,401 high 4K — CONFIRMADO al detalleNº1 t2i confirmado (AA y arena.ai). Lanzado abr-2026. Modelo con razonamiento; texto y prompt adherence líder
MAI-Image-2.5Microsoft · USA1303 AA (era 1269), nº6 t2i (era nº3); superada por MAI-Image-2.6-Preview 1350 nº2 y 2.5-Pro 1292 nº8Azure Foundry $47/M img out confirmado; $0,048/img confirmado (AA $48,1/1K)Microsoft. Nueva gen MAI-Image-2.6-Preview (ago-2026) nº2 t2i y nº1 editing. Variantes Pro $108,5/1K y Flash $20/1K
Nano Banana Pro (Gemini 3 Pro Image)Google · USA1296 AA t2i (era 1222), nº7 de 155 (era nº9 de 81); superada por Nano Banana 2 (1320, nº4)$0,134/img 1-2K · $0,24/img 4K Gemini API (Batch 50% → 4K ~$0,12) confirmado= Gemini 3 Pro Image. Salida hasta 4096×4096. GA jun-2026, SynthID; activo, sin deprecación
Nano Banana 2 Lite (Gemini 3.1 Flash Lite)Google · USA1287 AA t2i (era 1262), nº9 de 155 (era nº4)$0,034/img (1K) Gemini API confirmado (Batch $0,017)= Gemini 3.1 Flash Lite Image. Rápida/barata ~4s (no verif.), solo 1K
GPT Image 1.5OpenAI · USA1304 AA (era 1260), nº5 t2i (sube, era nº6)$0,009 low · $0,034 medio · $0,133 high (1024² OpenAI/fal.ai) — CONFIRMADO al detalleGen. anterior OpenAI (dic-2025), aún muy competitiva: nº5 AA, por encima de MAI-2.5. Sin deprecación
Grok ImaginexAI · USA1234 AA image-quality nº13 (era 1203/nº12); base 1216 nº24. Nuevo Imagine 2.0 nº3 arena.ai 1316$0,02/img base; quality $0,05 (1K)/$0,07 (2K); nuevo grok-imagine-image-2.0 $0,04/img (docs x.ai)xAI. CORREGIDO: i2v NO es nº1; grok-imagine-video-1.5 nº5 AA (1109). Nº1 i2v es Minimax H3 Max (1203)
Cosmos 3 SuperNVIDIA · USAAA t2i 1184 agentic (r46) y 1176 base; ya NO nº1 open (FLUX.2 [dev] 1197 delante). Debutó 1219 nº1 openOpen weights OpenMDW-1.1 (self-host gratis, uso comercial); API $0,04/img en fal (+$0,02 prompt expansion)NVIDIA, omnimodal MoT dual-tower 64B desde Qwen3-VL 32B. Superado en open por FLUX.2 [dev]

💻 Locales (open-weight, en tu hardware)

ModeloLicenciaHardwareNotas
FLUX.2Black Forest Labsopen-weight + APIGPU dedicada (variantes dev/FP8)Lanz. 25-nov-2025; max dic-2025; klein 15-ene-2026 (4B Apache 2.0; 9B disputada). FLUX.3 ya salió (jul-2026, cerrado)
Qwen-Image 2.0AlibabaApache-2.07B — GPU 16GB+Lanz. 10-feb-2026, decoder 7B + enc. Qwen3-VL 8B, 2K nativo. Sucedido por Qwen-Image-3.0 (GA 5-ago-2026, cerrado)
Z-Image TurboAlibaba (Tongyi)open-weight~1 s/imagen en H100; corre en Mac (MLX)Alibaba Tongyi-MAI, 6B S3-DiT, 8 NFE, sub-segundo en H100. Familia: Base, Edit, Omni-Base
Stable Diffusion 3.5Stability AIStability CommunityGPU 8-16GBVigente ago-2026, no retirado, sigue flagship de Stability. Mayor ecosistema (Civitai, ComfyUI, LoRAs)
HiDream-O1-Image-1.5HiDreamopen-weightGPU dedicadav1.5 cerrada (hosted), hasta 2K, pixel-native UiT sin VAE. Dev abierto (MIT). Debutó #3 AA, hoy #16

Datos a 2026-09-04 · fuentes: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · el Elo de arena es preferencia humana a ciegas sobre el resultado; precios orientativos — verificar antes de decidir.

🎬 Generación de vídeo

Los principales modelos de generación de VÍDEO, separados entre servicios remotos (pagas por segundo generado vía API) y modelos abiertos para tu propio hardware.

☁️ Remotos (API / cloud)

ModeloCalidad (arena)Precio (por segundo)Notas
Kling 3.0 / TurboKuaishou · ChinaAA t2v c/audio 1108 #9 (Pro 1080p) · sin audio ~1246 · i2v 1071 #14. llm-stats 1934 #1; ausente de arena.aifal Turbo Pro 1080p $0,14/s; Turbo Std 720p $0,112/s. AA Kling 3.0 Pro 1080p $20,16/min (~$0,34/s)Kuaishou 5-feb-2026 (3.0/Omni); Turbo 17-jun-2026. Hasta 15s, audio nativo, multi-shot 6 clips. Sin Kling 3.5
Veo 3.1Google · USAAA c/audio: 3.1 = 1092 #13, Lite 1089 #14, Fast 1086 #17. i2v 1086 #9. arena.ai Veo 3.1 Audio 1364 #10Gemini API: Lite $0,05/s 720p · Fast $0,10/s ($0,12 1080p) · Std $0,40/s 720p/1080p, $0,60/s 4K (audio incl.)Tres niveles + audio nativo (Vertex/Gemini API). Superado por Gemini Omni Flash/1.1 en AA y arena.ai
Gemini Omni FlashGoogle · USAAA t2v c/audio 1237 #2 (lidera Wan 3.0 1242); sin audio 1325 #1. i2v 1179 #4 c/audio, 1365 #1 sin audioVERIFICADO ~$0,10/s (720p) Gemini API. Omni 1.1: $0,03/s 360p · $0,10/s 720p · $0,15/s 1080p · $0,30/s 4KGoogle I/O may-2026. NUEVA VERSIÓN Gemini Omni 1.1 Flash (29-ago-2026): 40s, 4K upscale, #1 arena.ai 1515
Seedance 2.0 (Dreamina)ByteDance · ChinaAA t2v 720p 1221 #5 c/audio · 1267 #4 sin audio. i2v 1190 #2 c/audio, 1336 #3 sin audio. arena.ai 1479 #4AA $9,07/min 720p (~$0,15/s). EvoLink 720p Std $0,199/s, Fast $0,161/s; 480p $0,092/$0,074. Audio incluidoByteDance 12-feb-2026, 15s + audio. SUPERADO: Seedance 2.5 (31-jul-2026, API 7-ago): 30s, 50 refs, 4K
Sora 2OpenAI · USAAusente de AA. arena.ai t2v: Sora 2 Pro 1365 #9, Sora 2 1341 #17 (46 modelos, datos 25-ago-2026)Sigue listado: sora-2 $0,10/s 720p; Pro $0,30/$0,50/$0,70 (720p/1024p/1080p). Batch -50%RETIRADA: app 26-abr-2026; API 24-sep-2026 → 410 Gone. Aviso 24-mar-2026. Sin sucesor anunciado

💻 Locales (open-weight, en tu hardware)

ModeloLicenciaHardwareNotas
Wan 2.7Alibabaopen-weight16-24GB VRAM (14B)Alibaba, abr-2026 (7-abr según Alibaba Cloud). T2V/I2V/ref-to-video + edición, audio nativo, 15s. Sucesor Wan 3.0 (1242 #1)
LTX-2.3Lightricksopen-weightdesde 12GB VRAM (FP8: flujos de 32GB)Lightricks, 22B DiT, audio+vídeo en una pasada; ~18x más rápido que Wan 2.2 (NO VERIF); sucesor LTX-2.5 ya publicado
HunyuanVideoTencentopen-weight16-24GB VRAMTencent 13B, open dic-2024. CORREGIDO: sucesor HunyuanVideo 1.5 (8.3B, ~14GB VRAM, 20-nov-2025) NO es Apache 2.0
Mochi 1Genmoopen-weightfine-tune en 1×H100/A100 80GBGenmo, 10B AsymmDiT, oct-2024, Apache 2.0; 480p preview. Repo sin novedades desde nov-2024; sin sucesor ni cierre
SkyReels V1Skyworkopen-weightGPU dedicadaSkywork, 18-feb-2025, primer open human-centric (fine-tune HunyuanVideo), T2V+I2V; sucesores V2 abr-2025, V3 ene-2026, V4 feb-2026

Datos a 2026-09-04 · fuentes: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · el Elo de arena es preferencia humana a ciegas sobre el resultado; precios orientativos — verificar antes de decidir.