Zendoric

AI model comparison — text, image and video

The leading AI models from the US, Europe and China — text, image and video generation — compared by quality (market benchmarks), cost and open-source status, always separating remote (API) and local (on your hardware) models.

Data as of 2026-09-04 · automated research (Artificial Analysis, LMArena, official pricing) — verify before deciding.

📊 How quality is measured — three indices

We show quality three complementary ways. Here is how each index is built before you read the charts:

① Zendoric Quality (0-100) = equal-thirds average of SWE-bench-Pro (33% · real software development, checked against the maker) + LMArena (33% · human preference, normalised Elo) + Terminal-Bench (33% · agentic terminal capability). If a model lacks one of the three, its weight is shared among those present (at least two required).

② AA Index (Artificial Analysis Intelligence Index, 0-100) = a broader composite index (reasoning, science, code, maths). It gives a second reading: depending on how you measure, the maker ranking changes.

③ Cybersecurity (0-100) = capability on expert cyber tasks (hard «unguided pass@1» protocol: vuln-research and realistic exploitation). We use a non-saturated metric (the top is around 71, not 100, leaving headroom), not the Cybench «pass@k» the frontier already saturates. Sources: UK AISI, NIST-CAISI, CVE-Bench. We frame it as capability and risk, not an offensive ranking; where there is no direct eval it is estimated «est.».

📈 Zendoric Quality over time (frontier makers)

Quality index (0-100) of the top makers (their best model), last 24 months. Dashed line = quality estimated from the AA Index (labs without SWE-bench-Pro). Updated daily.

Moonshot AIAnthropicOpenAIxAIGoogleZhipu AIAlibabaDeepSeekMicrosoftMistral AIMeta
27415569829624-1025-0125-0425-0725-1026-0126-0426-0726-09Kimi k1.5Kimi K2Kimi K2.6Kimi K3Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Fable 5.1o3GPT-5GPT-5.5GPT-5.6 SolGPT-6 Astra (est.)Grok 4Grok 4.3Grok 4.6 (est.)Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.8 Flash (est.)GLM-4.5GLM-5GLM-5.2GLM-5.3-Flash (est.)Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-Thinking-1Large 3Mistral Large 3 (est.)Llama 4Llama 4 Maverick (est.)

📈 AA Index over time (frontier makers)

AA Index (Artificial Analysis Intelligence Index, 0-100) of the top makers (their best model), last 24 months. It is a broader composite index (reasoning, science, code, maths) than ours. The historical series is reconstructed by anchoring each maker's trajectory to its current AA. Updated daily.

AnthropicOpenAIxAIMoonshot AIGoogleZhipu AIAlibabaDeepSeekMicrosoftMistral AIMeta
8203346587124-1025-0125-0425-0725-1026-0126-0426-0726-09Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Fable 5.1o3GPT-5GPT-5.5GPT-5.6 SolGPT-6 AstraGrok 4Grok 4.3Grok 4.6Kimi k1.5Kimi K2Kimi K2.6Kimi K3Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.8 FlashGLM-4.5GLM-5GLM-5.2GLM-5.3-FlashQwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-Thinking-1Large 3Mistral Large 3Llama 4Llama 4 Maverick

🛡️ Cybersecurity over time (frontier makers)

Cybersecurity index (0-100) of each maker's best model, last 24 months. Metric: EXPERT cyber tasks under a hard «unguided pass@1» protocol (no hints, one attempt; vuln-research and realistic exploitation). We pick it because it is NOT saturated — the top is around 71, not 100, so it discriminates and shows headroom (we drop Cybench «pass@k», where the frontier already scores ~100%). Sources: UK AISI (GPT-5.5 71.4% vs Anthropic preview 68.6%), NIST-CAISI, CVE-Bench. High confidence only for OpenAI/Anthropic (measured by AISI); the rest imputed by proximity → the whole series is marked «est.». We frame it as capability and RISK to govern, not an offensive ranking. Updated daily.

OpenAIAnthropicZhipu AIGoogleMoonshot AIMicrosoftAlibabaxAIDeepSeekMistral AIMeta
21324354657624-1025-0125-0425-0725-1026-0126-0426-0726-09o3GPT-5GPT-5.5GPT-5.6 SolGPT-5.6 Sol (est.)Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Mythos 5 (est.)GLM-4.5GLM-5GLM-5.2GLM-5.2 (est.)Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3 Pro (est.)Kimi k1.5Kimi K2Kimi K2.6Kimi K2.6 (est.)MAI-1MAI-1 (est.)Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-Max (est.)Grok 4Grok 4.3Grok 4.3 (est.)V3R1V3.2V4-ProDeepSeek V4-Pro (est.)Large 3Mistral Large 3 (est.)Llama 4Llama 4 (est.)

💰 Zendoric Quality vs cost

Flagship models of the top makers by quality (a maker may have several, e.g. Anthropic: Opus 5, Opus 4.8 and Fable 5). HIGHER = more quality; LEFT = cheaper (log axis). Hollow dot = quality estimated (AA Index). Colour by maker.

OpenAIAnthropicGoogleMicrosoftMetaxAIMistral AIDeepSeekAlibabaMoonshot AIZhipu AI
Sweet spot264054688296$0.2$0.5$1$2$5$10$20$50Output cost ($/1M tokens · log scale)Kimi K3Claude Fable 5.1Claude Fable 5Claude Mythos 5Claude Opus 5GPT-6 Astra (est.)GPT-5.6 SolClaude Opus 4.8GPT-5.5Claude Sonnet 5Grok 4Claude Sonnet 4.6Grok 4.6 (est.)Gemini 3.8 Flash (est.)GLM-5.3-Flash (est.)Gemini 3.7 Flash (est.)GPT-5.6 TerraGrok 4.5GLM-5.2GPT-5.6 LunaQwen3.7-MaxKimi K2.6DeepSeek V4-ProGemini 3 ProMAI-Thinking-1Mistral Large 3 (est.)Llama 4 Maverick (est.)Magistral (est.)

💰 AA Index vs cost

Same format as the quality/cost chart, but the vertical axis is the AA Index. HIGHER = more capability; LEFT = cheaper (log axis). Hollow dot = estimated AA (Terminal-Bench/SWE-Pro). Colour by maker.

OpenAIAnthropicGoogleMicrosoftMetaxAIMistral AIDeepSeekAlibabaMoonshot AIZhipu AI
Sweet spot61932455871$0.2$0.5$1$2$5$10$20$50Output cost ($/1M tokens · log scale)AA IndexClaude Fable 5.1Claude Opus 5GPT-6 AstraClaude Fable 5Claude Mythos 5Kimi K3GPT-5.6 SolClaude Opus 4.8GPT-5.5Claude Sonnet 5Claude Sonnet 4.6Grok 4Grok 4.6Gemini 3.8 FlashGLM-5.3-FlashGemini 3.7 FlashGrok 4.5GPT-5.6 TerraGPT-5.6 LunaGLM-5.2Qwen3.7-MaxDeepSeek V4-ProKimi K2.6Gemini 3 ProMAI-Thinking-1Mistral Large 3Llama 4 MaverickMagistral

🏁 Efficient frontier — quality vs cost

Every cloud model with data. Y = AA Index; X = output cost, log and REVERSED: further RIGHT is cheaper — the top-right corner is ideal. The green line joins the efficient frontier: models with no alternative that is both better and cheaper; picking off the line is only justified by non-price factors (ecosystem, context, open source). Hollow dot = estimated AA. Hover a dot for details.

Efficient frontier (no model is both better and cheaper)Other models
61932455871$0.2$0.5$1$2$5$10$20$50Output cost ($/1M tokens · log scale · right = cheaper)most efficient ↗Claude Fable 5.1 — AA 66 · $50/1M tokensClaude Opus 5 — AA 63 · $25/1M tokensGPT-6 Astra — AA 61 · $50/1M tokensGrok 4.6 — AA 61 · $6/1M tokensClaude Fable 5 — AA 60 · $50/1M tokensClaude Mythos 5 — AA 60 · $50/1M tokensKimi K3 — AA 60 · $15/1M tokensGPT-5.6 Sol — AA 59 · $30/1M tokensGemini 3.8 Flash — AA 59 · $3.75/1M tokensGLM-5.3-Flash — AA 58 · $0.25/1M tokensClaude Opus 4.8 — AA 56 · $25/1M tokensGemini 3.7 Flash — AA 56 · $3.75/1M tokensGrok 4.5 — AA 56 · $6/1M tokensGPT-5.5 — AA 55 · $30/1M tokensGPT-5.6 Terra — AA 55 · $12/1M tokensClaude Sonnet 5 — AA 53 · $15/1M tokensGPT-5.6 Luna — AA 51 · $1.2/1M tokensGLM-5.2 — AA 51 · $2.2/1M tokensQwen3.7-Max — AA 46 · $6/1M tokensDeepSeek V4-Pro — AA 44 · $0.87/1M tokensKimi K2.6 — AA 43 · $2.5/1M tokensGemini 3 Pro — AA 40 · $10/1M tokensClaude Sonnet 4.6 — AA 37 · $15/1M tokensGrok 4 — AA 33 · $15/1M tokensMAI-Thinking-1 — AA 30 · $8/1M tokensMistral Large 3 — AA 16 · $6/1M tokensLlama 4 Maverick — AA 14 · $0.6/1M tokensMagistral — AA 11 · $1.5/1M tokensGLM-5.3-FlashDeepSeek V4-ProLlama 4 MaverickClaude Fable 5.1Claude Opus 5GPT-6 AstraGrok 4.6Claude Fable 5Claude Mythos 5Kimi K3GPT-5.6 SolGemini 3.8 FlashClaude Opus 4.8Gemini 3.7 FlashGrok 4.5GPT-5.5GPT-5.6 TerraClaude Sonnet 5GPT-5.6 LunaGLM-5.2Qwen3.7-MaxKimi K2.6Gemini 3 ProClaude Sonnet 4.6Grok 4MAI-Thinking-1Mistral Large 3Magistral

🏆 Zendoric Quality (SW dev + arena + agentic)

ModelZendoric QualitySWE-bench-ProDeepSWELMArenaTerminal-BenchLiveCodeBenchGPQAARC-AGI-2
🇨🇳 Kimi K3Moonshot AI · China91.4—68.5148988.368.093.5—
🆕 🇺🇸 Claude Fable 5.1Anthropic · USA90.681.2—1504————
🇺🇸 Claude Fable 5Anthropic · USA90.180.369.71515—91.792.6—
🇺🇸 Claude Mythos 5Anthropic · USA89.380.0—150788.091.794.1—
🇺🇸 Claude Opus 5Anthropic · USA86.879.273.6149384.6———
🇺🇸 GPT-5.6 SolOpenAI · USA82.764.672.7148391.9—94.6—
🇺🇸 GPT-5.6 TerraOpenAI · USA77.963.469.6146687.4—92.9—
🇺🇸 Grok 4.5xAI · USA77.864.753.8147183.3—93.1—
🇨🇳 GLM-5.2Zhipu AI · China76.962.169.0147581.080.2787
🇺🇸 Claude Opus 4.8Anthropic · USA76.569.259.0145582.788.88414
🇺🇸 GPT-5.5OpenAI · USA76.358.667.0147582.7—8516
🇺🇸 Claude Sonnet 5Anthropic · USA74.763.253.8146180.4—8312
🇺🇸 Grok 4xAI · USA74.2—66.7143083.379.48416
🇺🇸 GPT-5.6 LunaOpenAI · USA73.762.767.2—84.7—92.3—
🇨🇳 Qwen3.7-MaxAlibaba · China72.660.657.5147569.791.6817
🇨🇳 Kimi K2.6Moonshot AI · China68.458.6—146066.789.6789
🇨🇳 DeepSeek V4-ProDeepSeek · China66.155.462.8145067.993.5829
🇺🇸 Gemini 3 ProGoogle · USA65.843.311.7150154.291.78415
🇺🇸 Claude Sonnet 4.6Anthropic · USA63.458.129.9143067.0—809
🇺🇸 MAI-Thinking-1Microsoft · USA49.452.8——46.087.784.2—
🇺🇸 Gemini 3.7 FlashGoogle · USA——65.31491————
🇺🇸 Llama 4 MaverickMeta · USA———1288—43.4705
🇪🇺 Mistral Large 3Mistral AI · Europa———1418—74726
🇪🇺 MagistralMistral AI · Europa—————70.8870.074
🇨🇳 GLM-5.3-FlashZhipu AI · China——63.41474————
🆕 🇺🇸 GPT-6 AstraOpenAI · USA——————96.0—
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USA——73.81494————
🆕 🇺🇸 Grok 4.6xAI · USA——66.7—————

Quality = equal-thirds average of SWE-bench-Pro (SW development) + LMArena (human preference) + Terminal-Bench (agentic capability), the three with reliable sources (Zendoric Quality); if one is missing its weight is shared among those present (at least two; otherwise «—»). LiveCodeBench and GPQA are shown for reference (indicative, may be incomplete) but are NOT in the index; ARC-AGI-2 (arcprize.org) tracks AGI progress: models score VERY low → still far from AGI. %, except LMArena (Elo).

💵 Economics (USD / 1M tokens)

ModelInputCacheOutput
🇨🇳 Kimi K3Moonshot AI · China$3.0$0.3$15.0
🆕 🇺🇸 Claude Fable 5.1Anthropic · USA$10.0$0.25$50.0
🇺🇸 Claude Fable 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 Claude Mythos 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 Claude Opus 5Anthropic · USA$5.0$0.5$25.0
🇺🇸 GPT-5.6 SolOpenAI · USA$5.0$0.5$30.0
🇺🇸 GPT-5.6 TerraOpenAI · USA$2.0$0.2$12.0
🇺🇸 Grok 4.5xAI · USA$2.0$0.3$6.0
🇨🇳 GLM-5.2Zhipu AI · China$0.6$0.26$2.2
🇺🇸 Claude Opus 4.8Anthropic · USA$5.0$0.5$25.0
🇺🇸 GPT-5.5OpenAI · USA$5.0$0.5$30.0
🇺🇸 Claude Sonnet 5Anthropic · USAuntil Aug 31, 2026 $2.0
from Sep 1, 2026 $3.0
until Aug 31, 2026 $0.2
from Sep 1, 2026 $0.3
until Aug 31, 2026 $10.0
from Sep 1, 2026 $15.0
🇺🇸 Grok 4xAI · USA$3.0$0.75$15.0
🇺🇸 GPT-5.6 LunaOpenAI · USA$0.2$0.02$1.2
🇨🇳 Qwen3.7-MaxAlibaba · China$1.2$0.25$6.0
🇨🇳 Kimi K2.6Moonshot AI · China$0.6$0.16$2.5
🇨🇳 DeepSeek V4-ProDeepSeek · China$0.28$0.03$0.87
🇺🇸 Gemini 3 ProGoogle · USA$1.25$0.31$10.0
🇺🇸 Claude Sonnet 4.6Anthropic · USA$3.0$0.3$15.0
🇺🇸 MAI-Thinking-1Microsoft · USA$2.0—$8.0
🇺🇸 Gemini 3.7 FlashGoogle · USA$0.75$0.07$3.75
🇺🇸 Llama 4 MaverickMeta · USA$0.2—$0.6
🇪🇺 Mistral Large 3Mistral AI · Europa$2.0$0.05$6.0
🇪🇺 MagistralMistral AI · Europa$0.5$0.01$1.5
🇨🇳 GLM-5.3-FlashZhipu AI · China$0.07$0.01$0.25
🆕 🇺🇸 GPT-6 AstraOpenAI · USA$10.0$1.0$50.0
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USA$0.75—$3.75
🆕 🇺🇸 Grok 4.6xAI · USA$2.0$0.5$6.0

Claude Sonnet 5: scheduled price increase (same model) — reduced pricing until Aug 31, 2026 and standard pricing from Sep 1, 2026.

🔓 Open source & type

ModelOpen sourceLicenseType
🇨🇳 Kimi K3Moonshot AI · ChinaYesModified MITOpen-weight
🆕 🇺🇸 Claude Fable 5.1Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 Claude Fable 5Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 Claude Mythos 5Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 Claude Opus 5Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 GPT-5.6 SolOpenAI · USANoProprietaryProprietary (API only)
🇺🇸 GPT-5.6 TerraOpenAI · USANoProprietaryProprietary (API only)
🇺🇸 Grok 4.5xAI · USANoProprietaryProprietary (API only)
🇨🇳 GLM-5.2Zhipu AI · ChinaYesMITOpen-weight
🇺🇸 Claude Opus 4.8Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 GPT-5.5OpenAI · USANoProprietaryProprietary (API only)
🇺🇸 Claude Sonnet 5Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 Grok 4xAI · USANoProprietaryProprietary (API only)
🇺🇸 GPT-5.6 LunaOpenAI · USANoProprietaryProprietary (API only)
🇨🇳 Qwen3.7-MaxAlibaba · ChinaNoProprietaryProprietary (API only)
🇨🇳 Kimi K2.6Moonshot AI · ChinaYesModified MITOpen-weight
🇨🇳 DeepSeek V4-ProDeepSeek · ChinaYesMITOpen-weight
🇺🇸 Gemini 3 ProGoogle · USANoProprietaryProprietary (API only)
🇺🇸 Claude Sonnet 4.6Anthropic · USANoProprietaryProprietary (API only)
🇺🇸 MAI-Thinking-1Microsoft · USANoProprietaryProprietary (API only)
🇺🇸 Gemini 3.7 FlashGoogle · USANoProprietaryProprietary (API only)
🇺🇸 Llama 4 MaverickMeta · USAYesLlama 4 CommunityOpen-weight
🇪🇺 Mistral Large 3Mistral AI · EuropaYesApache-2.0Open-weight
🇪🇺 MagistralMistral AI · EuropaYesApache-2.0Open-weight
🇨🇳 GLM-5.3-FlashZhipu AI · ChinaYesMITOpen-weight
🆕 🇺🇸 GPT-6 AstraOpenAI · USANoProprietaryProprietary (API only)
🆕 🇺🇸 Gemini 3.8 FlashGoogle · USANoProprietaryProprietary (API only)
🆕 🇺🇸 Grok 4.6xAI · USANoProprietaryProprietary (API only)

🖥️ Open source you can self-host

Small/medium models you can run on your own machine (laptop/PC/Mac). Quality = Artificial Analysis Intelligence Index (0-100; output quality), the measure with best coverage of small open models (LMArena does not list sub-32B). Memory estimated at 4-bit (Q4) and 8-bit (Q8) quantization; on Apple Silicon it is UNIFIED memory (RAM=VRAM).

ModelQuality (AA Index)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicense
Qwen3.5 27BAlibaba4285.527B16 GB31 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 31BGoogle3984.331B19 GB36 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Qwen3.5 35B A3BAlibaba3784.235B21 GB40 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 26B A4BGoogle3182.326B16 GB30 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Nemotron-Cascade-2-30B-A3BNVIDIA2876.130B18 GB34 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)NVIDIA Open Model
gpt-oss-20bOpenAI2471.520B13 GB25 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 12BGoogle2278.812B8 GB15 GB≥8 GBSí (CPU lento · Mac 16 GB)Gemma
Gemma 4 E4BGoogle1958.64B4 GB6 GB≥8 GBSí (CPU/Mac, fluido)Gemma
Gemma 4 E2BGoogle1543.42B3 GB4 GB≥8 GBSí (CPU/Mac, fluido)Gemma

🗄️ Large open source (server / multi-GPU)

Powerful open models that need a server or multiple GPUs. Quality = LMArena Elo (human preference over output, source lmarena.ai), which does cover large models. For MoE, memory counts total parameters (all experts are loaded). Memory estimated at 4-bit (Q4) and 8-bit (Q8) quantization; on Apple Silicon it is UNIFIED memory (RAM=VRAM).

ModelQuality (LMArena)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicense
GLM-5.2Zhipu AI147291.2400B222 GB442 GB3× 80 GB (servidor)No (servidor GPU)MIT
DeepSeek-V4-Pro-0813DeepSeek146590.11600B882 GB1762 GB12× 80 GB (servidor)No (servidor GPU)MIT
Kimi K2.6Moonshot AI146090.51100B606 GB1212 GB8× 80 GB (servidor)No (servidor GPU)Modified MIT
Qwen3.5-397B-A17BAlibaba145088.4397B220 GB438 GB3× 80 GB (servidor)No (servidor GPU)Apache-2.0
Llama 4 MaverickMeta142069.8400B222 GB442 GB3× 80 GB (servidor)No (servidor GPU)Llama 4 Community
Mistral Large 3Mistral AI141668.0675B373 GB744 GB5× 80 GB (servidor)No (servidor GPU)Apache-2.0
gpt-oss-120bOpenAI135280.1117B66 GB130 GB≥80 GBNo (servidor GPU)Apache-2.0

🎨 Image generation

The leading IMAGE generation models, split between remote services (pay per image via API) and open models you can run on your own hardware.

☁️ Remote (API / cloud)

ModelQuality (arena)Price (per image)Notes
GPT Image 2OpenAI · USA1369 AA nº1 (era 1338); 2º MAI-Image-2.6-Prev 1350, gap 19; Reve 2.1 3º 1323. arena.ai 1382 nº1$0,211/img high 1024² (=$211/1K API OpenAI); fal.ai $0,005 low a $0,401 high 4K — CONFIRMADO al detalleNº1 t2i confirmado (AA y arena.ai). Lanzado abr-2026. Modelo con razonamiento; texto y prompt adherence líder
MAI-Image-2.5Microsoft · USA1303 AA (era 1269), nº6 t2i (era nº3); superada por MAI-Image-2.6-Preview 1350 nº2 y 2.5-Pro 1292 nº8Azure Foundry $47/M img out confirmado; $0,048/img confirmado (AA $48,1/1K)Microsoft. Nueva gen MAI-Image-2.6-Preview (ago-2026) nº2 t2i y nº1 editing. Variantes Pro $108,5/1K y Flash $20/1K
Nano Banana Pro (Gemini 3 Pro Image)Google · USA1296 AA t2i (era 1222), nº7 de 155 (era nº9 de 81); superada por Nano Banana 2 (1320, nº4)$0,134/img 1-2K · $0,24/img 4K Gemini API (Batch 50% → 4K ~$0,12) confirmado= Gemini 3 Pro Image. Salida hasta 4096×4096. GA jun-2026, SynthID; activo, sin deprecación
Nano Banana 2 Lite (Gemini 3.1 Flash Lite)Google · USA1287 AA t2i (era 1262), nº9 de 155 (era nº4)$0,034/img (1K) Gemini API confirmado (Batch $0,017)= Gemini 3.1 Flash Lite Image. Rápida/barata ~4s (no verif.), solo 1K
GPT Image 1.5OpenAI · USA1304 AA (era 1260), nº5 t2i (sube, era nº6)$0,009 low · $0,034 medio · $0,133 high (1024² OpenAI/fal.ai) — CONFIRMADO al detalleGen. anterior OpenAI (dic-2025), aún muy competitiva: nº5 AA, por encima de MAI-2.5. Sin deprecación
Grok ImaginexAI · USA1234 AA image-quality nº13 (era 1203/nº12); base 1216 nº24. Nuevo Imagine 2.0 nº3 arena.ai 1316$0,02/img base; quality $0,05 (1K)/$0,07 (2K); nuevo grok-imagine-image-2.0 $0,04/img (docs x.ai)xAI. CORREGIDO: i2v NO es nº1; grok-imagine-video-1.5 nº5 AA (1109). Nº1 i2v es Minimax H3 Max (1203)
Cosmos 3 SuperNVIDIA · USAAA t2i 1184 agentic (r46) y 1176 base; ya NO nº1 open (FLUX.2 [dev] 1197 delante). Debutó 1219 nº1 openOpen weights OpenMDW-1.1 (self-host gratis, uso comercial); API $0,04/img en fal (+$0,02 prompt expansion)NVIDIA, omnimodal MoT dual-tower 64B desde Qwen3-VL 32B. Superado en open por FLUX.2 [dev]

💻 Local (open-weight, on your hardware)

ModelLicenseHardwareNotes
FLUX.2Black Forest Labsopen-weight + APIGPU dedicada (variantes dev/FP8)Lanz. 25-nov-2025; max dic-2025; klein 15-ene-2026 (4B Apache 2.0; 9B disputada). FLUX.3 ya salió (jul-2026, cerrado)
Qwen-Image 2.0AlibabaApache-2.07B — GPU 16GB+Lanz. 10-feb-2026, decoder 7B + enc. Qwen3-VL 8B, 2K nativo. Sucedido por Qwen-Image-3.0 (GA 5-ago-2026, cerrado)
Z-Image TurboAlibaba (Tongyi)open-weight~1 s/imagen en H100; corre en Mac (MLX)Alibaba Tongyi-MAI, 6B S3-DiT, 8 NFE, sub-segundo en H100. Familia: Base, Edit, Omni-Base
Stable Diffusion 3.5Stability AIStability CommunityGPU 8-16GBVigente ago-2026, no retirado, sigue flagship de Stability. Mayor ecosistema (Civitai, ComfyUI, LoRAs)
HiDream-O1-Image-1.5HiDreamopen-weightGPU dedicadav1.5 cerrada (hosted), hasta 2K, pixel-native UiT sin VAE. Dev abierto (MIT). Debutó #3 AA, hoy #16

Data as of 2026-09-04 · sources: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · arena Elo is blind human preference over the output; indicative prices — verify before deciding.

🎬 Video generation

The leading VIDEO generation models, split between remote services (pay per generated second via API) and open models for your own hardware.

☁️ Remote (API / cloud)

ModelQuality (arena)Price (per second)Notes
Kling 3.0 / TurboKuaishou · ChinaAA t2v c/audio 1108 #9 (Pro 1080p) · sin audio ~1246 · i2v 1071 #14. llm-stats 1934 #1; ausente de arena.aifal Turbo Pro 1080p $0,14/s; Turbo Std 720p $0,112/s. AA Kling 3.0 Pro 1080p $20,16/min (~$0,34/s)Kuaishou 5-feb-2026 (3.0/Omni); Turbo 17-jun-2026. Hasta 15s, audio nativo, multi-shot 6 clips. Sin Kling 3.5
Veo 3.1Google · USAAA c/audio: 3.1 = 1092 #13, Lite 1089 #14, Fast 1086 #17. i2v 1086 #9. arena.ai Veo 3.1 Audio 1364 #10Gemini API: Lite $0,05/s 720p · Fast $0,10/s ($0,12 1080p) · Std $0,40/s 720p/1080p, $0,60/s 4K (audio incl.)Tres niveles + audio nativo (Vertex/Gemini API). Superado por Gemini Omni Flash/1.1 en AA y arena.ai
Gemini Omni FlashGoogle · USAAA t2v c/audio 1237 #2 (lidera Wan 3.0 1242); sin audio 1325 #1. i2v 1179 #4 c/audio, 1365 #1 sin audioVERIFICADO ~$0,10/s (720p) Gemini API. Omni 1.1: $0,03/s 360p · $0,10/s 720p · $0,15/s 1080p · $0,30/s 4KGoogle I/O may-2026. NUEVA VERSIÓN Gemini Omni 1.1 Flash (29-ago-2026): 40s, 4K upscale, #1 arena.ai 1515
Seedance 2.0 (Dreamina)ByteDance · ChinaAA t2v 720p 1221 #5 c/audio · 1267 #4 sin audio. i2v 1190 #2 c/audio, 1336 #3 sin audio. arena.ai 1479 #4AA $9,07/min 720p (~$0,15/s). EvoLink 720p Std $0,199/s, Fast $0,161/s; 480p $0,092/$0,074. Audio incluidoByteDance 12-feb-2026, 15s + audio. SUPERADO: Seedance 2.5 (31-jul-2026, API 7-ago): 30s, 50 refs, 4K
Sora 2OpenAI · USAAusente de AA. arena.ai t2v: Sora 2 Pro 1365 #9, Sora 2 1341 #17 (46 modelos, datos 25-ago-2026)Sigue listado: sora-2 $0,10/s 720p; Pro $0,30/$0,50/$0,70 (720p/1024p/1080p). Batch -50%RETIRADA: app 26-abr-2026; API 24-sep-2026 → 410 Gone. Aviso 24-mar-2026. Sin sucesor anunciado

💻 Local (open-weight, on your hardware)

ModelLicenseHardwareNotes
Wan 2.7Alibabaopen-weight16-24GB VRAM (14B)Alibaba, abr-2026 (7-abr según Alibaba Cloud). T2V/I2V/ref-to-video + edición, audio nativo, 15s. Sucesor Wan 3.0 (1242 #1)
LTX-2.3Lightricksopen-weightdesde 12GB VRAM (FP8: flujos de 32GB)Lightricks, 22B DiT, audio+vídeo en una pasada; ~18x más rápido que Wan 2.2 (NO VERIF); sucesor LTX-2.5 ya publicado
HunyuanVideoTencentopen-weight16-24GB VRAMTencent 13B, open dic-2024. CORREGIDO: sucesor HunyuanVideo 1.5 (8.3B, ~14GB VRAM, 20-nov-2025) NO es Apache 2.0
Mochi 1Genmoopen-weightfine-tune en 1×H100/A100 80GBGenmo, 10B AsymmDiT, oct-2024, Apache 2.0; 480p preview. Repo sin novedades desde nov-2024; sin sucesor ni cierre
SkyReels V1Skyworkopen-weightGPU dedicadaSkywork, 18-feb-2025, primer open human-centric (fine-tune HunyuanVideo), T2V+I2V; sucesores V2 abr-2025, V3 ene-2026, V4 feb-2026

Data as of 2026-09-04 · sources: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · arena Elo is blind human preference over the output; indicative prices — verify before deciding.