Zendoric

Comparativa de modelos de IA — texto, imagen y vídeo

Los principales modelos de IA de EE.UU., Europa y China — generación de texto, imagen y vídeo — comparados por calidad (benchmarks de mercado), coste y si son open source, separando siempre modelos remotos (API) y locales (en tu hardware).

Datos a 2026-07-25 · investigación automática (Artificial Analysis, LMArena, precios oficiales) — verificar antes de decidir.

📊 Cómo se mide la calidad — tres índices

Mostramos la calidad de tres formas complementarias. Así se compone cada índice antes de ver las gráficas:

① Calidad de Zendoric (0-100) = media a tercios de SWE-bench-Pro (33% · desarrollo de software real, cotejado con el fabricante) + LMArena (33% · preferencia humana, Elo normalizado) + Terminal-Bench (33% · capacidad agéntica en terminal). Si a un modelo le falta una de las tres, su peso se reparte entre las presentes (se exigen al menos dos).

② AA Index (Artificial Analysis Intelligence Index, 0-100) = índice compuesto y más amplio (razonamiento, ciencia, código, matemáticas). Ofrece una segunda lectura: según cómo se mida, el orden de los fabricantes cambia.

③ Ciberseguridad (0-100) = capacidad en tareas cyber expert (protocolo duro «unguided pass@1»: vuln-research y explotación realista). Usamos una métrica no saturada (el top ronda 71, no 100, y deja ver el recorrido), no el Cybench «pass@k» que la frontera ya satura. Fuentes: UK AISI, NIST-CAISI, CVE-Bench. La encuadramos como capacidad y riesgo, no como ranking ofensivo; donde no hay eval directa se estima «est.».

📈 Evolución de la Calidad de Zendoric (fabricantes frontera)

Índice de calidad (0-100) de los fabricantes punteros (su mejor modelo), últimos 24 meses. Línea punteada = calidad estimada por AA Index (labs sin SWE-bench-Pro). Se actualiza cada día.

Moonshot AIAnthropicOpenAIxAIZhipu AIGoogleAlibabaDeepSeekMicrosoftMistral AIMeta
26405468829624-0824-1125-0225-0525-0825-1126-0226-0526-07Kimi k1.5Kimi K2Kimi K2.6Kimi K3Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Fable 5o1o3GPT-5GPT-5.5GPT-5.6 SolGPT-5.6 Terra (est.)Grok 4Grok 4.3Grok 4.5GLM-4-PlusGLM-4.5GLM-5GLM-5.2GLM-5.2Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.6 Flash (est.)Qwen2.5Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-1-previewLarge 3Mistral Large 3 (est.)Llama 4Llama 4 Maverick (est.)

📈 Evolución del AA Index (fabricantes frontera)

AA Index (Artificial Analysis Intelligence Index, 0-100) de los fabricantes punteros (su mejor modelo), últimos 24 meses. Es un índice compuesto y más amplio (razonamiento, ciencia, código, matemáticas) que nuestro índice. La serie histórica está reconstruida anclando la trayectoria de cada fabricante a su AA actual. Se actualiza cada día.

AnthropicMoonshot AIOpenAIxAIZhipu AIGoogleAlibabaDeepSeekMicrosoftMistral AIMeta
8193143546624-0824-1125-0225-0525-0825-1126-0226-0526-07Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Opus 5Kimi k1.5Kimi K2Kimi K2.6Kimi K3o1o3GPT-5GPT-5.5GPT-5.6 SolGPT-5.6 SolGrok 4Grok 4.3Grok 4.5GLM-4-PlusGLM-4.5GLM-5GLM-5.2GLM-5.2Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3.6 FlashQwen2.5Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-MaxV3R1V3.2V4-ProDeepSeek V4-ProMAI-1MAI-1-previewLarge 3Mistral Large 3Llama 4Llama 4 Maverick

🛡️ Evolución en ciberseguridad (fabricantes frontera)

Índice de ciberseguridad (0-100) del mejor modelo de cada fabricante, últimos 24 meses. Métrica: tareas cyber EXPERT en protocolo duro «unguided pass@1» (sin pistas, un intento; vuln-research y explotación realista). La elegimos porque NO está saturada — el top ronda 71, no 100, así que discrimina y deja ver el recorrido (descartamos el Cybench «pass@k», donde la frontera ya hace ~100%). Fuentes: UK AISI (GPT-5.5 71,4 % vs Anthropic preview 68,6 %), NIST-CAISI, CVE-Bench. Confianza alta solo en OpenAI/Anthropic (medidos por AISI); el resto, imputado por proximidad → toda la serie va marcada «est.». Lo encuadramos como capacidad y RIESGO a gobernar, no como ranking ofensivo. Se actualiza cada día.

OpenAIAnthropicZhipu AIGoogleMoonshot AIMicrosoftAlibabaxAIDeepSeekMistral AIMeta
18304253647624-0824-1125-0225-0525-0825-1126-0226-0526-07o1o3GPT-5GPT-5.5GPT-5.6 SolGPT-5.6 Sol (est.)Sonnet 3.5 v2Sonnet 3.7Opus 4Opus 4.7Opus 4.8Fable 5Opus 5Claude Mythos 5 (est.)GLM-4-PlusGLM-4.5GLM-5GLM-5.2GLM-5.2 (est.)Gemini 2.0Gemini 2.5Gemini 3 ProGemini 3 Pro (est.)Kimi k1.5Kimi K2Kimi K2.6Kimi K2.6 (est.)MAI-1MAI-1 (est.)Qwen2.5Qwen3Qwen3.5Qwen3.7-MaxQwen3.7-Max (est.)Grok 4Grok 4.3Grok 4.3 (est.)V3R1V3.2V4-ProDeepSeek V4-Pro (est.)Large 3Mistral Large 3 (est.)Llama 4Llama 4 (est.)

💰 Calidad de Zendoric frente a coste

Modelos punteros de los fabricantes con mejor calidad (un fabricante puede tener varios, p.ej. Anthropic: Opus 5, Opus 4.8 y Fable 5). Más ARRIBA = más calidad; más a la IZQUIERDA = más barato (eje log). Lo ideal, arriba-izquierda. Punto hueco = calidad estimada (AA Index). Color por fabricante.

OpenAIAnthropicGooglexAIDeepSeekAlibabaMoonshot AIZhipu AIMistral AIMeta
Zona ideal364860728496$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log)Claude Fable 5Claude Mythos 5GPT-5.6 SolClaude Opus 4.8GPT-5.5Kimi K3GPT-5.6 Terra (est.)Grok 4.5GLM-5.2Gemini 3.6 Flash (est.)Claude Sonnet 5Grok 4Qwen3.7-MaxKimi K2.6DeepSeek V4-ProGemini 3 ProClaude Sonnet 4.6Mistral Large 3 (est.)Llama 4 Maverick (est.)

💰 AA Index frente a coste

Mismo formato que el de calidad/coste, pero el eje vertical es el AA Index. Más ARRIBA = más capacidad; más a la IZQUIERDA = más barato (eje log). Punto hueco = AA estimado (Terminal-Bench/SWE-Pro). Color por fabricante.

OpenAIAnthropicGoogleMetaxAIMistral AIDeepSeekAlibabaMoonshot AIZhipu AI
Zona ideal61830425466$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log)AA IndexClaude Opus 5Claude Fable 5Claude Mythos 5GPT-5.6 SolClaude Opus 4.8GPT-5.5Kimi K3GPT-5.6 TerraGrok 4.5Claude Sonnet 5GLM-5.2GPT-5.6 LunaGemini 3.6 FlashClaude Sonnet 4.6Qwen3.7-MaxDeepSeek V4-ProKimi K2.6Gemini 3 ProGrok 4Mistral Large 3Llama 4 MaverickMagistral Small

🏁 Frontera eficiente — calidad frente a coste

Todos los modelos cloud con datos. Eje Y = AA Index; eje X = coste de salida, log e INVERTIDO: cuanto más a la DERECHA, más barato — la esquina superior derecha es la ideal. La línea verde une la frontera eficiente: modelos para los que no existe otro mejor y más barato a la vez; elegir fuera de esa línea solo se justifica por factores ajenos al precio (ecosistema, contexto, open source). Punto hueco = AA estimado. Pasa el ratón por un punto para ver el detalle.

Frontera eficiente (nadie es mejor y más barato a la vez)Resto de modelos
61830425466$0.5$1$2$5$10$20$50Coste de salida ($/1M tokens · escala log · derecha = más barato)más eficiente ↗Claude Opus 5 — AA 61 · $25/1M tokensClaude Fable 5 — AA 60 · $50/1M tokensClaude Mythos 5 — AA 60 · $50/1M tokensKimi K3 — AA 57 · $15/1M tokensGPT-5.6 Sol — AA 56 · $30/1M tokensClaude Opus 4.8 — AA 56 · $25/1M tokensGPT-5.5 — AA 55 · $30/1M tokensGPT-5.6 Terra — AA 55 · $15/1M tokensGrok 4.5 — AA 54 · $6/1M tokensClaude Sonnet 5 — AA 53 · $15/1M tokensGLM-5.2 — AA 51 · $2.2/1M tokensGPT-5.6 Luna — AA 51 · $6/1M tokensGemini 3.6 Flash — AA 50 · $7.5/1M tokensClaude Sonnet 4.6 — AA 47 · $15/1M tokensQwen3.7-Max — AA 46 · $6/1M tokensDeepSeek V4-Pro — AA 44 · $0.87/1M tokensKimi K2.6 — AA 43 · $2.5/1M tokensGemini 3 Pro — AA 40 · $10/1M tokensGrok 4 — AA 33 · $15/1M tokensMistral Large 3 — AA 16 · $6/1M tokensLlama 4 Maverick — AA 14 · $0.6/1M tokensMagistral Small — AA 11 · $1.5/1M tokensDeepSeek V4-ProLlama 4 MaverickMagistral SmallClaude Opus 5Claude Fable 5Claude Mythos 5Kimi K3GPT-5.6 SolClaude Opus 4.8GPT-5.5GPT-5.6 TerraGrok 4.5Claude Sonnet 5GLM-5.2GPT-5.6 LunaGemini 3.6 FlashClaude Sonnet 4.6Qwen3.7-MaxKimi K2.6Gemini 3 ProGrok 4Mistral Large 3

🏆 Calidad de Zendoric (desarrollo SW + arena + agéntica)

ModeloCalidad ZendoricSWE-bench-ProDeepSWELMArenaTerminal-BenchLiveCodeBenchGPQAARC-AGI-2
🇨🇳 Kimi K3Moonshot AI · China90.767.5148688.368.093.5
🇺🇸 Claude Fable 5Anthropic · USA90.180.369.7151591.792.6
🇺🇸 Claude Mythos 5Anthropic · USA88.180.0150784.391.794.1
🇺🇸 GPT-5.6 SolOpenAI · USA78.963.072.7147088.887
🇺🇸 Grok 4.5xAI · USA77.364.753146883.393.1
🇨🇳 GLM-5.2Zhipu AI · China76.962.146.2147581.080.2787
🇺🇸 Claude Opus 4.8Anthropic · USA76.569.259.0145582.788.88414
🇺🇸 GPT-5.5OpenAI · USA76.358.667.0147582.78516
🇺🇸 Claude Sonnet 5Anthropic · USA74.763.253.8146180.48312
🇺🇸 Grok 4xAI · USA74.2143083.379.48416
🇨🇳 Qwen3.7-MaxAlibaba · China72.660.6147569.791.6817
🇨🇳 Kimi K2.6Moonshot AI · China68.458.6146066.789.6789
🇨🇳 DeepSeek V4-ProDeepSeek · China66.155.4145067.993.5829
🇺🇸 Gemini 3 ProGoogle · USA65.843.3150154.291.78415
🇺🇸 Claude Sonnet 4.6Anthropic · USA63.458.129.9143067.0809
🇺🇸 MAI-1-previewMicrosoft · USA49.452.846.087.784.2
🇺🇸 Claude Opus 5Anthropic · USA79.2
🇺🇸 Llama 4 MaverickMeta · USA128843.4705
🇪🇺 Mistral Large 3Mistral AI · Europa141574726
🇪🇺 Magistral SmallMistral AI · Europa70.8870.074
🆕 🇺🇸 GPT-5.6 TerraOpenAI · USA87.4
🆕 🇺🇸 GPT-5.6 LunaOpenAI · USA84.7
🆕 🇺🇸 Gemini 3.6 FlashGoogle · USA491485
🆕 🇨🇳 Qwen3.8-Max-PreviewAlibaba (Qwen) · China

Calidad de Zendoric = media a tercios de SWE-bench-Pro (desarrollo de SW) + LMArena (preferencia humana) + Terminal-Bench (capacidad agéntica), las tres con fuente fiable; si falta alguna se reparte su peso entre las presentes (mínimo dos; si no, «—»). LiveCodeBench y GPQA se muestran como referencia (orientativas, pueden estar incompletas) pero NO entran en el índice; ARC-AGI-2 (arcprize.org) mide progreso hacia AGI: los modelos puntúan MUY bajo → aún lejos de AGI. %, salvo LMArena (Elo).

💵 Economía (USD / 1M tokens)

ModeloInputCacheOutput
🇨🇳 Kimi K3Moonshot AI · China$3.0$0.3$15.0
🇺🇸 Claude Fable 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 Claude Mythos 5Anthropic · USA$10.0$1.0$50.0
🇺🇸 GPT-5.6 SolOpenAI · USA$5.0$0.5$30.0
🇺🇸 Grok 4.5xAI · USA$2.0$0.3$6.0
🇨🇳 GLM-5.2Zhipu AI · China$0.6$0.26$2.2
🇺🇸 Claude Opus 4.8Anthropic · USA$5.0$0.5$25.0
🇺🇸 GPT-5.5OpenAI · USA$5.0$0.5$30.0
🇺🇸 Claude Sonnet 5Anthropic · USAhasta 31 ago 2026 $2.0
desde 1 sep 2026 $3.0
hasta 31 ago 2026 $0.2
desde 1 sep 2026 $0.3
hasta 31 ago 2026 $10.0
desde 1 sep 2026 $15.0
🇺🇸 Grok 4xAI · USA$3.0$0.75$15.0
🇨🇳 Qwen3.7-MaxAlibaba · China$1.2$0.25$6.0
🇨🇳 Kimi K2.6Moonshot AI · China$0.6$0.16$2.5
🇨🇳 DeepSeek V4-ProDeepSeek · China$0.28$0.03$0.87
🇺🇸 Gemini 3 ProGoogle · USA$1.25$0.31$10.0
🇺🇸 Claude Sonnet 4.6Anthropic · USA$3.0$0.3$15.0
🇺🇸 MAI-1-previewMicrosoft · USA
🇺🇸 Claude Opus 5Anthropic · USA$5.0$0.5$25.0
🇺🇸 Llama 4 MaverickMeta · USA$0.2$0.6
🇪🇺 Mistral Large 3Mistral AI · Europa$2.0$0.2$6.0
🇪🇺 Magistral SmallMistral AI · Europa$0.5$0.05$1.5
🆕 🇺🇸 GPT-5.6 TerraOpenAI · USA$2.5$0.25$15.0
🆕 🇺🇸 GPT-5.6 LunaOpenAI · USA$1.0$0.1$6.0
🆕 🇺🇸 Gemini 3.6 FlashGoogle · USA$1.5$0.15$7.5
🆕 🇨🇳 Qwen3.8-Max-PreviewAlibaba (Qwen) · China

Claude Sonnet 5: subida de tarifas programada (mismo modelo) — precio reducido hasta el 31 ago 2026 y tarifa estándar desde el 1 sep 2026.

🔓 Open source y variedad

ModeloOpen sourceLicenciaVariedad
🇨🇳 Kimi K3Moonshot AI · ChinaNoPropietarioPropietario (solo API)
🇺🇸 Claude Fable 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Mythos 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.6 SolOpenAI · USANoPropietarioPropietario (solo API)
🇺🇸 Grok 4.5xAI · USANoPropietarioPropietario (solo API)
🇨🇳 GLM-5.2Zhipu AI · ChinaMITOpen-weight (pesos abiertos)
🇺🇸 Claude Opus 4.8Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 GPT-5.5OpenAI · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Sonnet 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Grok 4xAI · USANoPropietarioPropietario (solo API)
🇨🇳 Qwen3.7-MaxAlibaba · ChinaNoPropietarioPropietario (solo API)
🇨🇳 Kimi K2.6Moonshot AI · ChinaModified MITOpen-weight (pesos abiertos)
🇨🇳 DeepSeek V4-ProDeepSeek · ChinaMITOpen-weight (pesos abiertos)
🇺🇸 Gemini 3 ProGoogle · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Sonnet 4.6Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 MAI-1-previewMicrosoft · USANoPropietarioPropietario (solo API)
🇺🇸 Claude Opus 5Anthropic · USANoPropietarioPropietario (solo API)
🇺🇸 Llama 4 MaverickMeta · USALlama 4 CommunityOpen-weight (pesos abiertos)
🇪🇺 Mistral Large 3Mistral AI · EuropaApache-2.0Open-weight (pesos abiertos)
🇪🇺 Magistral SmallMistral AI · EuropaApache-2.0Open-weight (pesos abiertos)
🆕 🇺🇸 GPT-5.6 TerraOpenAI · USANoPropietarioPropietario (solo API)
🆕 🇺🇸 GPT-5.6 LunaOpenAI · USANoPropietarioPropietario (solo API)
🆕 🇺🇸 Gemini 3.6 FlashGoogle · USANoPropietarioPropietario (solo API)
🆕 🇨🇳 Qwen3.8-Max-PreviewAlibaba (Qwen) · ChinaNoPropietarioPropietario (solo API)

🖥️ Open source para tu hardware

Pequeños/medianos que corren en un equipo propio (portátil/PC/Mac). Calidad = Artificial Analysis Intelligence Index (0-100; calidad del output), la medida con mejor cobertura en modelos open pequeños (LMArena no lista los sub-32B). Memoria estimada en cuantización 4-bit (Q4) y 8-bit (Q8); en Apple Silicon es memoria UNIFICADA (RAM=VRAM).

ModeloCalidad (AA Index)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicencia
Qwen3.5-27BAlibaba4285.527B16 GB31 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 31BGoogle398631B18 GB35 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Qwen3.5-35B-A3BAlibaba3784.235B21 GB40 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 26B A4BGoogle3182.326B15 GB29 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Gemma
Nemotron-Cascade-2-30B-A3BNVIDIA2876.130B19 GB36 GB≥24 GBLimitado (mejor GPU/Mac ≥32 GB)NVIDIA Open Model
gpt-oss-20bOpenAI2471.520B13 GB25 GB≥16 GBLimitado (mejor GPU/Mac ≥32 GB)Apache-2.0
Gemma 4 12BGoogle2278.812B8 GB15 GB≥8 GBSí (CPU lento · Mac 16 GB)Gemma
Gemma 4 E4BGoogle1958.64B4 GB6 GB≥8 GBSí (CPU/Mac, fluido)Gemma
Gemma 4 E2BGoogle1543.42B3 GB4 GB≥8 GBSí (CPU/Mac, fluido)Gemma

🗄️ Open source grande (servidor / multi-GPU)

Modelos open potentes pero que necesitan servidor o varias GPU. Calidad = LMArena Elo (preferencia humana sobre el output, fuente lmarena.ai), que sí cubre los modelos grandes. En MoE la memoria cuenta el total de parámetros (todos los expertos se cargan). Memoria estimada en cuantización 4-bit (Q4) y 8-bit (Q8); en Apple Silicon es memoria UNIFICADA (RAM=VRAM).

ModeloCalidad (LMArena)GPQAParamsRAM Q4RAM Q8GPUCPU / MacLicencia
DeepSeek-V4-ProDeepSeek146590.11600B882 GB1762 GB12× 80 GB (servidor)No (servidor GPU)MIT
GLM-5.2Zhipu AI146591.2744B411 GB820 GB6× 80 GB (servidor)No (servidor GPU)MIT
Kimi K2.6Moonshot AI146090.51100B552 GB1102 GB7× 80 GB (servidor)No (servidor GPU)Modified MIT
Qwen3.5-397B-A17BAlibaba145088.4397B220 GB438 GB3× 80 GB (servidor)No (servidor GPU)Apache-2.0
Llama 4 MaverickMeta142069.8400B223 GB444 GB3× 80 GB (servidor)No (servidor GPU)Llama 4 Community
Mistral Large 3Mistral AI141668.0675B373 GB744 GB5× 80 GB (servidor)No (servidor GPU)Apache-2.0
gpt-oss-120bOpenAI135280.1117B66 GB130 GB≥80 GBNo (servidor GPU)Apache-2.0

🎨 Generación de imagen

Los principales modelos de generación de IMAGEN, separados entre servicios remotos (pagas por imagen vía API) y modelos abiertos que puedes ejecutar en tu propio hardware.

☁️ Remotos (API / cloud)

ModeloCalidad (arena)Precio (por imagen)Notas
GPT Image 2OpenAI · USA1338 AA Arena nº1 confirmado; 2º Reve 2.1 1300 (era 1305), gap ~38; arena.ai +242 (1512) confirmado$0,211/img high (=$211/1K API OpenAI); fal.ai $0,005 low a $0,401 high 4K (fal.ai no verif. al detalle)Nº1 t2i confirmado. Lanzado abr-2026. 2K, texto multilingüe y prompt adherence líder
MAI-Image-2.5Microsoft · USA1269 AA (era 1265), nº3 t2i confirmado; 2º Reve 2.1 1300Azure Foundry $47/M img out confirmado; ~$0,048/img estimadoMicrosoft. Nº3 t2i (tras Reve 2.1); Flash más barata (~1207 Elo)
Nano Banana Pro (Gemini 3 Pro Image)Google · USA1222 AA t2i (era 1218), nº9 de 81 (CORREGIDO, era nº13); fuera del top-3$0,134/img 1-2K · $0,24/img 4K Gemini API (Batch 50% → 4K ~$0,12) confirmado= Gemini 3 Pro Image. Salida hasta 4096×4096
Nano Banana 2 Lite (Gemini 3.1 Flash Lite)Google · USA1262 AA t2i (era 1251), nº4 (CORREGIDO, era nº5)$0,034/img (1K) Gemini API confirmado (Batch $0,017)= Gemini 3.1 Flash Lite Image. Rápida/barata ~4s, solo 1K
GPT Image 1.5OpenAI · USA1260 AA (era 1256), nº6 t2i confirmado$0,009 low · $0,034 medio · $0,133 high (1024 OpenAI API) — tiers no verif. al detalleGeneración anterior OpenAI, aún competitiva (nº6 AA)
Grok ImaginexAI · USA1203 AA (image-quality) nº12 (era 1201/nº14); variante base 1178 nº14$0,02/img confirmado (1K/2K, hasta 3 refs)xAI. Precio bajo confirmado. i2v nº1 AA (1336)
Cosmos 3 SuperNVIDIA · USA1217 AA t2i (era 1214); Nº1 open weights confirmado en AAOpen weights (licencia OpenMDW-1.1, self-host gratis); API $0,04/img en fal y WaveSpeedNVIDIA, omnimodal MoT ~64B (Qwen3-VL 32B). Nº1 open AA t2i confirmado

💻 Locales (open-weight, en tu hardware)

ModeloLicenciaHardwareNotas
FLUX.2Black Forest Labsopen-weight + APIGPU dedicada (variantes dev/FP8)Lanz. 25-nov-2025 (max 16-dic, klein 15-ene-2026), hasta 4MP; open + Pro/Flex/Max API
Qwen-Image 2.0AlibabaApache-2.07B — GPU 16GB+Lanzado 10-feb-2026, 7B + enc. 8B Qwen3-VL, 2K nativo, tipografía EN/ZH
Z-Image TurboAlibaba (Tongyi)open-weight~1 s/imagen en H100; corre en Mac (MLX)Alibaba Tongyi-MAI, 6B, sub-segundo en H100. El open más rápido
Stable Diffusion 3.5Stability AIStability CommunityGPU 8-16GBUpgrade gratis desde SD 3.0. Mayor ecosistema (Civitai, ComfyUI, LoRAs)
HiDream-O1-Image-1.5HiDreamopen-weightGPU dedicadav1.5 CERRADO (hosted), hasta 2K. Top-4 AA confirmado

Datos a 2026-07-29 · fuentes: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · el Elo de arena es preferencia humana a ciegas sobre el resultado; precios orientativos — verificar antes de decidir.

🎬 Generación de vídeo

Los principales modelos de generación de VÍDEO, separados entre servicios remotos (pagas por segundo generado vía API) y modelos abiertos para tu propio hardware.

☁️ Remotos (API / cloud)

ModeloCalidad (arena)Precio (por segundo)Notas
Kling 3.0 / TurboKuaishou · ChinaCon audio 1112 (Pro 1080p, ~#6 t2v). Gemini Omni lidera, no Kling. Sin audio 1244 NO VERIF; arena.ai 1991 NO VERIFCORREGIDO: fal Kling 3.0 Turbo 1080p ~$0,14/s (no $0,08); ~$2,10 por 15sKuaishou feb-2026; Turbo/Omni 17-jun-2026. Hasta 15s + audio nativo
Veo 3.1Google · USACORREGIDO: NO top-3. Con audio 1096, ~#6-9 t2v. Lidera Gemini Omni Flash en AALite ~$0,05/s · Fast $0,10/s (720p) · Std $0,40/s con audio (720p/1080p) — Vertex/Gemini APITres niveles + audio nativo (Vertex AI). Std $0,40/s audio incluido
Gemini Omni FlashGoogle · USA1244 con audio #1 t2v · 1325 sin audio #1 (orig 1326). Lidera t2v e i2v (i2v 1199 c/audio, 1375 s/audio)~$0,10/s (720p,24fps) preview Gemini API/AI Studio. Precio exacto NO VERIFICADOGoogle, I/O may-2026. Multimodal, audio nativo, edición conversacional, 3-10s
Seedance 2.0 (Dreamina)ByteDance · China720p 1228 con audio #2 (orig 1227) · 1272 sin audio #4. Fast 1703 arena.ai NO VERIF~$0,10/s std (AA ~$9/min 1080p). EvoLink desde $0,045/s. Fast ~$0,081/s NO VERIFByteDance SEED 12-feb-2026. Multimodal, 15s + audio estéreo
Sora 2OpenAI · USA— (ausente del leaderboard AA)$0,10–0,70/s aún activo hasta cierre (orig '—')EN RETIRADA: app cerrada 26-abr-2026; API se apaga 24-sep-2026 (410 después). Aviso 24-mar-2026

💻 Locales (open-weight, en tu hardware)

ModeloLicenciaHardwareNotas
Wan 2.7Alibabaopen-weight16-24GB VRAM (14B)Alibaba, release 22-abr-2026. Suite T2V/I2V/ref-to-video con voz + edición por instrucciones, multi-imagen
LTX-2.3Lightricksopen-weightdesde 12GB VRAM (FP8: flujos de 32GB)Lightricks, 22B DiT, audio+vídeo en una pasada; ~18x más rápido que Wan 2.2 (NO VERIF directo)
HunyuanVideoTencentopen-weight16-24GB VRAMTencent 13B, open dic-2024; sucesor HunyuanVideo-1.5 (8.3B, ~14GB VRAM, Apache 2.0) publicado 20-nov-2025. No en AA
Mochi 1Genmoopen-weightfine-tune en 1×H100/A100 80GBGenmo, 10B (AsymmDiT), oct-2024, Apache 2.0; 480p preview, alta adherencia al prompt. No en AA
SkyReels V1Skyworkopen-weightGPU dedicadaSkywork, feb-2025, primer open human-centric (fine-tune de HunyuanVideo); T2V+I2V. Ojo: SkyReels V4 (1110 AA) es otra versión

Datos a 2026-07-29 · fuentes: Artificial Analysis Image/Video Arena · arena.ai · llm-stats.com · Pixazo · documentación de fabricantes · el Elo de arena es preferencia humana a ciegas sobre el resultado; precios orientativos — verificar antes de decidir.