Clasificación con fuente

Ranking de modelos de IA

Explora puestos y ratings publicados por Arena.ai para modelos de texto. Mostramos la fuente, fecha, muestra e incertidumbre. El Arena Score propio de Debatidor sigue en desarrollo y nunca se mezcla con este ranking externo.

402

Modelos con rating externo

13 de setiembre de 2026

Fecha del snapshot

0

Arena Scores propios

Clasificación externa · Arena.ai Text

Puesto, rating, intervalo del 95 % y votos proceden del snapshot público de texto con control de estilo de Arena.ai. La columna de licencia describe al modelo; el dataset tiene licencia CC BY 4.0. Los números no son mediciones de Debatidor ni prueban disponibilidad por API en tu cuenta.

402 de 402 modelosArena.ai · texto con control de estilo ·
Ranking externo Arena.ai de modelos de texto
PuestoModeloRatingIntervalo 95 %VotosProveedorLicencia
1claude-fable-515061501–151030,057anthropicProprietary
2claude-opus-4-6-high15051501–150871,993anthropicProprietary
3claude-opus-4-7-high15021498–150660,002anthropicProprietary
4muse-spark-1.2 (xHigh)15001489–15103,227metaProprietary
5claude-fable-5.1-max14981490–15075,783anthropicProprietary
6claude-opus-4-614971494–150175,878anthropicProprietary
7claude-opus-4-714941491–149861,128anthropicProprietary
8muse-spark-1.3-max14931484–15024,723metaProprietary
9gemini-3.8-flash-high14931484–15025,076googleProprietary
10claude-opus-5-high14931489–149742,617anthropicProprietary
11muse-spark-1.114931488–149727,615metaProprietary
12gemini-3.7-flash-high14901482–14985,640googleProprietary
13muse-spark14881482–149413,565metaProprietary
14claude-opus-5-max14871482–149320,706anthropicProprietary
15gemini-3.1-pro-preview14871484–1490106,951googleProprietary
16gemini-3-pro14851482–148940,654googleProprietary
17kimi-k3-max14851480–149020,987moonshotKimi K3 license
18gpt-5.6-sol-xhigh14831479–148827,069openaiProprietary
19glm-5.3-max14831477–148910,960zaiMIT
20gpt-5.5-high14821478–148664,924openaiProprietary
21claude-opus-4-8-high14811477–148652,535anthropicProprietary
22qwen3.8-max14811475–148616,670alibabaProprietary
23gemini-3.6-flash-high14801475–148526,445googleProprietary
24gpt-6-astra-max14801468–14912,693openaiProprietary
25gemini-3.5-flash-high14781473–148238,257googleProprietary
26gpt-5.4-high14761473–148060,537openaiProprietary
27gpt-5.2-chat-latest-2026021014761472–148034,176openaiProprietary
28gpt-5.514761472–148066,317openaiProprietary
29glm-5.3-flash14751469–148210,038zaiMIT
30grok-4.20-beta114751470–147926,599xaiProprietary
31gemini-3.5-flash-medium14741469–147836,627googleProprietary
32gpt-5.5-instant14741469–147925,850openaiProprietary
33gemini-3-flash14741469–147830,225googleProprietary
34qwen3.7-max-preview14731463–14833,705alibabaProprietary
35claude-opus-4-814731469–147753,446anthropicProprietary
36claude-opus-4-5-20251101-high-32k14731469–147736,239anthropicProprietary
37claude-sonnet-4-614731469–147666,208anthropicProprietary
38glm-5.2-max14721467–147736,798zaiMIT
39grok-4.20-beta-0309-reasoning14711468–147562,168xaiProprietary
40grok-4.20-multi-agent-beta-030914701466–147460,777xaiProprietary
Mostrando 1–40
1 / 11

Fuente y atribución: Arena.ai leaderboard dataset · CC BY 4.0 · Snapshot · subconjunto text_style_control / overall. Seleccionamos las columnas mostradas y redondeamos rating e intervalo solo en pantalla; el archivo versionado conserva los valores originales.

Arena Score de Debatidor: datos pendientes

Nuestro ranking medirá debates, refutaciones, consenso y desempeño como Lead. Aún no hay veredictos públicos comparables, autorización por sala ni una muestra suficiente para publicar puestos propios. Las salas privadas no alimentan esta tabla externa.

Compara dos modelos

El comparador editorial contrasta características documentadas sin declarar un ganador por sí mismo.

Elige dos versiones para contrastar sus fichas editoriales con los mismos criterios. Las fuentes y fechas corresponden a cada modelo; esto no es un Arena Score ni prueba de disponibilidad en tu cuenta.

OpenAI · Estable

GPT-4o

Texto, visión y comparación de respuestas

ID API de Debatidor
gpt-4o
Fortalezas a contrastar
Análisis de texto y código · Entrada multimodal en la API del proveedor · Respuesta rápida para contrastar propuestas
Casos a evaluar
Calidad de las objeciones · Fidelidad a instrucciones · Claridad de una solución técnica
Revisión editorial

Anthropic · Estable

Claude Sonnet 4.6

Análisis, programación y revisión crítica

ID API de Debatidor
claude-sonnet-4-6
Fortalezas a contrastar
Análisis de requisitos · Revisión de código y planes · Argumentación técnica
Casos a evaluar
Supuestos débiles · Calidad de una refutación · Coherencia de propuestas
Revisión editorial