Step 3.7 Flash vs. Qwen3.6 35B A3B (Reasoning)
Comparación entre Step 3.7 Flash y Qwen3.6 35B A3B (Reasoning) según inteligencia, precio, velocidad, ventana de contexto y más.
Para más detalles sobre nuestra metodología, consulta la página de metodología.
Aspectos destacados
Comparación de modelos
Step 3.7 Flash | Qwen3.6 35B A3B (Reasoning) | ||
|---|---|---|---|
| Índice de Inteligencia | 30 | 32 | Qwen3.6 35B A3B (Reasoning) es más inteligente que Step 3.7 Flash |
| Precio por millón de tokens | $0.18 | $0.37 | Step 3.7 Flash es más económico que Qwen3.6 35B A3B (Reasoning) |
| Velocidad de salida | 396 tokens/s | 158 tokens/s | Step 3.7 Flash es más rápido que Qwen3.6 35B A3B (Reasoning) |
| Tiempo hasta el primer token | 0.89s | 2.21s | Step 3.7 Flash responde más rápido que Qwen3.6 35B A3B (Reasoning) |
| Ventana de contexto | 262k tokens~393 páginas A4 con fuente Arial de tamaño 12 | 262k tokens~393 páginas A4 con fuente Arial de tamaño 12 | Tanto Step 3.7 Flash como Qwen3.6 35B A3B (Reasoning) tienen una ventana de contexto del mismo tamaño |
| Fecha de lanzamiento | mayo de 2026 | abril de 2026 | Step 3.7 Flash tiene una fecha de lanzamiento más reciente que la de Qwen3.6 35B A3B (Reasoning) |
| Parámetros | 198B, 11B activos durante la inferencia | 36B, 3B activos durante la inferencia | Step 3.7 Flash tiene más parámetros que Qwen3.6 35B A3B (Reasoning) |
| Razonamiento | Sí | Sí | Tanto Step 3.7 Flash como Qwen3.6 35B A3B (Reasoning) son modelos de razonamiento |
| Entrada de imágenes | Sí | Sí | Tanto Step 3.7 Flash como Qwen3.6 35B A3B (Reasoning) admiten imágenes como entrada |
| Pesos abiertos | Tanto Step 3.7 Flash como Qwen3.6 35B A3B (Reasoning) tienen pesos abiertos | ||
| Licencia | |||
| La licencia permite el uso comercial sin restricciones | Sí | Sí | Tanto la licencia de Step 3.7 Flash como la de Qwen3.6 35B A3B (Reasoning) permiten el uso comercial sin restricciones |
Inteligencia
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Briefcase
AA-Briefcase Elo
AA-Omniscience
AA-Omniscience Index
Apertura
Artificial Analysis Openness Index: Score
Comparaciones del Índice de Inteligencia
Intelligence Index vs. Cost per Intelligence Index Task
Uso de tokens
Output Tokens per Intelligence Index Task
Precio y costo
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Ventana de contexto
Context Window
Velocidad
Medida por la velocidad de salida (tokens por segundo)
Output Speed
Time per Intelligence Index Task
Latencia
Medida por el tiempo (segundos) hasta el primer token
Latency: Time To First Answer Token
Tiempo de respuesta de extremo a extremo
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
Tamaño del modelo (solo modelos de pesos abiertos)
Model Size: Total and Active Parameters
Preguntas frecuentes
Qwen3.6 35B A3B (Reasoning) es más inteligente. Qwen3.6 35B A3B (Reasoning) obtiene 32, frente a los 30 de Step 3.7 Flash en el Índice de Inteligencia de Artificial Analysis.
Step 3.7 Flash es más rápido. Step 3.7 Flash genera 396.4 tokens por segundo, frente a los 158.2 tokens por segundo de Qwen3.6 35B A3B (Reasoning).
Step 3.7 Flash es más económico. Step 3.7 Flash cuesta $0.18 por millón de tokens, frente a Qwen3.6 35B A3B (Reasoning), que cuesta $0.37 por millón de tokens (proporción 7:2:1 entre aciertos de caché, entrada y salida).
Step 3.7 Flash tiene menor latencia. El tiempo hasta el primer token de Step 3.7 Flash es de 0.89s, frente a los 2.21s de Qwen3.6 35B A3B (Reasoning).
Ambos modelos tienen una ventana de contexto de 260k tokens.