Step 3.7 Flash
Stepfun🇨🇳
stepfun/step-3.7-flashStep 3.7 Flash is StepFun's multimodal vision-language model, built on Step 3.5 Flash with an added vision encoder for native image understanding. With a 256k context window, selectable reasoning levels, and high throughput, it targets agentic, coding, and search workflows that mix text and visual input.
Tarifa de coste
0.2x
Contexto
262K
Lanzamiento
28 may 2026
Entrada
TextImageVideo
Salida
Text
Compatibilidad
RazonamientoLlamada a herramientasSalidas estructuradas
En qué destaca
Las categorías en las que este modelo obtiene la mejor clasificación.
No se encontraron categorías mejor clasificadas.
Rendimiento
Latencia y rendimiento medianos medidos en solicitudes recientes.
Rendimiento177 tok/s
Latencia