Step 3.7 Flash
Stepfun🇨🇳
stepfun/step-3.7-flashStep 3.7 Flash is StepFun's multimodal vision-language model, built on Step 3.5 Flash with an added vision encoder for native image understanding. With a 256k context window, selectable reasoning levels, and high throughput, it targets agentic, coding, and search workflows that mix text and visual input.
Тариф стоимости
0.2x
Контекст
262K
Выпуск
28 мая 2026 г.
Ввод
TextImageVideo
Вывод
Text
Поддержка
РассуждениеВызов инструментовСтруктурированный вывод
Сильные стороны
Категории, в которых эта модель показывает лучшие результаты.
Категории с высоким рейтингом не найдены.
Производительность
Медианные задержка и пропускная способность, измеренные по недавним запросам.
Пропускная способность177 tok/s
Задержка