Publicidad
Patrocinador Verificado
Infraestructura Cloud, GPU Clusters y APIs de IA para Desarrolladores
Despliega pipelines de inferencia y trading con latencia ultra baja. Explora planes.
Conocer Más →

StepFun Lanza Step-3.7-Flash en NVFP4: Latencia Sub-10ms para Agentes y Voz en Tiempo Real

Por Marcus Sterling Publicado el 2026-09-07 4 min read Fuente: StepFun AI
StepFun colabora con NVIDIA para lanzar Step-3.7-Flash cuantizado en NVFP4, logrando respuestas por debajo de 10 milisegundos para asistentes de voz interactivos.

StepFun has unveiled **Step-3.7-Flash**, bringing sub-10-millisecond time-to-first-token (TTFT) performance to production deployments.

Native NVFP4 Optimization Optimized directly for Blackwell B200 and Hopper Tensor Cores with NVIDIA NVFP4 quantization, Step-3.7-Flash operates with minimal latency jitter, making it the preferred backend for synchronous voice-to-voice agents and high-frequency code completion engines.

Publicidad
Patrocinador Verificado
Trading Cuantitativo y 30 Modelos de Negocio con IA
Genera ingresos predecibles con retainers mensuales y bots automatizados.
Ver Blueprints →

Fuente y Verificación

Este informe técnico fue contrastado contra la documentación primaria publicada por StepFun AI.

Leer Anuncio Original en StepFun AI →