StepFun Lanza Step-3.7-Flash en NVFP4: Latencia Sub-10ms para Agentes y Voz en Tiempo Real
StepFun colabora con NVIDIA para lanzar Step-3.7-Flash cuantizado en NVFP4, logrando respuestas por debajo de 10 milisegundos para asistentes de voz interactivos.
StepFun has unveiled **Step-3.7-Flash**, bringing sub-10-millisecond time-to-first-token (TTFT) performance to production deployments.
Native NVFP4 Optimization Optimized directly for Blackwell B200 and Hopper Tensor Cores with NVIDIA NVFP4 quantization, Step-3.7-Flash operates with minimal latency jitter, making it the preferred backend for synchronous voice-to-voice agents and high-frequency code completion engines.
Publicidad
Ver Blueprints →
Patrocinador Verificado
Trading Cuantitativo y 30 Modelos de Negocio con IA
Genera ingresos predecibles con retainers mensuales y bots automatizados.
Fuente y Verificación
Este informe técnico fue contrastado contra la documentación primaria publicada por StepFun AI.
Leer Anuncio Original en StepFun AI →