leer pick editorial #disaggregated-inference
ai-dynamo/dynamo
framework de NVIDIA para servir LLMs, modelos de razonamiento, multimodales y de generación de vídeo a escala datacenter: no reemplaza a vLLM/SGLang/TensorRT-LLM sino que los orquesta como sistema multi-nodo con disaggregated serving, routing KV-aware, KV caching multi-tier y auto-scaling.
Estrellas
7.824
Forks
1.473
Lenguaje
Python
Licencia
Apache-2.0
Issues
—
Estado
—
Cómo funciona
Implementa disaggregated-inference
Núcleo
ai-dynamo/dynamo Python · Apache-2.0
Se cruza con compite con vllm-project/vllm relevante para nvidia
Diagrama derivado de madurez_senales (lenguaje, licencia, estado y topics) y de las relaciones que este repo tiene en el grafo de conocimiento. No es una arquitectura del proyecto: es su posición funcional tal como la registran los boletines.
Posición en el ecosistema
ai-dynamo/dynamo
implementa
disaggregated-inference
ai-dynamo/dynamo
compite con
vllm-project/vllm
ai-dynamo/dynamo
relevante para
nvidia
Relaciones que aportó este boletín