vLLM-Omni
High-performance serving framework for omni-modal models.
Open-source high-performance serving framework for multimodal generative models, covering unified production inference for text, image, audio, and video workloads.

Recent stories
1 linked story