MII makes low-latency and high-throughput inference, similar to vLLM powered by DeepSpeed.
| Тип | Репозиторий |
| Категория | GitHub-проекты / Из awesome-списка |
| Цена | открытый код |
| Платформа | Своё развёртывание |
| Системы | исходный код |
| Язык сайта | en |
| GitHub | microsoft/DeepSpeed-MII |