/
vllmvllm
Публичный
Описание
A high-throughput and memory-efficient inference and serving engine for LLMs
Языки
- Python88,1%
- Cuda6,4%
- C++3,8%
- Shell1%
- CMake0,3%
- C0,3%
- Остальные0,1%
5 месяцев назад
год назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
5 месяцев назад
7 месяцев назад
5 месяцев назад
6 месяцев назад
5 месяцев назад
2 года назад
год назад
2 года назад
год назад
6 месяцев назад
год назад
6 месяцев назад
7 месяцев назад
2 года назад
год назад
6 месяцев назад
7 месяцев назад
5 месяцев назад
2 года назад
год назад
2 года назад
3 года назад
год назад
6 месяцев назад
9 месяцев назад
год назад
год назад
6 месяцев назад
5 месяцев назад
5 месяцев назад
6 месяцев назад
README.md