Logo
Explore Help
Sign In
Karylab-cklius/vllm
Watch 1
Star 0
Fork 1
Code Issues Pull Requests 1 Actions Packages Projects Releases Wiki Activity
Files
e0ade06d6305cf84b41c1962cdd9dfdbfee16ac9
vllm/docs/source/models
T
History
张大成GitHubzhangdachengWoosuk Kwon
48a8f4a7fd Support Orion model (#2539)
Co-authored-by: zhangdacheng <zhangdacheng@ainirobot.com>
Co-authored-by: Woosuk Kwon <woosuk.kwon@berkeley.edu>
2024-02-26 19:17:06 -08:00
..
adding_model.rst
Use NCCL instead of ray for control-plane communication to remove serialization overhead (#2221)
2024-01-03 11:30:22 -08:00
engine_args.rst
[Docs] Update documentation for gpu-memory-utilization option (#2162)
2023-12-17 10:51:57 -08:00
lora.rst
multi-LoRA as extra models in OpenAI server (#2775)
2024-02-17 12:00:48 -08:00
supported_models.rst
Support Orion model (#2539)
2024-02-26 19:17:06 -08:00
Powered by Gitea Version: 1.27.1 Page: 22ms Template: 1ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API