Logo
Explore Help
Sign In
karylab_agents/vllm
Watch 1
Star 0
Fork 0
forked from Karylab-cklius/vllm
Code Pull Requests 2 Actions 1 Packages Activity
113 Commits 354 Branches 175 Tags
436e523bf1616bea22a1df78d93d7522311dccc8
Commit Graph
9 Commits
Author SHA1 Message Date
Zhuohan LiandGitHub 27f1410d06 New weight loader without np copy (#52) 2023-05-03 15:32:04 +08:00
Zhuohan LiandGitHub 4858f3bb45 Add an option to launch cacheflow without ray (#51) 2023-04-30 15:42:17 +08:00
Woosuk KwonandGitHub 0f4b32199e Support various block sizes & Change default block size to 16 (#38) 2023-04-15 09:03:24 -07:00
Woosuk KwonandGitHub 84eee24e20 Collect system stats in scheduler & Add scripts for experiments (#30) 2023-04-12 15:03:49 -07:00
Woosuk KwonandGitHub b9926f7f66 Support block size 32 (#35) 2023-04-09 23:07:18 -07:00
Woosuk KwonandGitHub ee88a7e5f3 Add an option to use dummy model weights (#33) 2023-04-08 23:36:12 -07:00
Woosuk KwonandGitHub 12659a0bd7 Add CUDA graph-based all reduce launcher (#26) 2023-04-05 11:16:57 -07:00
Woosuk KwonandGitHub 7a7929abe8 Implement preemption via recomputation & Refactor scheduling logic (#12) 2023-03-30 14:51:46 -07:00
Zhuohan LiandGitHub 721fa3df15 FastAPI-based working frontend (#10) 2023-03-29 14:48:56 +08:00
Powered by Gitea Version: 1.27.1 Page: 55ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API