Logo
Explore Help
Sign In
Karylab-cklius/vllm
Watch 1
Star 0
Fork 1
Code Issues Pull Requests 1 Actions Packages Projects Releases Wiki Activity
Files
c07ece5ca490a90b2b19c33ab7da2d21e015d7bd
vllm/tests
T
History
Antoni BaumGitHubAvnish Narayan
c07ece5ca4 Make AsyncLLMEngine more robust & fix batched abort (#969)
Signed-off-by: Antoni Baum <antoni.baum@protonmail.com>
Co-authored-by: Avnish Narayan <38871737+avnishn@users.noreply.github.com>
2023-09-07 13:43:45 -07:00
..
async_engine
Make AsyncLLMEngine more robust & fix batched abort (#969)
2023-09-07 13:43:45 -07:00
kernels
[BugFix] Implement RoPE for GPT-J (#941)
2023-09-06 11:54:33 +09:00
models
Add tests for models (#922)
2023-09-01 11:19:43 +09:00
samplers
Align vLLM's beam search implementation with HF generate (#857)
2023-09-04 17:29:42 -07:00
conftest.py
Use queue for finished requests (#957)
2023-09-05 19:27:23 -07:00
Powered by Gitea Version: 1.27.1 Page: 26ms Template: 3ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API