Logo
Explore Help
Sign In
karylab_agents/vllm
Watch 1
Star 0
Fork 0
forked from Karylab-cklius/vllm
Code Pull Requests 2 Actions 1 Packages Activity
Files
c07ece5ca490a90b2b19c33ab7da2d21e015d7bd
vllm/tests
T
History
Antoni BaumGitHubAvnish Narayan
c07ece5ca4 Make AsyncLLMEngine more robust & fix batched abort (#969)
Signed-off-by: Antoni Baum <antoni.baum@protonmail.com>
Co-authored-by: Avnish Narayan <38871737+avnishn@users.noreply.github.com>
2023-09-07 13:43:45 -07:00
..
async_engine
Make AsyncLLMEngine more robust & fix batched abort (#969)
2023-09-07 13:43:45 -07:00
kernels
[BugFix] Implement RoPE for GPT-J (#941)
2023-09-06 11:54:33 +09:00
models
Add tests for models (#922)
2023-09-01 11:19:43 +09:00
samplers
Align vLLM's beam search implementation with HF generate (#857)
2023-09-04 17:29:42 -07:00
conftest.py
Use queue for finished requests (#957)
2023-09-05 19:27:23 -07:00
Powered by Gitea Version: 1.27.1 Page: 21ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API