Logo
Explore Help
Sign In
Karylab-cklius/vllm
Watch 1
Star 0
Fork 1
Code Issues Pull Requests 1 Actions Packages Projects Releases Wiki Activity
Files
fac4e96940d9f2ac8dde8fc864b4c76cbdfd0e2d
vllm/vllm/lora/layers
T
History
Runkai TaoandGitHub e1d97c38f8 [Bug Fix] Fix naive_block_assignment always defaulting to False due to arg misalignment (#33848)
Signed-off-by: Runkai Tao <rt572@physics.rutgers.edu>
2026-02-12 11:30:57 +08:00
..
__init__.py
Add support for LoRA adapters in Nemotron-H models (#30802)
2026-01-19 22:30:44 +08:00
base_linear.py
[Quantization][Deprecation] Deprecate HQQ (#32681)
2026-01-21 09:32:40 -05:00
base.py
[LoRA] Continue optimizing MoE LoRA weight loading (#29322)
2025-11-27 05:56:28 -08:00
column_parallel_linear.py
Add support for LoRA adapters in Nemotron-H models (#30802)
2026-01-19 22:30:44 +08:00
fused_moe.py
[Bug Fix] Fix naive_block_assignment always defaulting to False due to arg misalignment (#33848)
2026-02-12 11:30:57 +08:00
logits_processor.py
[Bugfix][Model] Support LoRA on Qwen3 Output Embedding (#29816)
2026-02-06 20:25:31 +08:00
replicated_linear.py
[LoRA] Continue optimizing MoE LoRA weight loading (#29322)
2025-11-27 05:56:28 -08:00
row_parallel_linear.py
[LoRA] Continue optimizing MoE LoRA weight loading (#29322)
2025-11-27 05:56:28 -08:00
utils.py
[Quantization][Deprecation] Deprecate HQQ (#32681)
2026-01-21 09:32:40 -05:00
vocal_parallel_embedding.py
[Bugfix][Model] Support LoRA on Qwen3 Output Embedding (#29816)
2026-02-06 20:25:31 +08:00
Powered by Gitea Version: 1.27.1 Page: 106ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API