Logo
Explore Help
Sign In
Karylab-cklius/vllm
Watch 1
Star 0
Fork 1
Code Issues Pull Requests 1 Actions Packages Projects Releases Wiki Activity
Files
94de871546e8da687c08ed8a7e0a26531500d4bd
vllm/csrc/moe
T
History
Wentao YeandGitHub 77c09e1130 [Refactor] Remove align block size logic in moe_permute (#33449)
Signed-off-by: yewentao256 <zhyanwentao@126.com>
2026-02-06 10:57:06 -08:00
..
marlin_moe_wna16
[Bugfix]: Fix display errors in TORCH_CHECK messages (#32942)
2026-01-31 09:48:48 -08:00
permute_unpermute_kernels
[Refactor] Remove align block size logic in moe_permute (#33449)
2026-02-06 10:57:06 -08:00
dynamic_4bit_int_moe_cpu.cpp
[CPU]Parallelize over tokens in int4 moe (#29600)
2025-12-02 06:21:39 +00:00
grouped_topk_kernels.cu
[Perf] Optimize grouped topk kernel, 1.2%~2% E2E Throughput improvement (#32058)
2026-01-13 10:58:18 -08:00
moe_align_sum_kernels.cu
Lora MoE Align Improvements (#29257)
2025-12-09 10:35:16 +08:00
moe_ops.h
[Kernel] Add topk_sigmoid kernel (#31246)
2026-01-21 22:49:51 +00:00
moe_permute_unpermute_op.cu
[Refactor] Remove align block size logic in moe_permute (#33449)
2026-02-06 10:57:06 -08:00
moe_wna16_utils.h
pre-commit autoupdate (#17380)
2025-04-29 06:46:55 -07:00
moe_wna16.cu
[BugFix] Accuracy fix for llama4 int4 - improperly casted scales (#16801)
2025-04-17 22:13:29 -07:00
topk_softmax_kernels.cu
[Kernel] Add topk_sigmoid kernel (#31246)
2026-01-21 22:49:51 +00:00
torch_bindings.cpp
[Refactor] Remove align block size logic in moe_permute (#33449)
2026-02-06 10:57:06 -08:00
Powered by Gitea Version: 1.27.1 Page: 177ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API