Logo
Explore Help
Sign In
karylab_agents/vllm
Watch 1
Star 0
Fork 0
forked from Karylab-cklius/vllm
Code Pull Requests 2 Actions 1 Packages Activity
Files
010ec0c30ef1fa481fc69b8a5d2c205052d93607
vllm/csrc/moe
T
History
Wentao YeandGitHub c4e744dbd4 [Perf] Optimize moe_permute for CUTLASS FP8 (#32892)
Signed-off-by: yewentao256 <zhyanwentao@126.com>
2026-01-28 10:15:24 -08:00
..
marlin_moe_wna16
[Refactor] Rename gptq_marlin to marlin to match MoE (#32952)
2026-01-23 16:48:12 -05:00
permute_unpermute_kernels
[Perf] Optimize moe_permute for CUTLASS FP8 (#32892)
2026-01-28 10:15:24 -08:00
dynamic_4bit_int_moe_cpu.cpp
[CPU]Parallelize over tokens in int4 moe (#29600)
2025-12-02 06:21:39 +00:00
grouped_topk_kernels.cu
[Perf] Optimize grouped topk kernel, 1.2%~2% E2E Throughput improvement (#32058)
2026-01-13 10:58:18 -08:00
moe_align_sum_kernels.cu
Lora MoE Align Improvements (#29257)
2025-12-09 10:35:16 +08:00
moe_ops.h
[Kernel] Add topk_sigmoid kernel (#31246)
2026-01-21 22:49:51 +00:00
moe_permute_unpermute_op.cu
[Perf] Optimize moe_permute for CUTLASS FP8 (#32892)
2026-01-28 10:15:24 -08:00
moe_wna16_utils.h
pre-commit autoupdate (#17380)
2025-04-29 06:46:55 -07:00
moe_wna16.cu
[BugFix] Accuracy fix for llama4 int4 - improperly casted scales (#16801)
2025-04-17 22:13:29 -07:00
topk_softmax_kernels.cu
[Kernel] Add topk_sigmoid kernel (#31246)
2026-01-21 22:49:51 +00:00
torch_bindings.cpp
[Kernel] Add topk_sigmoid kernel (#31246)
2026-01-21 22:49:51 +00:00
Powered by Gitea Version: 1.27.1 Page: 172ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API