Logo
Explore Help
Sign In
karylab_agents/vllm
Watch 1
Star 0
Fork 0
forked from Karylab-cklius/vllm
Code Pull Requests 2 Actions 1 Packages Activity
Files
4c33d6732148fdaeb9780fa86fca1f87f2a93c19
vllm/csrc/quantization/gguf
T
History
TY-AMDandGitHub 9351f91be9 [BugFix][ROCm] Fix GGUF MoE Dispatch Block_Dim for ROCm (#16247)
Signed-off-by: Tianyuan Wu <Tianyuan.Wu@amd.com>
2025-04-08 05:10:26 -07:00
..
dequantize.cuh
[Kernel] Add more dtype support for GGUF dequantization (#15879)
2025-04-02 01:58:48 -07:00
ggml-common.h
[Bugfix][kernels] Fix half2float conversion in gguf kernels (#15995)
2025-04-04 09:38:58 -07:00
gguf_kernel.cu
[Kernel] Add more dtype support for GGUF dequantization (#15879)
2025-04-02 01:58:48 -07:00
mmq.cuh
Fix CUDA kernel index data type in vllm/csrc/quantization/fused_kernels/layernorm_utils.cuh +10 (#15159)
2025-03-21 10:01:11 +08:00
mmvq.cuh
Fix CUDA kernel index data type in vllm/csrc/quantization/fused_kernels/layernorm_utils.cuh +10 (#15159)
2025-03-21 10:01:11 +08:00
moe.cuh
[BugFix][ROCm] Fix GGUF MoE Dispatch Block_Dim for ROCm (#16247)
2025-04-08 05:10:26 -07:00
vecdotq.cuh
Missing comment explaining VDR variable in GGUF kernels (#13290)
2025-02-20 22:06:54 -08:00
Powered by Gitea Version: 1.27.1 Page: 69ms Template: 1ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API