This website requires JavaScript.
Explore
Help
Sign In
karylab_agents
/
vllm
Watch
1
Star
0
Fork
0
forked from
Karylab-cklius/vllm
Code
Pull Requests
2
Actions
1
Packages
Activity
Files
68ee8300a047db78fb52bac477daaaac7be11216
vllm
/
tests
/
entrypoints
/
serve
/
disagg
T
History
wang.yuqi
and
GitHub
31ca9504b1
[Frontend] Split ServingRender into renderer and entrypoint. (
#44285
)
...
Signed-off-by: wang.yuqi <
yuqi.wang@daocloud.io
>
2026-06-23 11:19:09 +00:00
..
__init__.py
[Refactor] Relocate entrypoint tests to match serving code structure (
#37593
)
2026-03-20 05:31:23 +00:00
test_generate_stream.py
[Frontend] Split ServingRender into renderer and entrypoint. (
#44285
)
2026-06-23 11:19:09 +00:00
test_protocol.py
[Bugfix][Frontend] Default max_tokens server-side on /inference/v1/generate (
#42329
)
2026-05-13 11:16:46 +02:00
test_return_routed_experts.py
[R3] Add routed experts to openai entrypoint (
#38939
)
2026-05-20 09:07:59 -07:00
test_serving_multimodal_tokens.py
[Frontend] Add multimodal support to /inference/v1/generate endpoint (
#38405
)
2026-04-17 20:31:56 -07:00
test_serving_tokens.py
[Bugfix][Frontend] Default max_tokens server-side on /inference/v1/generate (
#42329
)
2026-05-13 11:16:46 +02:00
test_tokens_logprobs.py
[Bugfix] Fix top logprobs token placeholders in
/inference/v1/generate
(
#42887
)
2026-05-19 10:21:49 +00:00