forked from Karylab-cklius/vllm
[Fix] Add Spacing when Requesting Output Token > max_model_len (#40324)
Signed-off-by: San-Nguyen <san.nguyen@ibm.com>
This commit is contained in:
@@ -204,7 +204,7 @@ class TokenizeParams:
|
||||
and max_output_tokens > max_total_tokens
|
||||
):
|
||||
raise VLLMValidationError(
|
||||
f"{self.max_output_tokens_param}={max_output_tokens}"
|
||||
f"{self.max_output_tokens_param}={max_output_tokens} "
|
||||
f"cannot be greater than "
|
||||
f"{self.max_total_tokens_param}={max_total_tokens=}. "
|
||||
f"Please request fewer output tokens.",
|
||||
|
||||
Reference in New Issue
Block a user