[Fix] Add Spacing when Requesting Output Token > max_model_len (#40324)

Signed-off-by: San-Nguyen <san.nguyen@ibm.com>
This commit is contained in:
San-Nguyen
2026-04-20 00:25:06 -07:00
committed by GitHub
parent ec7aafc02a
commit e729cc823d
+1 -1
View File
@@ -204,7 +204,7 @@ class TokenizeParams:
and max_output_tokens > max_total_tokens
):
raise VLLMValidationError(
f"{self.max_output_tokens_param}={max_output_tokens}"
f"{self.max_output_tokens_param}={max_output_tokens} "
f"cannot be greater than "
f"{self.max_total_tokens_param}={max_total_tokens=}. "
f"Please request fewer output tokens.",