forked from Karylab-cklius/vllm
80abe0de7d
Co-authored-by: Bugen Zhao <i@bugenzhao.com> Co-authored-by: mergify[bot] <37929162+mergify[bot]@users.noreply.github.com> Signed-off-by: RickyChen / 陳昭儒 <ricky.chen@infinirc.com> Signed-off-by: Bugen Zhao <i@bugenzhao.com>
40 lines
1.4 KiB
Rust
40 lines
1.4 KiB
Rust
use thiserror::Error;
|
|
use vllm_engine_core_client::Error as EngineCoreError;
|
|
use vllm_llm::Error as LlmError;
|
|
|
|
pub use crate::lower::logprobs::LogprobsError;
|
|
pub use crate::lower::token_ids::OutOfVocabError;
|
|
|
|
#[derive(Debug, Error)]
|
|
pub enum Error {
|
|
#[error("tokenizer error: {0}")]
|
|
Tokenizer(String),
|
|
#[error("text request `{request_id}` must contain at least one prompt token ID")]
|
|
EmptyPromptTokenIds { request_id: String },
|
|
#[error(
|
|
"this model's maximum context length is {max_model_len} tokens, \
|
|
but the prompt contains {prompt_len} input tokens"
|
|
)]
|
|
PromptTooLong { max_model_len: u32, prompt_len: u32 },
|
|
#[error(transparent)]
|
|
Logprobs(#[from] LogprobsError),
|
|
#[error(transparent)]
|
|
OutOfVocab(#[from] OutOfVocabError),
|
|
#[error("`thinking_token_budget` must be a non-negative integer or -1 for unlimited.")]
|
|
InvalidThinkingTokenBudget,
|
|
#[error("text request stream `{request_id}` closed before terminal output")]
|
|
StreamClosedBeforeTerminalOutput { request_id: String },
|
|
#[error(transparent)]
|
|
Llm(#[from] LlmError),
|
|
#[error(transparent)]
|
|
EngineCore(#[from] EngineCoreError),
|
|
}
|
|
|
|
pub type Result<T> = std::result::Result<T, Error>;
|
|
|
|
impl From<vllm_tokenizer::TokenizerError> for Error {
|
|
fn from(error: vllm_tokenizer::TokenizerError) -> Self {
|
|
Self::Tokenizer(error.0)
|
|
}
|
|
}
|