max_tokens | int | Maximum tokens to generate | Model default | Transformers, LlamaCpp, SGLang, vLLMOffline |
temperature | float | Sampling temperature | 1.0 | Transformers, LlamaCpp, SGLang, vLLMOffline |
top_p | float | Nucleus sampling | 1.0 | Transformers, LlamaCpp, SGLang, vLLMOffline |
seed | int | Random seed | None | LlamaCpp, vLLMOffline |
presence_penalty | float | Token presence penalty | 0.0 | LlamaCpp, SGLang, vLLMOffline |
frequency_penalty | float | Token frequency penalty | 0.0 | LlamaCpp, SGLang, vLLMOffline |
logit_bias | dict[str, int] | Logit bias per token | None | Transformers, LlamaCpp, vLLMOffline |