vllm-project/vllm · error · ValueError
Embedding models do not support `--runner {self.runner_type}
Error message
Embedding models do not support `--runner {self.runner_type}`. Use `--runner pooling` or `--runner auto` for embedding models. What it means
Error "Embedding models do not support `--runner {self.runner_type}`. Use `--runner pooling` or `--runner auto` for embedding models." thrown in vllm-project/vllm.
Source
Thrown at vllm/config/model.py:648
architectures = self.architectures
registry = self.registry
is_generative_model = registry.is_text_generation_model(architectures, self)
is_pooling_model = registry.is_pooling_model(architectures, self)
self.runner_type = self._get_runner_type(
architectures, self.runner, self.convert
)
self.convert_type = self._get_convert_type(
architectures, self.runner_type, self.convert
)
if (
is_pooling_model
and not is_generative_model
and self.runner_type in ("draft", "generate")
):
raise ValueError(
f"Embedding models do not support `--runner {self.runner_type}`. "
"Use `--runner pooling` or `--runner auto` for embedding models."
)
if self.runner_type == "generate" and not is_generative_model:
generate_converts = _RUNNER_CONVERTS["generate"]
if self.convert_type not in generate_converts:
# Currently we don't have any converters for generative models
raise ValueError("This model does not support `--runner generate`.")
if self.runner_type == "pooling" and not is_pooling_model:
pooling_converts = _RUNNER_CONVERTS["pooling"]
if self.convert_type not in pooling_converts:
convert_option = "<" + "|".join(pooling_converts) + ">"
raise ValueError(
"This model does not support `--runner pooling`. "
f"You can pass `--convert {convert_option} to adapt "
"it into a pooling model."
)
View on GitHub (pinned to c794754062)
Solutions
- Use --runner pooling or --runner auto for embedding models.
When it happens
Trigger: Raised at vllm/config/model.py:648 when validation fails: Embedding models do not support the selected runner; use --runner pooling or --runner auto. Typically triggered by an incompatible or incomplete vLLM configuration, an unsupported platform/backend combination, or a runtime resource/dependency that is missing.
Common situations: Commonly encountered at vllm/config/model.py:648 during vLLM startup/config validation or runtime setup when: (1) conflicting CLI flags or config fields are combined, (2) the current platform (CUDA/ROCm/CPU/XPU) or installed optional packages do not support the requested feature, or (3) a required value is absent or out of range. Resolve by correcting the configuration as described in the message, or by selecting a supported alternative.
AI-assisted analysis of vllm-project/vllm@c794754062 (2026-08-14).
Data as JSON: /api/errors/6dd4447afce1daa1.
Report an issue: GitHub.