VLLM_FALLBACK=0 可关闭这一可选的兜底行为。Models & inference
vLLM 兜底
将本地的 vLLM OpenAI 兼容服务器用作 Arka 的兜底提供商。
先启动 vLLM,然后在 Arka 的兜底链中启用它:
当 vLLM 可达或被显式配置时,Arka 会尝试它;若本地服务器失败,则继续沿常规的提供商链推进。设置
将本地的 vLLM OpenAI 兼容服务器用作 Arka 的兜底提供商。
VLLM_FALLBACK=0 可关闭这一可选的兜底行为。