LlmFallbackEngine 管理跨 25 家提供商的所有 LLM 调用,支持自动故障切换、API 密钥轮换以及按任务或按技能的模型覆盖。
支持的提供商
Anthropic、OpenAI、Gemini、Groq、xAI、DeepSeek、Moonshot、Z.AI、MiniMax、Venice、Mistral、Cohere、Together、Fireworks、Perplexity、Hugging Face、OpenRouter、Sakana Fugu、Bedrock、Azure、LiteLLM、Ollama、LM Studio、vLLM 以及 vLLM Cloud。故障切换的工作方式
编排器按以下顺序构建候选列表:AI_PREFERRED_PROVIDER+AI_PREFERRED_MODEL(若已设置)- 从各提供商 API 获取的实时模型列表(当密钥允许时)
- 内置链:Gemini 2.5/2.0 Flash → Groq Llama 3.3/3.1 → Ollama cloud/local
API_KEY_ROTATION=1)会在切换提供商前先循环使用备份密钥。
按任务的配置文件
按任务覆盖:
按技能模型
~/.config/arka/llm-skill-models.json。
共享的耗尽缓存
单会话缓存 —— 已耗尽的模型在重置前会跨技能被跳过:LLM_FALLBACK_NOTIFY=1。调试尝试过程:LLM_VERBOSE=1。
本地 LLM 服务器
为什么技能保持简洁
Arka 不会让 LLM 去记忆 70 个技能手册。技能是本地程序 —— 模型只需选出正确的名称。在 LLM 路由时,Arka 会传递:- 一份紧凑的技能目录(仅包含已注册的名称)
- 精选路由规则(高信噪比的模式)
- 通过
ROUTE_ALIASES传入的你机器上的 shell 别名
运行时检查
设置
SHOW_MODEL=1(默认值)可在答案下方显示 Model: provider/name。相关内容
配置
环境变量与 API 密钥
对话与网络
使用编排器的技能
故障排查
401、429 与故障切换修复