
LiteLLM(https://www.litellm.ai/)是一个面向多模型调用的网关与 SDK,主打“OpenAI 兼容接口 + 多供应商统一接入”。它支持将不同模型供应商的差异封装成统一 API,并提供路由、重试、降级、预算与可观测能力,便于团队在生产环境中稳定使用大模型。开源仓库位于(https://github.com/BerriAI/litellm)。
LiteLLM 的核心价值在于“把模型调用当成基础设施”。对于需要同时接入 OpenAI、Anthropic、Google、Azure、开源模型等多家供应商的团队,LiteLLM 可以统一鉴权、请求格式与日志,减少应用端复杂度。它还提供基于策略的路由、Fallback 与速率限制等能力,使调用更稳定可控。
文档与快速开始可在(https://docs.litellm.ai/)查看,支持本地部署或云端托管两种模式。

可以。它提供 OpenAI 兼容 API,应用侧调用方式基本一致。
支持。可在自有服务器或容器环境中部署 LiteLLM 网关。
通过配置路由与优先级策略,在主模型失败时回退到备用模型。
可以。LiteLLM 提供集中鉴权与日志能力,便于统一管理。
适合。其定位就是生产级模型调用网关与可观测层。













