图文教程:十分钟用 LiteLLM 搭一个统一大模型网关
下载本站的 LiteLLM 官方源码包,装好后用一个地址、一套 OpenAI 格式接口同时调用 DeepSeek、通义千问、Gemini 等上百种模型,还能管预算、看用量。

第一步:安装 LiteLLM
到本站「AI工具」栏目下载《LiteLLM v1.102.1 官方源码包》(tar.gz,约 18.5MB)。
电脑需先装好 Python 3.10 以上版本,然后在文件所在目录执行:pip install litellm-1.102.1.tar.gz
装完执行 litellm --version,能打印版本号就说明安装成功。

第二步:配置模型密钥
把你要用的服务密钥设为环境变量,例如 OPENAI_API_KEY、DEEPSEEK_API_KEY、GEMINI_API_KEY 等。
Windows 用户可在「系统属性 → 环境变量」里添加;Mac/Linux 用户写进 ~/.bashrc 或 ~/.zshrc。

第三步:启动网关并测试
执行 litellm --model deepseek/deepseek-chat 启动本地网关(默认地址 http://0.0.0.0:4000)。
用任意 OpenAI 格式的客户端把 base_url 指向 http://localhost:4000/v1,模型名写成 deepseek/deepseek-chat 就能直接对话。
换其他模型只改模型名前缀(如 gemini/gemini-2.5-pro),代码一行不用动。

第四步:进阶——预算、日志与护栏
写一个 config.yaml 可同时挂多个模型、设置每用户每日花费上限。
启动时加 --detailed_debug 可以在终端看到每次调用的模型、Token 与耗时明细。
v1.102 的新护栏能力可在流式输出过程中实时拦截敏感内容,企业接入场景建议开启。

使用提醒
本文整理自公开资料并附上配套资源;涉及产品的功能与价格以官方页面为准。资源仅供学习交流,请遵循来源许可。
本篇为图文教程,直接按步骤操作即可,无需下载文件。
阅读与点赞数据保存在你的浏览器本地,欢迎留下你的想法。
今日正能量每天进步一点点,AI 陪你把想法变成现实。从一篇图文教程开始 →广告
评论 文明发言,让讨论更有价值