Tabby 命令速查表 - 自托管 AI 编码助手 CLI 全参数
Tabby 是开源、自托管的 AI 编码助手,提供代码补全、内联聊天与回答引擎,且无需外部数据库或云服务。tabby 是它的可执行入口:serve 启动服务并暴露 OpenAI 兼容接口,download 管理模型,scheduler 触发仓库索引。本表覆盖启动、模型与 API 调用,读完即可自建一个私有补全后端。
安装与启动 6
./tabby serve --model StarCoder-1B用指定模型启动服务(CPU)
./tabby serve --model StarCoder-1B --device cuda用 NVIDIA GPU 启动
./tabby serve --model StarCoder-1B --device metal用 Apple Silicon 启动
./tabby serve --model StarCoder-1B --device cpu强制 CPU 推理
./tabby serve --model StarCoder-1B --port 8080指定服务端口
./tabby --help列出全部命令
模型与索引 6
./tabby download --model StarCoder-1B预下载模型
./tabby scheduler --now立即触发仓库索引
curl http://localhost:8080/health检查服务健康
docker run -p 8080:8080 tabbyml/tabby serve --model StarCoder-1B用 Docker 启动
./tabby serve --chat-model Qwen2-1.5B-Instruct额外指定聊天模型
./tabby serve --model StarCoder-1B --chat-model Qwen2-1.5B-Instruct --device cuda补全+聊天模型一起启
配置与 API 8
cat ~/.tabby/config.toml查看配置文件
curl -X POST http://localhost:8080/v1/completions -d '{"language":"python","segments":{"prefix":"def "}}'调用代码补全
curl -X POST http://localhost:8080/v1/chat/completions -d '{"messages":[{"role":"user","content":"hi"}]}'调用聊天补全
./tabby serve --model TabbyML/DeepseekCoder-6.7B --device cuda换更大补全模型
./tabby serve --help查看 serve 参数
./tabby download --help查看下载参数
./tabby scheduler --help查看调度参数
curl http://localhost:8080/v1/models列出可用模型
提示
- Tabby 暴露 OpenAI 兼容接口,IDE 插件把补全地址指向本机 8080 即可私有化。
- `--device` 决定加速方式:cuda(N 卡)/ metal(Apple)/ cpu(兜底)。
- `scheduler --now` 触发代码仓库索引,能让回答引擎带上项目上下文。
常见问题
Tabby 和 Continue 有什么不同?
Tabby 是自带服务端的自托管补全引擎,暴露标准 API;Continue 是 IDE 扩展,可接多种后端(含 Tabby / Ollama / 云端)。
需要 GPU 吗?
不是必须。`--device cpu` 也能跑,只是更慢;有 N 卡用 cuda、Apple 芯片用 metal 体验更好。
由 巧匠 维护
公开更新于 2026年9月10日,内容持续校对官方文档。