Tabby 命令速查表 - 自托管 AI 编码助手 CLI 全参数

Tabby 是开源、自托管的 AI 编码助手,提供代码补全、内联聊天与回答引擎,且无需外部数据库或云服务。tabby 是它的可执行入口:serve 启动服务并暴露 OpenAI 兼容接口,download 管理模型,scheduler 触发仓库索引。本表覆盖启动、模型与 API 调用,读完即可自建一个私有补全后端。

AI 命令行·共 20 条命令·最后更新 2026-09-10
tabbytabbymlaicode-completionself-hostedcliopenai-compatible

安装与启动 6

./tabby serve --model StarCoder-1B
用指定模型启动服务(CPU)
./tabby serve --model StarCoder-1B --device cuda
用 NVIDIA GPU 启动
./tabby serve --model StarCoder-1B --device metal
用 Apple Silicon 启动
./tabby serve --model StarCoder-1B --device cpu
强制 CPU 推理
./tabby serve --model StarCoder-1B --port 8080
指定服务端口
./tabby --help
列出全部命令

模型与索引 6

./tabby download --model StarCoder-1B
预下载模型
./tabby scheduler --now
立即触发仓库索引
curl http://localhost:8080/health
检查服务健康
docker run -p 8080:8080 tabbyml/tabby serve --model StarCoder-1B
用 Docker 启动
./tabby serve --chat-model Qwen2-1.5B-Instruct
额外指定聊天模型
./tabby serve --model StarCoder-1B --chat-model Qwen2-1.5B-Instruct --device cuda
补全+聊天模型一起启

配置与 API 8

cat ~/.tabby/config.toml
查看配置文件
curl -X POST http://localhost:8080/v1/completions -d '{"language":"python","segments":{"prefix":"def "}}'
调用代码补全
curl -X POST http://localhost:8080/v1/chat/completions -d '{"messages":[{"role":"user","content":"hi"}]}'
调用聊天补全
./tabby serve --model TabbyML/DeepseekCoder-6.7B --device cuda
换更大补全模型
./tabby serve --help
查看 serve 参数
./tabby download --help
查看下载参数
./tabby scheduler --help
查看调度参数
curl http://localhost:8080/v1/models
列出可用模型

提示

  • Tabby 暴露 OpenAI 兼容接口,IDE 插件把补全地址指向本机 8080 即可私有化。
  • `--device` 决定加速方式:cuda(N 卡)/ metal(Apple)/ cpu(兜底)。
  • `scheduler --now` 触发代码仓库索引,能让回答引擎带上项目上下文。

常见问题

Tabby 和 Continue 有什么不同?

Tabby 是自带服务端的自托管补全引擎,暴露标准 API;Continue 是 IDE 扩展,可接多种后端(含 Tabby / Ollama / 云端)。

需要 GPU 吗?

不是必须。`--device cpu` 也能跑,只是更慢;有 N 卡用 cuda、Apple 芯片用 metal 体验更好。

官方参考来源

下方为命令对应的官方权威文档,供你核对最新用法与深入查阅。

由 巧匠 维护

公开更新于 2026年9月10日,内容持续校对官方文档。

联系我们

命令或描述有误?提交反馈、商务合作或产品建议都可发送邮件给我们。

联系我们