面向开发者的高性能 API 网关,提供稳定、低延迟的模型调用服务。支持流式输出、多模型路由与用量统计。
三步接入:获取 API Key → 配置终端 → 发起首个请求。
curl https://api.bitlesu.com/v1/chat/completions
自动在多个上游模型间智能调度,保障可用性与响应速度。
model: "auto"
实时查看 Token 消耗、缓存命中率与各账号剩余额度。
GET /v1/billing/usage