基础版
个人接入、联调与小流量试运行
- 60 RPM
- 10 万 Token
- 标准调度
多模型 LLM 网关 · FENGKUI
把模型厂商、合作渠道和自托管接口汇入一个兼容 OpenAI 的入口,再通过独立密钥分发给不同用户。蜂葵LLM API 统一管理会员、额度、流量开关与结算,从差价或渠道返佣中获得收益。
3 个泊位待命
一条请求的航次
蜂葵LLM API 会员系统
开通鱼坞通卡后,下游用户获得独立密钥、调用额度、流量开关和结算规则。基础版用于接入联调,专业版覆盖团队日常流量,企业版面向高并发与对公结算。
开通鱼坞通卡个人接入、联调与小流量试运行
团队日常调用、多密钥与差价结算
高并发、专属渠道与对公结算
公开模型目录
每个逻辑模型都有公开单价。密钥签发后用同一名称调用,路由、故障回退和结算由蜂葵LLM API 完成。
对话 / 流式
兼容 OpenAI Chat Completions
沿用熟悉的 Chat Completions 请求结构。模型映射、渠道密钥和故障切换都留在蜂葵LLM API 内部。
curl http://127.0.0.1:8787/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "fengkui-chat",
"messages": [
{"role": "user", "content": "你好"}
],
"stream": true
}'
调度依据与安全边界
过滤离线渠道,再按优先级和当前负载排序候选泊位。
健康度 · 优先级 · 在途量上游限流、服务异常或网络失败时,在响应开始前安全切换渠道。
429 · 5xx · Network追踪请求、尝试次数与 Token 用量,不保存提示词和模型正文。
调用元数据 · Token · 延迟每位下游用户拥有独立密钥、会员等级、调用额度、流量开关和结算规则。
会员管理 · 用户停复机 · 差价 / 返佣本地演示泊位已就绪
先接入上游模型接口,再为不同用户开通鱼坞通卡。蜂葵LLM API 负责分发、控制与结算每一条模型调用。
完成第一条请求