模型算力调度台

每一次调用,都有清晰航路

服务正常 产品主页
等待首次刷新

开始使用蜂葵LLM API

0/3

完成三个动作,验证从密钥到模型响应的完整链路。

实时泊位路由

一个入口,择优分发

等待调用进入航道

API统一入口
策略路由
加载泊位…
本次运行
已结算请求
运行期 Token
输入 + 输出
成功率
最近运行窗口
在线泊位
健康 / 全部

近一小时运行窗口

调用趋势与可用性

每 10 分钟收到的请求 0 次
正在读取运行趋势完成后将按十分钟汇总调用。
成功 失败或取消 处理中

算力经营账本

经营结算

按已完成调用估算 · 人民币

用户应收
¥0.0000
向下游用户计费
上游成本
¥0.0000
模型厂商接口成本
毛收益
¥0.0000
差价 + 上游返佣
综合毛利率
毛收益 / 用户应收
差价模式上游成本加价后向用户结算 返佣模式按上游消费获得渠道返佣 其中返佣 ¥0.0000

模型层计费策略

模型计费配置与聚合

新增或下架逻辑模型,并为每个模型设置上游算力单价。

模型计费与模型级经营汇总
模型状态输入单价(每百万 token)输出单价(每百万 token)模型级汇总操作
正在读取模型计费…

调用台

发送一次真实代理请求

尚未签发密钥

选择模型后显示公开单价

0 / 4000
⌘/Ctrl + Enter 发送
延迟
Token
本次应收
等待调用
模型响应等待请求

签发一枚临时密钥,然后把请求送入蜂葵LLM API。这里会逐字显示模型响应。


            

下游用户与会员

用户与鱼坞通卡

按用户控制流量、鱼坞通卡与分发计费

鱼坞通卡 蜂葵LLM API 的会员系统。档位决定默认 RPM、Token 预算与服务策略,用户表管理开户、流量与结算。 基础版 · 专业版 · 企业版
下游用户与鱼坞通卡列表
用户鱼坞通卡API 密钥累计用量收益方式毛收益流量状态操作
正在读取用户…

访问控制

API 密钥管理

按密钥分配频率与当前运行周期 Token 预算

0 枚密钥
API 密钥列表
名称所属用户密钥标识状态Token 预算频率最后使用操作
正在读取密钥…

产品接口

开放接口

下游用户、公开目录与管理台使用这些路径。密钥走 Bearer,管理写操作走管理员令牌。

正在读取接口目录…

上游供给

上游 API 接口

尚未主动检测

泊位供应方模型状态延迟在途操作
正在读取渠道…

调用追踪

最近航次

只记录元数据,不记录提示词和响应正文

还没有调用。去调用台发送第一条消息。

下游访问凭证

生成一枚临时调用密钥

完整密钥只显示这一次,并且只保存在当前页面内存中。刷新页面后需要重新生成。

额度将按该用户的鱼坞通卡档位预填,仍可手动调整。
1–10,000 RPM
当前运行周期内累计

下游用户开户

新增下游用户

为用户开通鱼坞通卡,并设定蜂葵LLM API 从该用户调用中获得收益的方式。

档位决定新密钥的默认 RPM 与 Token 预算
在上游成本上增加结算比例
%

调用额度

调整密钥限额

为这枚密钥设置独立的请求频率和 Token 预算。

控制突发调用,范围 1–10,000
上调后可立即恢复被额度阻止的调用

模型计费

设置模型单价

按模型维度单独设置上游算力分摊成本;下游结算仍按用户差价/返佣模式累计。

例如:1,500,000 代表 1.5 CNY / 1M token 输入
例如:6,000,000 代表 6.0 CNY / 1M token 输出
请输入 ISO 4217 三位大写字母,提交时会自动标准化为大写。

逻辑模型

新增逻辑模型

创建一个对下游可见的模型名,并映射到上游 API 接口中的真实模型。

调用将转发到该泊位的 OpenAI 兼容接口
写入渠道 modelMap 的真实模型 ID

上游 API

接入上游接口

添加一个 OpenAI 兼容上游。开发环境可指向本地 Mock 或回环地址。

不要把密钥写进 URL。探测会请求 /v1/models

管理接口认证

输入管理员令牌

令牌仅保存在当前页面内存中,用于访问生产环境管理接口;刷新或关闭页面后会清除。

撤销这枚 API 密钥?

使用这枚密钥的所有调用会立即被拒绝,此操作无法恢复。