L2 供给层 / TOKEN SUPPLY

一路稳定的
大模型 Token

统一网关接入多家模型,按场景路由与降级,配额有保障、调用可追溯。用量、单价与成本在同一张看板上可查——先把账算清楚,再决定跑多大。

接入改动:2 行 OPENAI 兼容
# 原有代码不用动,只换 key 和 base_url
from openai import OpenAI

client = OpenAI(
    api_key  = "rfhc-••••••••",
    base_url = "https://api.rfhct.com/v1",
)

resp = client.chat.completions.create(
    model    = "auto",   # 或指定档位 / 具体模型
    messages = [{"role": "user", "content": "..."}],
)
接入成本 改 2 行代码 OpenAI 兼容协议,现有 SDK 与框架直接可用
模型切换 一次接入,多模型可切 换模型不用改业务代码,改配置即可
结算方式 按量计费 / 预付包量 账单可拆分到部门、项目与人
可用性 多模型互为备份 主模型异常自动降级到备选,业务不断

成本测算 / COST ESTIMATOR

先算账,再上项目

把你的调用规模填进去,立刻看到月度 token 消耗与费用区间。参数都可改,用来跟内部立项预算对齐,或者跟现有方案做横向比较。

INPUT / 用量参数
PRICE / 单价(示例值,非报价)

单价为便于试算的示例值,不代表任何报价。实际单价按模型档位、承诺用量与合同周期确定,以正式报价单为准。

OUTPUT / 测算结果
月度费用估算
元 / 月
按 30 天计
月度输入 tokens
月度输出 tokens
月度总 tokens
单次调用平均成本
日均费用
年度费用(×12)
改任意参数即时重算 · 数字仅为测算,不构成报价 按这个量取报价

接入方式 / INTEGRATION

一次接入
多模型可切

网关对上层暴露统一的 OpenAI 兼容接口。业务代码写一次,之后换模型、调档位、加备份,都在网关侧配置,不用重新发版。

模型档位 典型用途 上下文 相对单价
旗舰推理档 复杂推理、代码生成、Agent 主干
通用对话档 客服问答、摘要改写、分类抽取
长文本档 合同与标书解析、长报告处理 超长
视觉多模态档 图纸识别、单据录入、质检辅助 中高
向量嵌入档 知识库检索、语义去重

按档位而非按品牌选型,业务侧不必绑定单一厂商。具体可用模型清单、上下文长度与单价,在开通时提供。

01 / 路由
按场景路由
同一个入口,不同业务走不同档位:客服问答走通用档,合同解析走长文本档,Agent 主干走旗舰档。路由规则在网关配置,业务无感。
02 / 降级
故障自动降级
主模型超时、限流或异常时,自动切到备选模型继续服务,并记录降级事件。避免单一供应商波动直接打到你的业务上。
03 / 兼容
OpenAI 兼容协议
现有基于 OpenAI SDK、LangChain、Dify 等框架写的代码可直接迁移,改 key 和 base_url 两处即可,不需要重写调用层。
04 / 私有
可对接私有化模型
内网自建的开源模型可以挂在同一个网关后面,和公有模型共用一套路由、计量与审计,敏感数据走内网、通用请求走公有。

计费与配额 / BILLING

两种结算方式
按你的预算节奏选

用量不稳定的阶段建议按量计费,跑稳之后转预付包量拿更低单价。两种方式都支持把账单拆到部门、项目和具体调用方。

按量计费 POSTPAID

用多少算多少,月结。适合处于验证期、用量还没跑稳的项目。

无预付门槛,随开随用
按月出账,用量明细可导出
可为每个项目设独立用量上限
随时可转为预付包量
预付包量 PREPAID

按承诺用量提前采购,换更低单价与高峰期配额预留。适合已经跑稳、要控年度预算的业务。

承诺量越大,单价档位越低
高峰时段配额预留,不与他人争抢
余量可视,用尽前提前提醒
一次采购、跨部门分摊使用

成本优化 / OPTIMIZATION

同样的业务量
账单可以低一截

大部分企业的 token 账单里有相当一部分是可以省掉的。这四件事我们在接入阶段就会一起做,不额外收费。

手段 01
档位下沉
很多任务并不需要旗舰模型。把分类、抽取、改写这类确定性任务下沉到通用档,效果不掉、单价降一档。我们会先跑评测再切,不是拍脑袋换。
手段 02
提示词与上下文瘦身
输入 token 常年被冗长的系统提示和整段塞进去的知识库拖高。做提示词精简与检索片段控制,输入量往往能压掉三成以上。
手段 03
缓存与批量
高频重复问答走结果缓存,离线任务走批量接口。对客服、报表这类重复度高的场景效果最明显。
手段 04
用量治理
给每个项目设配额与告警,把失控的重试、死循环调用和测试环境跑真量这些问题挡在账单之前。看板上按部门看得见,谁在花钱一目了然。

接入流程 / GETTING STARTED

四步开通

从聊清楚场景到跑起来,通常在一周内。

STEP 01 场景与用量对齐 说清业务场景、并发与预期用量,我们给出档位建议和单价区间。
STEP 02 开通测试额度 发放测试 key,用真实业务数据跑一轮,验证效果与延迟。
STEP 03 签约与配置 确定结算方式,配置路由、降级、配额与账单拆分口径。
STEP 04 上线与调优 正式切量,按周看用量与成本,持续做档位与提示词优化。

采购关注 / FAQ

采购方常问的几件事

数据会不会被用去训练?
不会。经网关的请求只做转发与计量,不留存业务内容用于训练。对数据敏感的业务,可以把开源模型部署在你的内网,挂到同一个网关后面,敏感请求全程不出内网。
上游模型涨价或下线怎么办?
这正是走网关而不是直连的意义。同档位下有多个可选模型互为备份,切换在网关侧完成,业务代码不动。预付包量的客户在合同周期内单价不受上游波动影响。
能不能只买 Token,不买你们别的服务?
可以。四层能力可以单独采购,Token 供给是独立的一层。当然如果同时做智能体或行业产品,用量优化和排障会顺手很多。
发票、合同与结算周期怎么走?
按标准企业采购流程走,可开专票,月结或按合同约定周期结算。账单附完整用量明细,可按部门、项目、调用方三个维度拆分,方便内部分摊。
用量突然涨十倍撑得住吗?
提前告知的情况下可以预留配额。预付包量客户在高峰时段有配额预留,不与其他客户争抢。未提前报备的突发流量按限流策略处理,并触发告警而不是直接失败。

开通与报价 / CONTACT

把用量说清楚
我们给一份可核算的报价

带上你在测算器里算出来的量,或者直接说场景,我们会给出档位建议、单价区间和一份可以拿去立项的成本测算表。

TEL0755-86546172
ADDR深圳市南山区粤海街道
科技中一路汉京中心 18 层 01-02
HOURS工作日 09:00 – 18:00