Token 工厂

面向商业 AI 推理的 Token 工厂

杭州趣算科技面向企业客户托管并运营开源大模型,通过托管模型 API 与智能路由提供推理服务。只做推理:不做训练与微调,客户直接获得 API 输出,无需接触底层 GPU。

查看价格
杭州趣算科技大模型服务示意图:JSON 契约、模型路由与评估检查点
API托管接入生产级模型推理
路由单一入口完成模型选择与请求路由
GPU基础设施由杭州趣算科技全程运营

端到端的托管推理

为需要稳定模型输出、又不想自建和运维 GPU 集群的企业,提供生产级的 token 服务层。

工程师在生产推理硬件旁操作托管模型 API
01

托管模型 API

通过为商业推理负载打造的稳定 API,接入开源大模型。

AI 工程工作站上打开的生产 token 服务流程
02

生产级 token 服务

杭州趣算科技负责推理服务层、算力容量、可观测性与可靠性,保障生产环境持续产出 token。

工程师在模块化 GPU 基础设施间调度模型推理
03

模型路由

在统一的托管入口与服务契约之下,把推理请求路由到各个受支持的模型。

可靠性工程师运维隔离的生产 AI 基础设施
04

基础设施隔离

客户只获取 API 输出。底层 GPU、推理服务栈与运维完全由杭州趣算科技掌控。

从业务负载到 token 交付

  1. 评估

    我们与您一起梳理推理负载、目标模型、延迟要求、吞吐量与 API 契约。

  2. 部署

    杭州趣算科技按约定负载选型并运营所需的推理基础设施。

  3. 接入

    客户只需对接一个托管 API 即可获得模型输出,无需直接访问 GPU 层。

  4. 运营

    随生产需求变化,我们持续监控路由、容量、可靠性与 token 交付。

为商业推理而生

AI 产品推理

通过托管模型 API,为面向客户的智能助手、信息抽取与自动化系统提供推理能力。

企业模型接入

让内部产品获得可管控的推理入口,无需自建和运营 GPU 平台。

多模型路由

把受支持的开源模型、路由策略、用量可视化与运维整合到一个服务之内。

国产模型

大模型价格

以下为规划 AI 产品时的参考价格,按每 100 万输入 / 输出 token 计(美元)。

DeepSeek 深度求索

6 个模型
模型 ID输入 / 100 万 token输出 / 100 万 token
deepseek/deepseek-v4-pro$0.435$0.87
deepseek/deepseek-v4-flash$0.098$0.196
deepseek/deepseek-v3.2$0.269$0.40
deepseek/deepseek-r1-0528$0.50$2.15
deepseek/deepseek-r1$0.70$2.50
deepseek/deepseek-chat$0.20$0.80

通义千问 Qwen

6 个模型
模型 ID输入 / 100 万 token输出 / 100 万 token
qwen/qwen3.7-max$1.475$4.425
qwen/qwen3.7-plus$0.32$1.28
qwen/qwen3.6-flash$0.188$1.125
qwen/qwen3-coder-plus$0.65$3.25
qwen/qwen3-coder-flash$0.195$0.975
qwen/qwen3-coder$0.30$1.00

月之暗面 Kimi

4 个模型
模型 ID输入 / 100 万 token输出 / 100 万 token
moonshotai/kimi-k2.7-code$0.719$3.49
moonshotai/kimi-k2.6$0.95$4.00
moonshotai/kimi-k2-thinking$0.60$2.50
moonshotai/kimi-k2$0.57$2.30

智谱 GLM

4 个模型
模型 ID输入 / 100 万 token输出 / 100 万 token
z-ai/glm-5.2$0.959$3.014
z-ai/glm-5.1$0.966$3.036
z-ai/glm-5$0.95$3.15
z-ai/glm-4.7-flash$0.06$0.40