昆仑引擎
登录 免费试用
已备案 · 等保二级 · 数据不出域

昆仑引擎 · 腾讯混元官方算力中转

兼容 OpenAI 协议 · 企业级审计 · 已备案

OpenAI 兼容协议 · 一行接入
BASE=https://api.yizhuruanjian.com/v1 curl $BASE/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $YOUR_KEY" \ -d '{"model":"hy3","messages":[ {"role":"user","content":"你好"}]}'
← 左右滑动查看完整命令

兼容 OpenAI 协议 · 存量代码 5 分钟迁移 · 查看完整文档 →

立即开通 查看文档

新用户注册即送 180 万 Token 免费额度

模型总览

生产白名单 2 个混元模型 · 明码标价 · 切换只改 model 字段

混3
混元 3
通用主力 · 腾讯自研
256K 上下文低延迟腾讯自研
输入¥0.8 / 百万 tokens
输出¥2.0 / 百万 tokens
缓存输入¥0.2 / 百万 tokens
混4
混元 4 预览
高质量旗舰 · 腾讯自研
深度思考1M 上下文腾讯自研
输入¥1.0 / 百万 tokens
输出¥4.0 / 百万 tokens
缓存输入¥0.25 / 百万 tokens
hy4-preview

生产白名单仅以上 2 个腾讯混元模型;混元翻译 / 混元角色为企业版专属,见 企业 & 私有化。第三方模型仅内部测试,不参与对外商用服务。套餐 Token 单价 = 混元官方价 +20%,页面标注的额度即真实可用量。

简单透明的定价

包年 = 付 10 个月的钱,享 11 个月 Token 额度(多送 1 个月)

Token 额度为真实可用量,按混元官方价 +20% 计价,无虚标、无隐藏限制

所有套餐含:OpenAI 兼容协议 · 子账号 · 按项目计量 · 操作审计日志 · 仅启用已备案的腾讯混元模型

企业版 & 私有化部署

企业版·深度(混元 4 预览 + 混元角色,并发 100)· 企业版·多语种(混元翻译 + 混元 3,并发 100)· 私有化网关(混元 3,并发 500,数据不出域)

OpenAI 兼容协议 · Key 级预算上限 · 明细账单 · 等保级日志 · 对公开票 · 内网私有化网关授权

联系商务

5 分钟接入

base_url 换成昆仑引擎,其余代码一行不改。

base_url / 模型名

# ① 所有请求把 base_url 换成 ↓ https://api.yizhuruanjian.com/v1 # ② 模型名(白名单;随套餐档位,不是自选) hy3 / hy4-preview
← 左右滑动查看完整内容

cURL

BASE=https://api.yizhuruanjian.com/v1 curl $BASE/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $YOUR_KEY" \ -d '{"model":"hy3","messages":[ {"role":"user","content":"你好"}]}'
← 左右滑动查看完整命令

Python(openai SDK)

from openai import OpenAI BASE = "https://api.yizhuruanjian.com/v1" client = OpenAI( base_url=BASE, api_key="$YOUR_KEY", ) resp = client.chat.completions.create( model="hy3", messages=[ {"role": "user", "content": "你好"}, ], ) print(resp.choices[0].message.content)
← 左右滑动查看完整代码

Node.js(openai SDK)

import OpenAI from "openai"; // BASE_URL=https://api.yizhuruanjian.com/v1 const client = new OpenAI({ baseURL: process.env.BASE_URL, apiKey: process.env.YOUR_KEY, }); const chat = client.chat.completions; const resp = await chat.create({ model: "hy3", messages: [ { role: "user", content: "你好" }, ], }); console.log(resp.choices[0].message.content);
← 左右滑动查看完整代码

计费口径:输入 / 输出 / 缓存命中分别计价,按百万 tokens 结算;max_tokens 上限 16384,默认流式返回并附带 usage。

昆仑引擎是已备案大模型(腾讯混元)的 API 算力中转与计费网关。生产环境对外服务仅启用腾讯混元 hy3 / hy4-preview;平台不训练、不微调、不改变模型权重、不对模型输出做实质性重组;第三方模型仅作内部测试,不参与对外商用服务。