Skip to content

腾讯混元教程

本页带你走完「认产品 → 网页试用 → TokenHub 第一次调用 → 找到开源权重」。参数与价格见 速查表,场景配方见 Cookbook,撞名见 术语表

模型内部(MoE、MTP、注意力)不在这里讲,见 LLM 基础Learn LLM

1. 先确认你进对了门

你以为自己在用实际是下一步
「腾讯那个 AI」网页聊天多半是 元宝离开本页,见 #76
IDE 里补全 / 改仓库CodeBuddy离开本页,见 #78
自己的服务要 chat/completionsTokenHub + hy3继续往下
下载权重自己 serveTencent-Hunyuan/Hy3跳到 开源权重

混元官网是 hunyuan.tencent.com(同站 hy.tencent.com)。品牌文案已从 Hunyuan 迁到 Hy;API 和仓库里两套名字都还在。

2. 网页试用(可选)

官方试用台是 Hy AI Studioaistudio.tencent.com。官网页头「试用 Hy」也进这里。适合确认模型口吻,不适合当生产端点。

生产调用不要抄 Studio 的页面 URL,走下一节的 TokenHub。

3. TokenHub:15 分钟第一次 hy3

事实源:快速入门混元调用指南

3.1 开通

  1. 注册腾讯云 并完成实名(快速入门「准备工作」原文)。
  2. 登录 TokenHub 控制台,按界面开通。
  3. 模型广场右上角领「新用户福利免费体验」。额度与有效期以控制台和 新人免费体验包 文档为准,不要把营销页的「100 万 tokens」当成所有模型的固定配额。
  4. 打开 API Key 管理 → 选地域 → 创建 API Key。范围选「全选」或勾上 hy3。创建后立刻复制,页面不会反复明文展示。

TokenHub 不是混元专用网关。它还提供 DeepSeek / Kimi / GLM 等。本教程只把 model 设成 hy3

3.2 调一次(TypeScript)

端点:https://tokenhub.tencentmaas.com/v1。鉴权:Authorization: Bearer <API Key>hy3 兼容 OpenAI Chat Completions(以及 Responses、Anthropic Messages,见调用指南)。

官方 Node 示例把 model 换成 hy3,并带上调用指南推荐的 temperature: 0.9

ts
import OpenAI from 'openai'

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: 'https://tokenhub.tencentmaas.com/v1',
})

const response = await client.chat.completions.create({
  model: 'hy3',
  messages: [{ role: 'user', content: '你好,请简单介绍一下你自己。' }],
  temperature: 0.9,
})

console.log(response.choices[0].message.content)

curl 对照(132252):

bash
curl -X POST 'https://tokenhub.tencentmaas.com/v1/chat/completions' \
  -H 'Content-Type: application/json' \
  -H "Authorization: Bearer ${TOKENHUB_API_KEY}" \
  -d '{
    "model": "hy3",
    "messages": [{"role": "user", "content": "你好,请简单介绍一下你自己。"}],
    "stream": false,
    "temperature": 0.9
  }'

成功时响应里的 modelhy3choices[0].message.content 是正文。不要把示例里的 YOUR_API_KEY 提交进仓库。

3.3 规格(托管)

来源:模型列表模型价格

官方值
modelhy3
上下文窗口256k
最大输入 / 输出192k / 128k
能力深度思考(保留式)、结构化输出、Function Calling、Cache
后付费输入 1 / 输出 4 / 缓存命中 0.25 元/百万 tokens

hy3-preview 能力相近,但官方写明 2026-08-31 下线。新代码不要再用 preview slug。

思考档、流式、工具调用见 Cookbook

4. 接到现成 coding agent

TokenHub 快速入门「通过 AI 工具调用模型」列出 Claude Code、Cursor、OpenClaw、CodeBuddy Code、Cline、Kilo Code、Roo Code 等。Hy3 在 Claude Code 里的官方步骤:1823/131903

本页不复制那些 IDE 的安装过程。要点只有一句:把兼容端点指到 https://tokenhub.tencentmaas.com/v1,模型填 hy3,Key 用 TokenHub 的。CodeBuddy 本身怎么用,去 #78。

5. 开源权重

旗舰开源模型是 Hy3GitHubHugging Face tencent/Hy3。Apache-2.0。联系邮箱(README 原文):hunyuan_opensource@tencent.com

官方规格(不要改数字):295B MoE、21B 激活、3.8B MTP、256K 上下文、192 experts top-8。README 原文:满血 serve 建议 8 卡,推荐 H20-3e 或显存更大的 GPU。这不是「笔记本 ollama run」那条路。

本地先起服务,再打 OpenAI 兼容口(README Quickstart):

python
from openai import OpenAI

client = OpenAI(base_url="http://127.0.0.1:8000/v1", api_key="EMPTY")

response = client.chat.completions.create(
    model="hy3",
    messages=[{"role": "user", "content": "Hello! Can you briefly introduce yourself?"}],
    temperature=0.9,
    top_p=1.0,
    extra_body={"chat_template_kwargs": {"reasoning_effort": "no_think"}},
)
print(response.choices[0].message.content)

启动命令以仓库 README 为准。两套 parser 不要抄混

  • vLLM:--tool-call-parser hy_v3--reasoning-parser hy_v3
  • SGLang:--tool-call-parser hunyuan--reasoning-parser hunyuan

同 org 还有 HunyuanVideo、HunyuanImage-3.0、Hunyuan3D-2.1、HunyuanOCR 等。下载哪个仓,看你要的模态,不要假设都能用 hy3 这个 slug 调用。

6. 常见失败

现象先查
401Key 没带、带了腾讯云 CAM 密钥而不是 TokenHub API Key
模型不存在model 写成了 hunyuan / Hy3 / hy3-preview(后者临近下线)
思考字段对不上TokenHub 用 thinking / reasoning_effort;本地 README 用 chat_template_kwargs。见 术语表
想找 CLI混元没有第一方 CLI。终端 Agent 是 CodeBuddy

下一步:Cookbook速查表

为前端工程师打造 · 基于 VitePress 构建