本页可直接阅读、选中文本复制或打印。文中的复制按钮、判断练习和成果保存,请使用互动版。

中文教程 · 独立阅读版

Qwen 模型:选择托管 API 还是自行运行

从硬件、维护和接口开始,区分模型权重与可直接调用的服务。

内容整理:2026-09-07 · 资料核对:2026年9月14日

进入互动版,练习并保存成果

开始前准备

有基本开发经验,写下一项计划接入 AI 的任务。不需要为了这篇教程购买设备或下载模型。

1. 先分清下载模型与调用模型

Qwen 模型可以通过相应模型发布页面获取权重,也可以由服务商托管并提供 API。下载了权重并不等于已经有可调用接口,还需要推理运行环境。

Qwen Chat 是现成应用,Qwen Code 是终端工具,都不能代替你确认模型部署方式。

2. 为两种方式列准备清单

托管 API 需要核对服务地区、认证、模型 ID、请求格式与费用;自行运行需要核对权重许可、显存、推理框架、量化格式和运维能力。

以一个小型文本提取任务为例,先评估是否有自行维护的必要。没有硬件经验时,可先阅读托管接口示例,不必一步跨到部署完整大模型。

3. 固定准确的模型与接口约定

同一系列下不同尺寸、版本和用途的模型不是可以任意互换的字符串。从选择的服务文档复制准确标识,不根据网页品牌名猜模型 ID。

用带缺失字段的提取任务设计验收:语法、字段类型和原文对应都要检查。之后更换服务时重新检查兼容性。

练习与核对

按实际操作自查,完成标记与成果草稿请在互动版保存。

打开练习与核对

带走这一点

选择模型的同时,也在选择它的运行位置和维护方式。

资料与核对记录

关键步骤有官方依据

已确认权重、推理与部署入口。本课只比较运行方式,不把文档首页版本当作最新模型。

本次核对公开官方资料,未登录产品账号、运行练习或发起付费调用。

步骤对不上?在互动版生成问题记录