模型分层选型
简单任务(分类、抽取、改写)用 Flash 或 Turbo 控制成本;中等复杂任务用 Plus;需要深度推理、复杂逻辑与高质量生成的场景用 Max。合理分层可把成本降低一个数量级。
输入关键词开始搜索,支持产品名、别名、场景与关键词。
千问(Qwen)是阿里云完全自主研发的大模型家族,并非单一对话模型,而是覆盖文本、代码、图像、音频、视频的全模态模型矩阵。Qwen 系列包括旗舰级 Qwen-Max、均衡型 Qwen-Plus、高性价比 Qwen-Flash、开源可私有化部署的 Qwen 系列,以及视觉、语音、图像生成等专用模型。
希望在产品中集成大模型能力但不想自建模型的团队;需要中文能力强、成本可控且合规的国内业务;需要视觉与语音多模态能力的应用。
以下参数用于快速比对本产品的核心能力边界。
| 模型系列 | Qwen-Max(旗舰)、Qwen-Plus(均衡)、Qwen-Flash(高性价比)、Qwen-Turbo |
|---|---|
| 多模态 | Qwen-VL(视觉理解)、Qwen-Audio、Qwen-Image、Wan(视频生成) |
| 开源版本 | Qwen 系列多规格开源,可本地部署 |
| 上下文长度 | 最高支持数十万 tokens(依模型而定) |
| 能力 | 文本生成、代码、数学推理、多语言翻译、工具调用、结构化输出 |
| 接入方式 | 百炼平台 API、DashScope SDK、OpenAI 兼容接口 |
| 私有化 | 支持开源模型本地部署或通过 PAI 部署 |
价格为整理时的参考区间,实际以下单页面为准。计费模式:按 tokens 计费(输入/输出分别计价) · 批量推理折扣 · 免费额度 · 模型订阅套餐。
| 套餐 / 规格 | 配置说明 | 参考价格 | 备注 |
|---|---|---|---|
| Qwen-Flash | 输入 | 按 tokens 元/千 tokens | 高性价比,适合高并发 |
| Qwen-Plus | 输入 / 输出 | 按 tokens 元/千 tokens | 能力与成本均衡 |
| Qwen-Max | 输入 / 输出 | 按 tokens 元/千 tokens | 复杂推理任务 |
| 新用户额度 | 免费 tokens | 0 | 注册赠送额度 |
| 批量推理 | Batch 调用 | 低至 5 折 | 离线任务更省 |
省钱提示:长期稳定负载优先包年包月并叠加节省计划;无状态批处理可用抢占式实例,成本可低至按量价的 10%。 查看成本优化指南 →
简单任务(分类、抽取、改写)用 Flash 或 Turbo 控制成本;中等复杂任务用 Plus;需要深度推理、复杂逻辑与高质量生成的场景用 Max。合理分层可把成本降低一个数量级。
支持图片理解、OCR、图表解析、票据识别与多图推理。可直接上传截图或扫描件,让模型提取结构化信息,替代传统 OCR + 规则解析的方案。
原生支持 Function Calling,模型可自主决定调用哪些外部工具(查数据库、调 API、搜索),是构建 Agent 与自动化工作流的基础能力。
支持 JSON 模式输出,可直接生成符合指定 Schema 的结构化数据,便于程序解析,大幅简化从自然语言到结构化数据的转换流程。
支持超长上下文,可直接把合同、报告、技术文档整篇输入,让模型做摘要、对比、条款提取与风险识别,无需先做分块。
Qwen 多个规格已开源,可通过 PAI 平台或自有 GPU 集群部署,满足数据不出域、成本可控与深度定制的需求。
遵循「够用就好」原则:分类、抽取、改写等简单任务用 Flash;客服问答、内容生成用 Plus;复杂推理、代码、长文档分析用 Max。建议先用 Plus 做验证,再按实际效果升降级。
百炼平台提供 OpenAI 兼容接口,只需修改 base_url 与 api_key,现有基于 OpenAI SDK 的代码基本可以零改动迁移。
有。新用户注册百炼平台通常会获得一定量的免费 tokens 额度,各模型也有新用户专享的试用额度,可用于开发测试。
通过百炼 API 调用的数据不会用于模型训练。如果对数据安全有更高要求,可选择开源模型私有化部署,数据完全不出自有环境。
不同模型支持的上下文长度不同,主流规格可处理数万到数十万 tokens。超长文档建议结合 RAG(向量检索)方案,只把相关片段送入模型。
一站式大模型应用开发平台,从调用到 Agent 编排
从数据标注到模型训练的全链路 AI 工程平台
Serverless 向量数据库,RAG 应用的标准组件
弹性模型推理服务,把模型变成稳定的在线 API