LLM API 价格

Qwen 模型

浏览 TokenHot 上所有 15 个 Qwen 模型

一个统一 API Key,即开即用 15 个 Qwen 模型。兼容 OpenAI 接口,实时定价,无需单独申请厂商账号。

上下文1M
输入$0.1492/M
输出$0.4476/M
Qwen 系列的高效多模态主力模型,原生支持百万级上下文,并兼顾代码辅助、智能体工作流和图表等视觉理解;适合长文档、代码库、高并发应用与需要工具协作的任务。
输入模态:
输出模态:
深度思考工具调用结构化输出长上下文
试用模型
按秒$0.0675/s
通义万相 3.0 系列的速度优先版本(早期访问阶段),在保持高质量视频生成的同时缩短出片等待,适合低延迟预览、批量试做和需要快速迭代的短视频工作流;若更看重极致画面控制而非出片速度,可选择标准版。
输入模态:
输出模态:
多模态输出
试用模型
Qwen
按秒$0.0450/s
阿里通义万相 3.0 系列的标准视频生成模型(早期访问阶段),支持文生视频、图生视频及多模态参考输入,单次可生成最长约 30 秒的视频并同步生成音频,适合广告、短剧和叙事短片的快速出片;正式发布日期尚未公布,规格以官方为准。
输入模态:
输出模态:
多模态输出
Qwen
上下文1M
输入
$1.4200/M$1.7750/M
输出
$4.2640/M$5.3300/M
千问当前能力最强的旗舰多模态推理模型,适合长程编程、专业工作与多阶段智能体任务。它可处理文本、图片和视频,提供 1M 上下文、最长 128K 输出,并支持函数调用、结构化输出、联网搜索与代码解释器;更适合作为高质量复杂任务主力,而不是追求最低成本和最低延迟的批量调用。
输入模态:
输出模态:
深度思考联网搜索工具调用函数调用结构化输出长上下文代码执行
试用模型
按秒
$0.0024/s$0.0030/s
质量优先的专业生图与编辑模型:支持文生图和基于 1–3 张参考图的图像编辑,最长可接收约 4.5K token 指令,适合报纸、故事板、菜单、试卷等复杂版面,以及 10px 级细小文字、12 种语言和多字体渲染。相较标准版,更适合把复杂布局和细节还原放在首位;若更看重速度与成本,选标准版。
输入模态:
输出模态:
按秒
$0.0024/s$0.0030/s
兼顾质量与速度的 Qwen-Image 3.0 标准档,支持文生图与基于 1–3 张参考图的图像编辑,最长约 4.5K token 指令、最多 6 张输出和 2K 级分辨率,适合日常海报、界面、信息图与批量创作。复杂版面、细小文字和质量优先的成片可切换到 Pro;高频调用则优先选标准版。
输入模态:
输出模态:
按秒$0.1350/s
面向文生视频,相比 HappyHorse 1.0 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
按秒$0.1350/s
面向参考生成视频,相比 HappyHorse 1.0 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
按秒$0.1350/s
面向图生视频,相比 HappyHorse 1.0 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
Qwen
上下文1M
输入
$0.2400/M$0.3000/M
输出
$0.9600/M$1.2000/M
面向代理式工作负载、代码和办公生产力,相比 Qwen3.6 更强调长上下文、工具调用和结构化输出的稳定组合;对比 GPT、Claude、Gemini 等旗舰模型,它更适合作为中文、代码和多步工具任务里的高性价比替代。
输入模态:
输出模态:
深度思考工具调用函数调用结构化输出长上下文
试用模型
Qwen
上下文1M
输入
$1.4400/M$1.8000/M
输出
$4.3200/M$5.4000/M
面向代理式工作负载、代码和办公生产力,相比 Qwen3.6 更强调长上下文、工具调用和结构化输出的稳定组合;对比 GPT、Claude、Gemini 等旗舰模型,它更适合作为中文、代码和多步工具任务里的高性价比替代。
输入模态:
输出模态:
深度思考工具调用函数调用结构化输出长上下文
试用模型
上下文8K
按秒$0.1350/s
面向视频编辑,相比 早期视频模型 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
上下文8K
按秒$0.1350/s
面向文生视频,相比 早期视频模型 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
上下文8K
按秒$0.1350/s
面向参考生成视频,相比 早期视频模型 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出
上下文8K
按秒$0.1350/s
面向图生视频,相比 早期视频模型 更突出音频原生生成,一次完成对白、音效和背景音乐;对比 Veo、Kling、Runway,它的差异化优势在声画同步和角色一致性工作流。适合短剧、广告、电商和品牌营销视频。
输入模态:
输出模态:
多模态输出