阿里云qwen3.7-plus模型:阶梯计费限时8折 夜间4折,缓存低至0.16元/百万Token,多档优惠

阿里云百炼(模型服务)qwen3.7-plus大模型详情介绍:该模型的代码与介绍标签(Qwen3.7、文本生成、深度思考、视觉理解)、模型能力矩阵(输入/输出模态、function calling、结构化输出、联网搜索、缓存、批量推理等)、阶梯计费模式下的模型价格(输入/输出每百万tokens原价及限时折扣、Batch与缓存计价)、工具调用价格(code_interpreter、web_search、t2i_search、i2i_search、web_extractor)、免费额度状态(剩余0%,不支持开启)、模型限流与上下文参数(最大输入991K、最大输出128K、上下文1M、RPM 30000、TPM 5000000等),以及基于OpenAI兼容模式的Python流式调用API代码示例(含深度思考开关enable_thinking)。

一、qwen3.7-plus模型介绍

Qwen3.7系列是阿里云推出的高性价比Plus级模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力:能够感知真实世界场景、读取屏幕并操作GUI、基于视觉参考生成代码、端到端导航移动应用,真正实现"看懂界面、动手操作"的Agent级体验。

该模型带有 Qwen3.7、文本生成、深度思考、视觉理解 四大标签,当前版本功能等同于快照模型 qwen3.7-plus-2026-05-26,模型Code为 qwen3.7-plus,用户可在控制台点击"立即体验"快速试用。

二、qwen3.7-plus模型能力

模态支持:

  • 输入模态:文本、图像、视频;
  • 输出模态:文本。

功能特性一览:

能力项支持情况能力项支持情况
模型体验✅ 支持前缀续写✅ 支持
Function Calling✅ 支持Cache缓存✅ 支持
结构化输出✅ 支持批量推理✅ 支持
联网搜索✅ 支持模型调优❌ 不支持

可以看出,qwen3.7-plus在智能体调用(function calling)、结构化输出、联网搜索与缓存加速等工程化能力上全面就绪,仅不支持用户侧的模型调优(微调)。

三、qwen3.7-plus模型适用场景

根据大模型服务平台百炼文档,qwen3.7-plus 能力与成本均衡,拥有 100 万上下文窗口和完整的内置工具,推荐用于以下场景:

  • 通用文本任务:聊天机器人、内容生成、摘要总结、文档处理。
  • 办公场景(非编程):文档撰写、邮件处理、会议纪要整理、数据分析等日常办公任务,支持 Function Calling 和内置工具。
  • AI 编程与 Agent 开发:适用于 OpenClaw、Claude Code、Hermes 等工具,具备完整工具调用支持,1M 上下文适合大型代码库。
  • 多模态交互混合智能体:能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

四、qwen3.7-plus模型价格

模型采用阶梯计费模式,以下为输入长度 ≤256K 档位的定价(单位:元/每百万tokens),并标注限时折扣及折后参考价:

基础推理价格:

计费项原价优惠折后参考价
输入2限时8折1.6
输入(缓存命中)0.4限时8折0.32
输入(Batch File)11
显式缓存创建2.5限时8折2
显式缓存命中0.2限时8折0.16
输入(Batch Chat)2限时5折1
输出8限时8折6.4
输出(Batch File)44
输出(Batch Chat)8限时5折4

工具调用价格(Responses API):

工具价格工具价格
code_interpreter限时免费i2i_search48元/千次调用
web_extractor限时免费t2i_search24元/千次调用
web_search4元/千次调用

整体来看,qwen3.7-plus的输入价格低至每百万tokens 2元(折后1.6元),缓存命中后更可降至0.4元乃至0.2元档位,配合Batch批量推理半价策略,大规模应用成本优势显著;代码解释器与网页抽取工具当前限时免费,进一步降低了Agent开发门槛。

五、qwen3.7-plus免费额度

根据大模型服务平台百炼计费文档,qwen3.7-plus 的免费额度规则如下:

  • 额度数量:100 万 Token。
  • 适用地域:仅在华北2(北京)地域下有免费额度,其他地域均无免费额度。
  • 有效期:自开通百炼/模型发布/申请通过之日起 90 天内(以较晚者为准)。

qwen3.7-plus的免费推理额度,用户需按量付费使用;不过得益于限时折扣(输入/输出8折、Batch Chat 5折)以及code_interpreter、web_extractor等工具的限时免费政策,实际使用成本依然可控。详情可通过百炼平台了解:https://www.aliyun.com/product/bailian

六、qwen3.7-plus模型限流与上下文

参数数值参数数值
最大输入长度991K最大输出长度128K
最大输入长度(思考模式下)983K最大输出长度(思考模式下)128K
上下文长度1M最大思维链长度256K
RPM(每分钟请求数)30000TPM(每分钟Token数)5000000

qwen3.7-plus拥有1M(百万级)超长上下文,最大输入可达991K tokens(思考模式下983K),最大输出128K,思维链长度最高256K,足以容纳整本书籍、大型代码库或长视频脚本;同时RPM高达3万、TPM高达500万,为企业级高并发生产部署提供了充足余量。

七、qwen3.7-plus模型使用API代码示例

平台提供 OpenAI兼容 与 DashScope 两种接入方式,支持 Completions API 与 Responses API,点击"获取API Key"即可开通调用。以下为Python流式调用示例(开启深度思考模式):

from openai import OpenAI
import os

client = OpenAI(
    # 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://llm-fltqd30d7x9rrh4v.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
    model="qwen3.7-plus",  # 您可以按需更换为其它深度思考模型
    messages=messages,
    extra_body={"enable_thinking": True},
    stream=True
)
is_answering = False  # 是否进入回复阶段
print("\n" + "=" * 20 + "思考过程" + "=" * 20)
for chunk in completion:
    if not chunk.choices:
        continue
    delta = chunk.choices[0].delta
    if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
        if not is_answering:
            print(delta.reasoning_content, end="", flush=True)
    if hasattr(delta, "content") and delta.content:
        if not is_answering:
            print("\n" + "=" * 20 + "完整回复" + "=" * 20)
            is_answering = True
        print(delta.content, end="", flush=True)

代码要点解读: 该示例通过OpenAI兼容接口接入阿里云百炼服务,将 model 指定为 qwen3.7-plus,并通过 extra_body={"enable_thinking": True} 开启深度思考能力;在流式(stream)返回中,程序先打印模型的 reasoning_content(思考过程),待正式回复 content 开始输出时再切换打印"完整回复",从而清晰分离思维链与最终答案,便于开发者调试和展示深度思考模型的推理轨迹。

八、阿里云qwen3.7-plus最新活动

截至目前,qwen3.7-plus正在进行多项限时优惠活动:

Night Plan夜间错峰优惠(低至2折起)
每晚22:00至次日08:00(北京时间),Qoder和秒悟Meoo客户使用qwen3.7-plus可享4折优惠,Credits消耗倍率从0.1x降至0.04x,最高可节省60%成本。

  • 覆盖产品:Qoder全系(Desktop、Work CN、CLI、JetBrains插件)及秒悟Meoo网页端
  • 参与门槛:Pro Trial试用用户及付费订阅用户自动生效,无需报名、不用领券
  • 效果保障:折扣仅影响计费,模型推理质量、响应速度与白天完全一致

需要注意的是,Token Plan个人版用户的夜间折扣政策已有所调整。根据2026年8月发布的规则,qwen3.8-max上线后,个人版夜间5折优惠仅针对qwen3.8-max,qwen3.7-plus等旧模型按标准Credits系数计费,无额外夜间折扣。但Qoder/Meoo客户端的夜间错峰折扣(4折)仍可能继续适用,具体最新政策建议以阿里云百炼控制台实时展示为准。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

按量付费限时8折
qwen3.7-plus非思考模式推理后付费服务享受限时8折优惠,折后价格如下(华北2北京地域):

计费项原价(元/百万Token)8折价(元/百万Token)
输入(≤256K)2.01.6
输出(≤256K)8.06.4
输入(256K-1M)6.04.8
输出(256K-1M)24.019.2
缓存命中0.40.32

AI焕新季满减券(2026年9月30日截止)
面向已完成实名认证并开通百炼平台的特邀用户,提供三档满减券:

  • 满20减10
  • 满99减15
  • 满199减35

领取后14天内有效,仅限首次新购1年期及以内订单,支持Token Plan团队版、Qoder系列、Agent工具等产品。详情可参考:https://www.aliyun.com/benefit/client/cross

Token Plan订阅套餐限时优惠
通过Token Plan订阅计划使用qwen3.7-plus,成本可预测且灵活可控:

  • 个人版:Lite版39元/月(原价60元)、Standard版139元/月(原价180元)、Pro版499元/月(原价600元)
  • 团队版:标准坐席150元/席位/月(原价198元)、高级坐席550元/席位/月(原价698元)

详情可访问阿里云百炼Token Plan服务页面:https://www.aliyun.com/benefit/scene/tokenplan

OPC创新助力计划
面向独立开发者、自由职业者及"一人公司",提供最低1000元、最高100万元Token补贴,采用"先用后返"模式,根据实际消费金额次月获得相应额度的满返优惠券。申请入口:https://opc.aliyun.com/products

👉友情提示:购买之前,别忘了先领优惠券:
https://www.aliyun.com/minisite/goods 领了之后再买活动中的云产品,可以享受折上折。

总结: qwen3.7-plus凭借多模态混合智能体能力、百万级上下文、极高的限流配额以及极具竞争力的限时折扣价格,成为兼顾性能与成本的生产级大模型选择;配合开箱即用的OpenAI兼容API与免费工具调用权益,开发者可以快速构建具备深度思考、视觉理解与工具执行能力的智能应用。

本文原创链接:https://www.tengxunyun8.com/20714.html
版权所有,如未注明,均为原创,转载请注明