Qwen3.8-Flash
- 上下文
- 1M
- 输入价
- $0.15 / 百万 tokens
- 输出价
- $0.47 / 百万 tokens
- 许可
- 闭源
概览
Qwen3.8 系列的低价高吞吐档,由阿里云百炼提供托管服务。与旗舰同样支持 100 万 token 上下文、最大 131,072 token 输出,并接受图像、文本、视频输入,但价格仅为 Max 档的十三分之一左右——每百万 token 输入 $0.15、输出 $0.47。适合大批量文档处理、内容审核、长文摘要等对成本敏感的场景,也支持函数调用、结构化输出与上下文缓存。
- 模态
- 多模态
能力
- 百万 token 上下文(最大输入 991,808、最大输出 131,072 token)
- 图像与视频输入的多模态理解
- 函数调用与结构化输出
- 支持上下文缓存,重复前缀可显著降本
- 同时兼容 OpenAI 与 Anthropic 两套 API 协议

