qwen3-vl-plus
通义千问VL是具有视觉(图像)理解能力的文本生成模型,不仅能进行OCR(图片文字识别),还能进一步总结和推理,例如从商品照片中提取属性,根据习题图进行解题等
模型概览
- 提供商
- Bailian (阿里云百炼)
- 计费方式
- 按 Token 计费
- 计费模式
- tiered_expr
- 支持的 API 接口
- openai
能力与标签
- 对话
- 识图
价格信息
动态价格取决于请求内容和用户分组,请查看交互式价格详情。
通义千问VL是具有视觉(图像)理解能力的文本生成模型,不仅能进行OCR(图片文字识别),还能进一步总结和推理,例如从商品照片中提取属性,根据习题图进行解题等
动态价格取决于请求内容和用户分组,请查看交互式价格详情。