Qwen-VL
通义千问开源的视觉语言模型,支持图文对话与定位。
工具介绍
项目简介通义千问开源的视觉语言模型,支持图文对话与定位。核心特性中英文图文理解支持检测框定位提供量化版本获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
功能特点
- 中英文图文理解 支持检测框定位 提供量化版本
标签:Qwen-VL 通义千问 视觉语言 多模态
分类:开源多模态模型
通义千问开源的视觉语言模型,支持图文对话与定位。
项目简介通义千问开源的视觉语言模型,支持图文对话与定位。核心特性中英文图文理解支持检测框定位提供量化版本获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
标签:Qwen-VL 通义千问 视觉语言 多模态
分类:开源多模态模型