CogVLM
智谱开源的视觉语言模型,保持语言能力强的同时理解图像。
工具介绍
项目简介智谱开源的视觉语言模型,保持语言能力强的同时理解图像。核心特性视觉与语言深度融合支持视觉定位开源权重与代码获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
功能特点
- 视觉与语言深度融合 支持视觉定位 开源权重与代码
标签:CogVLM 智谱 视觉语言 多模态
分类:开源多模态模型
智谱开源的视觉语言模型,保持语言能力强的同时理解图像。
项目简介智谱开源的视觉语言模型,保持语言能力强的同时理解图像。核心特性视觉与语言深度融合支持视觉定位开源权重与代码获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
标签:CogVLM 智谱 视觉语言 多模态
分类:开源多模态模型