NExT-GPT
开源任意到任意多模态大模型,统一处理文本/图像/音频/视频。
工具介绍
项目简介开源任意到任意多模态大模型,统一处理文本/图像/音频/视频。核心特性任意模态输入输出统一指令范式模块化可扩展获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
功能特点
- 任意模态输入输出 统一指令范式 模块化可扩展
标签:NExT-GPT 任意模态 多模态 生成
分类:开源多模态模型
开源任意到任意多模态大模型,统一处理文本/图像/音频/视频。
项目简介开源任意到任意多模态大模型,统一处理文本/图像/音频/视频。核心特性任意模态输入输出统一指令范式模块化可扩展获取方式通过上述官方开源仓库(通常为 GitHub)克隆或下载,按 README 安装依赖即可本地部署与二次开发。
标签:NExT-GPT 任意模态 多模态 生成
分类:开源多模态模型