ai-open-source工具
- LMDeploy - 书生·浦语开源的 LLM 压缩与部署工具箱。
- SGLang - 高性能大语言模型服务框架,RadixAttention 复用前缀。
- OpenLLM - BentoML 开源的任何模型一键部署为服务的工具。
- DeepSpeed - 微软开源的深度学习优化库,支持超大模型推理训练。
- Triton Inference Server - NVIDIA 开源的统一推理服务,支持多框架多模型。
- MLC-LLM - 基于编译的本地大模型部署,覆盖移动端与 WebGPU。
- KoboldCpp - 基于 llama.cpp 的易用 AI 推理前端,适合本地创作。
- Llama 3 - Meta 推出的 Llama 3 系列大语言模型,提供 8B/70B 等权重,支持商业使用与微调。
- Mistral 7B - Mistral AI 开源的 7B 稠密模型,以小而强著称,推理效率高。
- Mixtral 8x7B - Mistral 开源的专家混合(MoE)模型,激活参数少、性价比高。
- Qwen - 阿里巴巴通义千问开源大模型系列,覆盖对话、代码与多模态。
- Qwen2.5 - Qwen 系列升级版,强化数学、代码与结构化输出能力。
- DeepSeek-LLM - 深度求索开源的通用大模型,含 DeepSeek-V2/V3 等强推理版本。
- GLM-4 - 智谱 AI 开源的 GLM 系列大模型,支持长文本与工具调用。
- Gemma - Google DeepMind 开源的轻量大模型系列,基于 Gemini 技术。
- Falcon - 阿联酋 TII 开源的大模型,含 7B/40B/180B 等。
- BLOOM - BigScience 社区协作训练的多语言 176B 开源大模型。
- Yi - 零一万物开源的 Yi 系列模型,含 Yi-1.5 与 Yi-VL 多模态。
- InternLM - 上海AI实验室开源的书生·浦语大模型,配套全链路工具链。
- LLaVA - 开源视觉语言模型,将视觉编码器与 LLM 对齐实现图文理解。
- Qwen-VL - 通义千问开源的视觉语言模型,支持图文对话与定位。
- Qwen2-VL - Qwen-VL 升级版,支持动态分辨率与长视频理解。
- InternVL - 上海AI实验室开源的通用视觉大模型系列,性能对标商用。
- CogVLM - 智谱开源的视觉语言模型,保持语言能力强的同时理解图像。
- MiniGPT-4 - 轻量视觉语言模型,用单投影层对齐视觉与 LLM。
- DeepSeek-VL - 深度求索开源的视觉语言模型,兼顾通用与对话。
- IDEFICS - HuggingFace 开源的图文模型,可遵循指令完成多模态任务。
- Llama 3.2 Vision - Meta 在 Llama 3.2 中推出的视觉版本,支持图像推理。
- Janus - 深度求索开源的统一多模态理解与生成模型。
- NExT-GPT - 开源任意到任意多模态大模型,统一处理文本/图像/音频/视频。
- Molmo - AI2 开源的开创性视觉语言模型,强调真实世界指向理解。
- Stable Diffusion - 经典开源文生图潜扩散模型,奠定 AIGC 图像基石。
- SDXL - Stability AI 开源的高分辨率文生图模型,画质大幅提升。
- ComfyUI - 基于节点工作流的开源文生图界面,灵活可复现。
- AUTOMATIC1111 - 最流行的 Stable Diffusion WebUI,插件生态庞大。
- Fooocus - 重体验的开源文生图工具,开箱即用的极简界面。
- FLUX - Black Forest Labs 开源的当代文生图模型,细节与提示词遵循强。
- ControlNet - 为扩散模型添加姿态/边缘/深度等可控条件的开源插件。
- Kandinsky - Sber AI 开源的文生图模型,采用潜在扩散与 CLIP。
- InvokeAI - 面向创作者的开源文生图平台,支持画布重绘。
- AuraFlow - fal.ai 开源的流匹配文生图模型,支持 LoRA 微调。
- PixArt-α - 高效开源文生图模型,以更低训练成本逼近 SDXL 画质。
- CogView - 智谱开源的的中文文生图模型系列。
- Open-Sora - 潞晨科技开源的视频生成项目,复现 Sora 思路并开放全套流程。
- CogVideoX - 智谱开源的视频生成模型,支持文生视频与图生视频。
- AnimateDiff - 将扩散模型扩展为动画的开源方案,让图片动起来。
- Stable Video Diffusion - Stability 开源的图生视频扩散模型。
- HunyuanVideo - 腾讯开源的大规模视频生成基础模型,画质与运动强。
- Mochi - Genmo 开源的视频生成模型,强调运动质量与提示遵循。
- Wan2.1 - 阿里万相开源的视频生成模型,支持多分辨率与图生视频。