AI开源
L
LMDeploy
书生·浦语开源的LLM压缩与部署工具箱,TurboMind引擎高吞吐推理,支持量化、服务化部署。
S
SGLang
斯坦福/UC伯克利开源的LLM推理框架,采用RadixAttention前缀缓存,实现高吞吐、低成本的大模型服务。
O
OpenLLM
BentoML开源的LLM部署平台,一条命令将Llama、Qwen等模型部署为服务,支持微调、量化与云端发布。
M
MLC-LLM
开源通用LLM部署引擎,支持在Web、iOS、Android、GPU等全平台原生运行大模型,端侧AI利器。
K
KoboldCpp
一键式本地LLM运行工具,整合llama.cpp与Stable Diffusion,支持角色扮演、AI小说与API调用。
D
DeepSpeed
微软开源的大模型训练优化库,ZeRO技术实现万亿参数训练,推理优化兼顾性能与成本。
T
Triton Inference Server
NVIDIA开源的生产级推理服务器,支持多框架、多模型、动态批处理,GPU推理标准方案。
Y
Yi
零一万物开源的双语大模型,6B/34B规格,中英文能力均衡,以高训练质量著称。
D
DeepSeek-VL
深度求索开源的视觉语言大模型,采用创新MoE架构,在中文与英文视觉理解任务上表现出色,开源权重可商用。
M
MiniGPT-4
视觉语言助手开源项目,仅需一个线性投影层即可将冻结的视觉编码器与LLM对齐,实现图文对话、图片描述等能力。
Q
Qwen2-VL
通义千问2代多模态视觉语言模型,在图像/视频/多语言理解上全面升级,支持超高分辨率与视频理解,开源旗舰级视觉模型。
Q
Qwen-VL
阿里通义千问开源的多模态视觉语言模型,支持图片理解、视觉问答、OCR识别与图文对话,与Qwen语言模型无缝衔接。
L
LLaVA
开源视觉指令微调多模态模型,将视觉编码器与LLM结合,支持图文对话,多模态研究基石。
I
InternLM
上海AI实验室开源的书生·浦语大模型,覆盖1.8B-123B,工具调用与中文能力强,国产大模型代表。
F
Falcon
TII开源的大模型,180B参数训练自RefinedWeb高质量数据集,性能曾登顶开源榜首。
G
Gemma
Google DeepMind开源的轻量级大模型,2B/7B规格,基于Gemini技术,安全可靠适合端侧部署。
D
DeepSeek-LLM
深度求索开源的大语言模型,中文能力突出,高性价比训练,系列演进至V3/R1等旗舰模型。
Q
Qwen2.5
阿里通义千问2.5代开源模型,128K超长上下文,编程数学能力全面升级,支持100+语言。
Q
Qwen
阿里通义千问开源大模型系列,覆盖0.5B-72B多规格,中英双语强,开源中文大模型代表。
M
Mixtral 8x7B
Mistral AI开源的稀疏MoE大模型,8个专家子模型组合,470亿参数媲美Llama 2 70B,推理成本大幅降低。