AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
智谱开源 GLM-4-9B,综合能力对标主流开源,128K 上下文,中文优秀且 MIT 免费商用,是国产开源新标杆之一。
百川智能的新一代基座大模型,医疗场景专项优化(Baichuan-3 药学),部分权重开放,商业化走闭源 API。
百川智能开源的 Baichuan 2 模型,中文与数学能力突出,7B/13B 尺寸适合中文本地部署。
阿里开源 Qwen2 系列,多尺寸覆盖 MoE/密集,中文与代码能力强,Apache-2.0 免费商用,2.5 的前代主力。
DeepSeek 开源数学推理模型,基于 7B,在竞赛数学与 K12 题目上表现突出,专攻推理与符号计算。
DeepSeek-V2 以 MLA(多头潜在注意力)架构开源,MoE 高效推理、中文优秀,训练成本极具竞争力,V3 的前身。
Mistral 与 NVIDIA 合作开源的 12B 模型,128K 上下文,多语言能力强(含中文改善),Apache-2.0 可用,端侧友好。
Mistral 开源的 7B 轻量模型,小参数量却有出色指令跟随,Apache-2.0 商用自由,是边缘部署经典。
Mistral 开源的大规模 MoE 模型,总参 141B 仅激活 39B,推理效率与性能兼备,Apache-2.0 可商用,多语言好。
Meta 第二代入门开源模型,开创商业免费许可,是全球开源热潮的起点,如今仍是学习与轻量部署参考。
Meta 开源的代表端侧与多模态的 Llama 3.2,1B/3B 面向移动端,11B/90B 新增视觉理解,指令遵循强。
Stable Video 3D 从单张图生成 3D 环绕视频(novel view synthesis),为 3D 重建与摄影测量提供素材。
Stability 开源 SD3.5,MMDiT 架构,文字渲染与多主题理解大幅提升,2B/8B 覆盖不同显存档位。
Stable Diffusion 1.5 是史上最流行的开源文生图模型,海量 LoRA 与模型生态,至今仍是社区主力。
阿里开源全模态模型 Qwen2.5-Omni,文本、图像、音频、视频实时理解与生成,端侧可跑,Apache-2.0 商用。
Stability 开源 Stable Fast 3D,单张图片 0.5 秒生成 3D 模型,快速高质量,本地可跑。
阿里开源文生图模型 Qwen-Image,20B MoE,中文理解与高质量写实出图,支持多图与编辑,国产开源强将。
Google 开源 PaliGemma,基于 Gemma 的视觉语言模型,3B 轻量,支持图文问答、检测与分割,端侧友好。
微软 Florence-2 统一视觉模型,用文本指令完成检测、分割、描述、OCR 等任务,小体积高效,MIT 商用。
智谱开源 CogVLM 视觉语言模型,17B 参数在视觉问答与理解上表现优秀,中文图文理解强。
共 444 个 AI 模型
Aitishiku.com