AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
Meta Llama 4 系列中的超长上下文模型,17B 激活/109B 总参数 MoE,原生多模态,10M token 上下文,Int4 量化可单卡 H100 运行。
面壁智能全能端侧多模态模型,8B 支持文本/视觉/音频/语音全模态,端侧跑通,Apache-2.0,是国产端侧多模态的代表。
书生开源视觉多模态模型 InternVL 2.5,覆盖 1B~78B 全尺寸,MIT 许可,图文理解与 OCR 能力领先开源阵营。
书生浦语 InternLM3 思考版,原生思维链推理,1M 长上下文,工具调用强,中文开源模型的代表性新作之一。
微软 Phi 系列新一代 Phi-5,小模型高数据质量路线延续,14B 级别推理与编码能力追赶大模型,MIT 开源。
微软 Phi-4 系列的小尺寸版本,3.8B/14B 参数,MIT 开源,端侧可跑,推理与数学能力超出同体积模型。
Google 面向端侧优化的 Gemma 3N 系列,1B/4B 极小体积骁龙级端侧可跑,专为手机与边缘设备设计的原生多模态。
Google Gemma 3 的最大开源模型,27B 参数支持多模态,128K 上下文,中文有所提升,是开源多模态小模型的高性能选择。
智谱面对开发者开放的中等规模开源模型,32B 参数能力均衡,128K 上下文,量化后单卡可跑,是中文开源基座的热门选择。
阿里 Qwen3 代码专用模型,Agentic 编码能力大幅提升,256K 上下文可处理大仓库,Apache-2.0 开源,是开源编码模型的顶流之一。
阿里开源 Qwen3 系列视觉语言模型,原生多模态理解,8B 量化后单卡可跑,OCR 与文档理解能力突出,Apache-2.0 可自由商用。
腾讯开源旗舰 MoE 模型 MiMo V2.5,1M 上下文、深度思考,性能接近开源顶尖,是腾讯在开源大模型领域的主力布局。
Mistral 开源的代码生成模型,支持 80+ 编程语言,256K 上下文可处理整个代码库,兼容 Fill-in-the-Middle 补全格式,适合接入 IDE。
AI21 开源的 Jamba 混合架构(SSM + Transformer + MoE),256K 上下文,内存效率高,Apache-2.0 可商用。
LG 旗下 EXAONE 开源中大型模型,支持韩英双语,32B 性能对标主流开源,企业场景设计。
NVIDIA 开源 Nemotron 系列,70B 指令模型,RLHF 对齐成本低,面向企业自训与合成数据。
Codestral 开源代码模型,22B 参数,专注代码补全与生成,MNPL 许可限制商业用途,与 CODESTRAL 工具链配套。
HuggingFace 开源超小模型 SmolLM,最小到 135M,面向手机与嵌入式,教学与端侧 demo 友好。
Apple 开源的小语言模型 OpenELM,端侧目标导向,全尺寸权重公开,是苹果入局的端侧代表。
智谱开源 GLM-4-Air,9B 尺寸轻量高效,128K 上下文,MIT 商用自由,性价比高的国产开源选择。
共 107 个 AI 模型
Aitishiku.com