AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 107 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
XLM-RoBERTa
Meta
开源 海外

Meta 的跨语言编码器,100 种语言预训练,支持零样本跨语言迁移,多语言 NLP 的常用底座。

参数:278M / 550M 👁 4
ELECTRA
Google
开源 海外

Google 通过鉴别器预训练的高效编码器,比 BERT 更省算力且效果更优。

参数:小/基础/大 👁 4
RoBERTa
Meta
开源 海外

BERT 的优化版本,采用更大的数据与动态掩码策略,在多个基准上显著超越 BERT。

参数:125M / 355M 👁 4
BERT
Google
开源 海外

Google 提出的双向预训练编码器,革命性提升 NLP 理解能力,是 Transformer 时代最重要的预训练模型之一。

参数:110M / 340M 👁 8
BART
Meta
开源 海外

Meta 提出的去噪自编码预训练模型,擅长摘要、翻译与生成任务,是序列到序列预训练的重要基础模型。

参数:140M / 400M 👁 4
T5
Google
开源 海外

Google 的文本到文本统一框架,把 NLP 任务统一为 text-to-text,是迁移学习与预训练时代的重要基础模型。

参数:60M / 220M / 770M / 3B / 11B 👁 4
MiMo
腾讯
开源 国内

腾讯混元团队开源的轻量 MoE 模型 MiMo,以低激活参数实现高效推理,面向开发者提供私有化与终端部署方案。

参数:MoE 架构(低激活) 上下文:32K 👁 3
Seed(字节开源)
字节跳动
开源 国内

字节跳动 Seed 团队自研语言模型,提供面向终端的轻量开源版本(Seed-LLM-8B/16B),强调低延迟与端侧部署能力。

参数:8B / 16B 上下文:32K 👁 4
CodeGeeX
智谱AI
开源 国内

智谱 AI 与清华联合推出的代码大模型,支持代码补全、解释、翻译,提供 IDE 插件与开源权重,是多语言代码生成领域国产代表。

参数:6B / 13B 上下文:8K 👁 4
GLM-Z1
智谱AI
开源 国内

智谱 AI 的开源推理模型,将 R1 级推理能力蒸馏至不同规模的 GLM 基础模型,兼顾推理质量与部署成本。

参数:开源(蒸馏 R1 的推理小模型) 上下文:64K 👁 4
GLM-4
智谱AI
开源 国内

智谱 AI 第四代开源大模型 GLM-4-9B,支持 128K 长上下文、函数调用与多语言,中文能力出色,可本地部署并配套智谱云 API。

参数:9B(开源版) 上下文:128K 👁 4
Qwen-Math
阿里巴巴
开源 国内

Qwen 团队专门针对数学推理训练的开源模型,基于 Qwen2 底座微调,在 GSM8K、MATH 等数学基准上达到一流水平。

参数:1.5B / 7B / 72B 上下文:32K 👁 4
QwQ-32B
阿里巴巴
开源 国内

阿里 Qwen 团队推出的开源推理模型,采用 MoE 架构仅激活 32 亿参数,在数学与代码推理上对标更大模型,能以极低成本本地部署。

参数:32B(MoE:32 亿激活) 上下文:128K 👁 4
Qwen(初代)
阿里巴巴
开源 国内

阿里云通义千问第一代开源大模型,提供 1.8B-72B 多尺寸版本,兼顾中文能力与可部署性,是国产开源模型早期代表。

参数:1.8B / 7B / 14B / 72B 上下文:32K 👁 4
DeepSeek-R1 蒸馏版
深度求索
开源 国内

DeepSeek R1 的知识蒸馏版本,把旗舰推理能力压缩进 1.5B-70B 的多种小模型,可离线部署至消费级硬件,是个人本地推理模型的标杆选择。

参数:1.5B / 7B / 8B / 14B / 32B / 70B 上下文:128K 👁 4
Gemma 2 27B
Google
开源 海外

Gemma 2 系列最大型号,270 亿参数,在多项基准上对标甚至超越更大闭源模型,是开源 SOTA 级别对话模型。

参数:27B 上下文:8K 👁 4
Gemma 2 9B
Google
开源 海外

Gemma 2 系列的中型开放权重模型,基于 Gemini 技术,9B 参数在推理与对话上表现优秀,支持多种推理框架本地部署。

参数:9B 上下文:8K 👁 5
Phi-3 Medium
Microsoft
开源 海外

Phi-3 系列的中型型号,140 亿参数,在复杂推理任务上表现优于同尺寸模型,MIT 协议开放,兼具性能与易部署性。

参数:14B 上下文:32K(可扩至 128K) 👁 4
Phi-3 Small
Microsoft
开源 海外

微软 Phi-3 系列的小型语言模型,7B 参数在高质量数据上训练,性能接近更大模型,MIT 协议开放,适合端侧与资源受限场景。

参数:7B 上下文:32K 👁 4
Granite
IBM
开源 海外

IBM 面向企业场景推出的开源大模型家族,从代码生成到文档回答均有覆盖,支持 128K 上下文,与 watsonx 平台深度集成。

参数:3B / 8B / 34B 上下文:128K 👁 4

共 107 个 AI 模型