AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 132 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
Vidu(生数科技)
生数科技
多模态 国内

生数科技出品的国产视频生成大模型 Vidu,对标 Sora,支持文生视频、图生视频与多主体一致性,画面质量高。

参数:闭源(未公开) 上下文:文生视频 👁 2
Pika(文生视频)
Pika Labs
多模态 海外

Pika 以爆款视频特效工具起家,支持文本/图片生成视频,画质与动态感在线,后发布 Pika 2 强化创意控制。

参数:闭源(未公开) 上下文:文生视频 👁 3
Runway Gen-3
Runway
多模态 海外

Runway 的视频生成模型 Gen-3 Alpha,好莱坞背景团队,运动与镜头语言出色,支持文生视频、图生视频与运动笔刷。

参数:闭源(未公开) 上下文:文生视频 👁 2
Sora(文生视频)
OpenAI
多模态 海外

OpenAI 的文本生成视频模型,可生成最长数十秒的连贯视频,支持镜头控制与续写,物理与语义理解能力强。

参数:闭源(未公开) 上下文:文生视频 👁 2
Imagen(文生图)
Google
多模态 海外

Google 的高质量文生图模型,照片级写实、文字渲染与细节优秀,深度整合 Gemini 生态,在 Vertex AI 提供 API。

参数:闭源(未公开) 上下文:文生图 👁 4
Google Veo(视频生成)
Google
多模态 海外

Google 的视频生成大模型,文本/图片生成高质量视频,支持原生音频,动作与光影真实自然,在 Gemini 生态中提供(Veo 3)。

参数:闭源(未公开) 上下文:文生视频 / 图生视频 👁 4
ElevenLabs(语音克隆)
ElevenLabs
多模态 海外

AI 语音合成与声音克隆平台,声音自然度、情感表现业界顶级,支持多语种、实时语音与个性化音色,免费层有限额,专业级 TTS 首选之一。

参数:闭源(未公开) 上下文:语音合成 / 克隆 👁 2
Suno(音乐生成)
Suno, Inc.
多模态 海外

文本一键生成完整歌曲的 AI 音乐平台,可指定风格、歌词与音色,生成带人声的高质量歌曲,免费层有限额,付费解锁商用与更多时长。

参数:闭源(未公开) 上下文:文本生成音乐 👁 2
Hailuo 海螺(视频)
MiniMax
多模态 国内

MiniMax 打造的「海螺 AI」视频生成,文本/图片生成流畅自然的视频,多语种能力好,网页端可直接使用,也有开放平台 API。

参数:闭源(未公开) 上下文:文生视频 · 图生视频 👁 2
Kling 可灵
快手
多模态 国内

快手推出的视频生成大模型,文本/图片生成高清视频,人物动作自然,国内可直连使用,是国产视频生成的代表作之一。

参数:闭源(未公开) 上下文:文生视频 · 图生视频 👁 4
Midjourney
Midjourney, Inc.
多模态 海外

最受设计师欢迎的文生图工具,以艺术感、氛围与风格把控著称,通过 Discord 使用,付费订阅制,图像质量与美学水准业界标杆。

参数:闭源(未公开) 上下文:文生图 / 图生图 👁 2
DALL·E 3
OpenAI
多模态 海外

OpenAI 的文生图模型,以精准的提示词理解与文字渲染著称,与 ChatGPT 深度整合,可通过 API 生成高质量图像,闭源按张计费。

参数:闭源(未公开) 上下文:1024×1024(生成尺寸) 👁 2

共 132 个 AI 模型