模型百科
ChatGPT GPT-5.5
文本
OpenAI 出品的对话大模型,全球用户最多的 AI,什么都能聊,新手首选
Gemini Gemini 3.1 Pro
文本
Google 的多模态大模型,深度整合搜索与安卓生态,第二大门户
豆包 Seed 2.0
文本
字节跳动出品,国内月活第一的 AI 对话应用,免费额度大
Claude Claude Opus 4.5
文本
Anthropic 出品,代码与长文写作公认最强之一,企业付费转化率最高
DeepSeek V4 Pro
文本
深度求索出品,国产开源之光,性价比之王,推理能力比肩顶尖
腾讯元宝 混元
腾讯出品,微信生态里一键直达的 AI 助手,用户增长最快之一
Kimi K2.6 Thinking
月之暗面出品,超长上下文处理王,读长文档/长网页最强
通义千问 Qwen3.7 Max
文本
阿里出品,开源权重领先,开发者自部署首选
智谱清言 GLM-5
智谱 AI 出品,国产老牌对话模型,中文理解扎实
Grok Grok 4
文本
xAI 出品,深度整合 X(推特) 平台,实时信息能力突出
Perplexity Sonar
文本
AI 搜索引擎,每条回答附来源引用,调研查证利器
即梦 AI Seedream 5.0
图像
字节跳动出品,国产生图综合第一,中文理解最强、文字不乱、国内直连
Midjourney V8
图像
艺术审美天花板,光影构图最强,封面/海报/氛围图首选
Flux Flux 2 Pro
图像
开源写实派代表,真实感强、可控性好、能本地部署
可灵 AI Kolors 2.0
快手出品,免费生图天花板,中国风理解好,视频也强
Nano Banana Nano Banana 2
图像
Google 出品的写实人像神器,照片级真实感、改图精准
GPT Image DALL-E 4
图像
OpenAI 生图,ChatGPT 内直接用,提示词理解准、易上手
可灵 Kling 2.0
快手出品,国内视频生成第一梯队,最长可生成 2 分钟+
豆包视频 Seedance 2.0
视频
字节跳动出品,已接入豆包 App 免费使用,30 秒视频直接生成
Sora Sora 2
视频
OpenAI 出品的视频生成模型,真实感与运镜标杆(概念级)
Runway Gen-4
视频
专业级 AI 视频工具,文生视频/图生视频/视频编辑一体
Pika Pika 2.0
视频
轻量视频生成,实时编辑与风格迁移是亮点,上手快
剪映数字人 剪映语音合成
语音
剪映内置的数字人播报与语音合成,做口播视频零门槛
ElevenLabs v3 多语言
全球顶级 AI 语音合成,音色真实自然、多语言支持
豆包语音 豆包 TTS
语音
火山引擎(字节)出品,豆包/即梦内置配音,中文音色多、免费额度大
阿里云语音合成 CosyVoice / 通义
阿里通义实验室出品,CosyVoice 3.0 开源,中文 TTS 工业部署事实标准
通义 Qwen3-TTS Qwen3-TTS 1.7B
语音
阿里 Qwen 团队开源语音大模型,中文综合最强、3 秒克隆、97ms 低延迟
GPT-SoVITS v4
开源中文 TTS 榜首(59k star),1 分钟音频即可微调出专属音色
ChatTTS 2B
开源对话式 TTS(39k star),口语化最自然,带笑声/停顿/语气
Fish Audio Fish Speech S2
语音
开源多语种 TTS,覆盖 80+ 语言,情绪控制细腻,云端 API 可选
微软语音 VibeVoice / Edge TTS
微软开源语音 AI(VibeVoice 7B)+ Edge 浏览器免费朗读,长音频强
Kokoro 82M
超轻量开源 TTS(82M 参数),CPU 就能跑,边缘设备首选
MiniMax 语音 海螺 TTS
MiniMax 出品,海螺 App 内置,中文配音自然、情感丰富
VoxCPM2 2B
面壁智能+清华开源语音基础模型,48kHz 高保真,音色可凭空设计
IndexTTS2 B站开源
B 站开源的工业级零样本 TTS,中文音色还原度高
Stable Diffusion SD 3.5 / SDXL
图像
开源生图之王,完全本地部署,LoRA/ControlNet 生态最强,免费无限生成
通义万相 Wanx
图像
阿里出品,免费不限次,中国风/工笔/水墨效果最好
文心一格 文心一格
图像
百度出品,商务/海报风格稳,国内备案最齐全
Ideogram Ideogram 3
图像
文字渲染天花板,海报/Logo/带字图片最强
Recraft Recraft V3
图像
AI 矢量图生成,Logo/插画可输出 SVG 矢量,商用友好
Leonardo AI Phoenix
图像
游戏资产/概念图专业户,免费 token 多,ControlNet 集成
Adobe Firefly Firefly 4
Adobe 出品,训练素材全授权,商用最安全,Photoshop 深度集成
Imagen 4 Google Imagen 4
图像
Google 摄影级生图,人像/细节/光影顶级,提示词遵循性好
Vidu Vidu Q3
视频
生数科技(清华系)出品,10 秒出片、动漫特化、角色一致性强
海螺 AI Hailuo 2.3
MiniMax 出品,首尾帧控制好、低硬件门槛,社交媒体短视频顺手
智谱清影 CogVideoX
智谱 AI 出品,4K/60fps 高清输出,开源可本地部署
PixVerse PixVerse V4.5
视频
AI 动漫/风格化视频强,多镜头批量生成,二次元特化
Luma Dream Machine Luma Ray 3
视频
Luma 出品,轻量快捷的 AI 视频,上手简单、社区大
Google Veo Veo 3.1
Google DeepMind 旗舰视频模型,原生生成音画同步
腾讯混元视频 HunyuanVideo
视频
腾讯出品,最长 16 秒,开源可部署,微信生态联动
阿里 Wan 视频 Wan 2.6
视频
阿里开源视频模型,能本地跑(8GB 显存起),首个渲染中英文字的视频模型
Midjourney Video MJ Video
视频
Midjourney 2026 新增视频模型,静态图转 5 秒动态,画质延续艺术感
Llama Llama 4 Scout
文本
Meta 开源旗舰,10M 超长上下文无敌,全生态支持最好,本地部署首选
Mistral Mistral Small 3.1
文本
欧洲开源代表,Apache-2.0 商业友好,效率与参数量比极佳
Gemma Gemma 3 27B
文本
Google 开源系列,小模型性价比之王,单张消费级显卡就能跑
Phi Phi-4 14B
文本
微软开源小模型,14B 推理能力惊人,笔记本级轻量选择
MiniCPM MiniCPM 4.5
文本
面壁智能开源,边缘设备大模型,手机都能跑的端侧智能
Kimi K2 K2.6
文本
月之暗面开源版,智能体/工具调用能力最强,超长上下文
gpt-oss gpt-oss-120b
文本
OpenAI 首次开源(GPT-2 以来),Apache-2.0,推理与代码能力强
InternLM InternLM 3
文本
上海 AI 实验室开源,中文长文本与工具调用扎实
Devstral Devstral 3
文本
Mistral 开源编程特化模型,本地 Agent 写代码最优解之一
Ollama Ollama
文本
本地跑大模型的一键工具,一条命令拉取并运行任意开源模型
LM Studio LM Studio
图形化本地模型运行器,点两下就能跑开源模型,无需命令行
vLLM vLLM
文本
生产级推理引擎,高并发大模型服务,吞吐量行业标准
llama.cpp llama.cpp
文本
C++ 版模型推理,CPU 就能跑,量化后低配机器可用
DeepFloyd IF IF
图像
深度求索系开源文生图,文字渲染准,多阶段生成
HunyuanVideo 开源 混元开源版
视频
腾讯混元开源版,本地部署免费无限生成,社区微调多