对比主流 LLM、图像、视频与音频模型的能力与定价,先体验再选择。
OpenAI
OpenAI 多模态旗舰模型,支持视觉、音频与快速文本推理。
Anthropic
顶级推理、编程与长上下文分析能力。
Google
超长上下文窗口,多模态推理能力强。
Meta
开源前沿模型,可自建部署。
DeepSeek
高性价比的推理与编程模型。
Midjourney
顶级的艺术风格图像生成。
Black Forest Labs
开源图像模型,提示词还原度高。
Stability AI
开源图像模型,微调生态丰富。
文生视频,长镜头连贯自然。
高保真视频生成,自带音频。
Kuaishou
运动逼真,支持长视频生成。
ElevenLabs
超逼真的文字转语音与声音克隆。
更新时间:2026-07
定价与能力变动频繁,仅供参考,请以官方信息为准。