MaxxAI

MaxxAI MODEL SELECTION

按业务指标选模型,
不是追参数榜单

你的团队最终要为效果、速度、成本、数据边界和系统稳定性负责。先按业务用途筛选,再用真实样本比较候选模型,最后确认版本、接入方式和替换方案。

代表文本、图像、视频、语音、音乐与向量能力的六个模型模块
71个模型与版本
6类能力
18家模型厂商
71 个匹配结果
DeepSeek

DeepSeek V4 Pro

精选

通用文本、复杂任务与推理场景。

文本模型API咨询接入
Chat推理API
咨询此模型 ↗
DeepSeek

DeepSeek V4 Flash

面向高频、低延迟文本任务的轻量版本。

文本模型API咨询接入
Chat轻量API
咨询此模型 ↗
Z.ai

GLM-4.7

精选

通用对话、内容生成与企业知识场景。

文本模型API咨询接入
Chat中文API
咨询此模型 ↗
Z.ai

GLM-5.2

通用文本与复杂任务处理模型。

文本模型API咨询接入
Chat推理API
咨询此模型 ↗
Z.ai

GLM-5.1

支持不同上下文长度的企业文本任务。

文本模型API咨询接入
Chat长上下文API
咨询此模型 ↗
Z.ai

GLM-5 Turbo

兼顾响应速度与任务处理能力。

文本模型API咨询接入
Chat快速API
咨询此模型 ↗
Kimi

Kimi K2.6

精选

长文本理解、分析与通用对话。

文本模型API咨询接入
Chat长文本API
咨询此模型 ↗
Kimi

Kimi 2.7 Coding

面向代码生成与软件开发工作流。

文本模型API咨询接入
代码AgentAPI
咨询此模型 ↗
MiniMax

MiniMax M2.7

通用文本生成与企业应用集成。

文本模型API咨询接入
Chat中文API
咨询此模型 ↗
Qwen

Qwen 3.7 Plus

精选

通用对话、推理与企业工作流。

文本模型API咨询接入
Chat推理API
咨询此模型 ↗
Qwen

Qwen 3.7 Max

面向复杂任务与高质量文本生成。

文本模型API咨询接入
Chat复杂任务API
咨询此模型 ↗
Qwen

Qwen 3.6 Plus

稳定的通用文本与知识问答能力。

文本模型API咨询接入
Chat知识库API
咨询此模型 ↗
xAI

Grok 4

通用对话、推理与信息处理。

文本模型API咨询接入
Chat推理API
咨询此模型 ↗
xAI

Grok 4.1

面向复杂对话和任务执行。

文本模型API咨询接入
ChatAgentAPI
咨询此模型 ↗
xAI

Grok Code

代码生成、解释与开发辅助。

文本模型API咨询接入
代码开发API
咨询此模型 ↗
Doubao

Doubao Seed 1.8

通用中文文本与业务应用。

文本模型API咨询接入
Chat中文API
咨询此模型 ↗
Doubao

Doubao Seed 1.6

适合内容、问答与流程自动化。

文本模型API咨询接入
Chat工作流API
咨询此模型 ↗
OpenAI

GPT-5.5

精选

通用智能、推理与 Agent 场景。

文本模型API咨询接入
Chat推理Agent
咨询此模型 ↗
OpenAI

GPT-5.4 Mini

面向高频任务和轻量工作流。

文本模型API咨询接入
Chat轻量API
咨询此模型 ↗
OpenAI

GPT-5

文本生成、推理与企业自动化。

文本模型API咨询接入
Chat推理API
咨询此模型 ↗
OpenAI

GPT-4o

多模态交互和通用文本任务。

文本模型API咨询接入
多模态ChatAPI
咨询此模型 ↗
Google

Gemini 3.1 Pro

精选

长上下文、多模态与复杂任务。

文本模型API咨询接入
多模态长上下文API
咨询此模型 ↗
Google

Gemini 3 Flash

快速处理文本、图片与视频输入。

文本模型API咨询接入
多模态快速API
咨询此模型 ↗
Google

Gemini 2.5 Pro

复杂推理、多模态理解与企业应用。

文本模型API咨询接入
多模态推理API
咨询此模型 ↗
Google

Gemini 2.5 Flash

高频多模态任务与快速响应场景。

文本模型API咨询接入
多模态快速API
咨询此模型 ↗
Anthropic

Claude Opus 4.6

精选

复杂分析、写作与 Agent 工作流。

文本模型API咨询接入
Chat分析Agent
咨询此模型 ↗
Anthropic

Claude Sonnet 4.6

兼顾质量与效率的通用工作模型。

文本模型API咨询接入
Chat代码API
咨询此模型 ↗
Anthropic

Claude Opus 4.5

复杂知识工作和长文本处理。

文本模型API咨询接入
Chat长文本API
咨询此模型 ↗
Anthropic

Claude Sonnet 4.5

内容、开发与企业协作任务。

文本模型API咨询接入
Chat代码API
咨询此模型 ↗
Anthropic

Claude Haiku 4.5

适合快速响应和轻量文本任务。

文本模型API咨询接入
Chat轻量API
咨询此模型 ↗
OpenAI

OpenAI Image 2

精选

支持多档质量与多种分辨率的图像生成。

图像模型API咨询接入
文生图图生图1K–4K
咨询此模型 ↗
Google

Gemini Image 3.1

图像生成与高分辨率视觉内容制作。

图像模型API咨询接入
文生图图像编辑1K–4K
咨询此模型 ↗
Google

Gemini Image 3

适合营销、创意与产品视觉生成。

图像模型API咨询接入
文生图创意1K–4K
咨询此模型 ↗
Google

Gemini Image 2.5

图像生成、编辑与超分处理。

图像模型API咨询接入
文生图超分API
咨询此模型 ↗
Midjourney

Midjourney V7

精选

风格化创意视觉与高质量图像生成。

图像模型API咨询接入
文生图创意高质量
咨询此模型 ↗
Kling

Kling Image 3

支持多种图像生成和参考图场景。

图像模型API咨询接入
文生图参考图1K–4K
咨询此模型 ↗
Kling

Kling Image 2.1

文生图、单图及多图参考生成。

图像模型API咨询接入
文生图图生图多图参考
咨询此模型 ↗
Doubao

Seedream 4.5

中文场景下的图像生成与创意制作。

图像模型API咨询接入
文生图中文API
咨询此模型 ↗
Doubao

Seedream 4.0

适合内容、营销和产品视觉生成。

图像模型API咨询接入
文生图创意API
咨询此模型 ↗
PixVerse

PixVerse V6.0

精选

支持有声与无声视频生成。

视频模型API咨询接入
文生视频有声多分辨率
咨询此模型 ↗
PixVerse

PixVerse V5.6

多分辨率的通用视频生成模型。

视频模型API咨询接入
文生视频无声多分辨率
咨询此模型 ↗
PixVerse

PixVerse C1

支持有声及无声的视频内容生成。

视频模型API咨询接入
视频生成有声API
咨询此模型 ↗
Kling

Kling 3.0 Turbo

精选

面向快速视频生成与高频内容制作。

视频模型API咨询接入
视频生成快速多分辨率
咨询此模型 ↗
Kling

Kling 3.0 Omni

支持参考素材与多种音画组合。

视频模型API咨询接入
多模态参考生成有声
咨询此模型 ↗
Kling

Kling O1

支持无参考与参考视频生成流程。

视频模型API咨询接入
视频生成参考视频API
咨询此模型 ↗
Kling

Kling 2.6

通用视频生成,支持有声扩展。

视频模型API咨询接入
视频生成有声API
咨询此模型 ↗
Kling

Kling 2.1

成熟的通用视频生成版本。

视频模型API咨询接入
视频生成多分辨率API
咨询此模型 ↗
Vidu

Vidu Q3 Pro

精选

支持图生、文生与首尾帧生成。

视频模型API咨询接入
文生视频图生视频首尾帧
咨询此模型 ↗
Vidu

Vidu Q3 Turbo

适合快速图文和首尾帧视频生成。

视频模型API咨询接入
快速图生视频首尾帧
咨询此模型 ↗
Vidu

Vidu Q3

以参考素材驱动的视频生成。

视频模型API咨询接入
参考生成多分辨率API
咨询此模型 ↗
Vidu

Vidu Q3 Mix

支持混合参考素材的视频创作。

视频模型API咨询接入
参考生成混合输入API
咨询此模型 ↗
Vidu

Vidu Q3 Drama

面向剧情和参考素材的视频生成。

视频模型API咨询接入
剧情参考生成API
咨询此模型 ↗
Hailuo

Hailuo 2.3

通用视频生成与多分辨率输出。

视频模型API咨询接入
视频生成多分辨率API
咨询此模型 ↗
Hailuo

Hailuo 2.3 Fast

适合快速预览和高频生成任务。

视频模型API咨询接入
视频生成快速API
咨询此模型 ↗
Doubao

Seedance 2.0

精选

面向中文内容与创意视频工作流。

视频模型API咨询接入
视频生成中文API
咨询此模型 ↗
Doubao

Seedance 1.5

通用视频内容生成与业务接入。

视频模型API咨询接入
视频生成中文API
咨询此模型 ↗
Google

Veo 3.1

精选

高质量视频生成与多模态创作。

视频模型API咨询接入
视频生成多模态API
咨询此模型 ↗
Google

Veo 3.0

面向营销、创意与影视内容生成。

视频模型API咨询接入
视频生成创意API
咨询此模型 ↗
OpenAI

Sora 2

文本驱动的视频创作与内容生成。

视频模型API咨询接入
文生视频创意API
咨询此模型 ↗
OpenAI

GPT-4o Realtime

精选

低延迟实时语音交互与对话。

语音模型API咨询接入
实时语音对话API
咨询此模型 ↗
OpenAI

Whisper

多语言语音识别与转写。

语音模型API咨询接入
ASR转写多语言
咨询此模型 ↗
OpenAI

OpenAI TTS

面向应用集成的文本转语音能力。

语音模型API咨询接入
TTS语音合成API
咨询此模型 ↗
Microsoft

Azure TTS

多语言文本转语音与企业集成。

语音模型API咨询接入
TTS多语言企业
咨询此模型 ↗
ElevenLabs

ElevenLabs TTS

精选

自然语音合成与内容配音。

语音模型API咨询接入
TTS配音API
咨询此模型 ↗
Doubao

Doubao TTS

中文语音合成与业务应用。

语音模型API咨询接入
TTS中文API
咨询此模型 ↗
MiniMax

MiniMax T2A HD

高质量文本转语音与内容配音。

语音模型API咨询接入
TTS高清中文
咨询此模型 ↗
MiniMax

MiniMax T2A Turbo

适合快速语音生成与高频调用。

语音模型API咨询接入
TTS快速API
咨询此模型 ↗
Mureka

Mureka O2

精选

AI 音乐生成与创意音频制作。

音乐模型API咨询接入
音乐生成创意API
咨询此模型 ↗
Mureka

Mureka V7.6

歌曲与音乐内容生成。

音乐模型API咨询接入
音乐生成歌曲API
咨询此模型 ↗
Mureka

Mureka V7.5 Generate

面向内容生产的音乐生成版本。

音乐模型API咨询接入
音乐生成内容API
咨询此模型 ↗
Microsoft

Embedding 3

精选

知识库检索、语义搜索与 RAG 场景。

嵌入模型API咨询接入
EmbeddingRAG检索
咨询此模型 ↗
目录说明

这里是候选模型目录,不代表采购建议。最终版本、成本、数据处理方式和接入方案,以真实样本测试及项目确认为准。

MaxxAI MODEL SELECTION

先写清业务指标,
再做模型和供应商决定。

告诉我们输入、预期输出、质量基线、响应时间、调用量、敏感数据边界和现有系统。我们会据此选择候选模型,并留下可解释的测试结果。

发起企业模型选型 ↗

CONTACT MAXXAI

微信扫码联系 MaxxAI

添加后请简单说明公司、岗位和想解决的业务问题,我们会尽快回复。

MaxxAI 微信联系二维码
请使用微信扫码添加