可用模型总览
以下是平台当前接入的主要模型,具体可用情况以控制台「模型列表」为准。
TIP
使用 GET /v1/models 接口可获取当前令牌实际可用的模型列表。
对话 & 文本补全模型
OpenAI 系列
| 模型 ID | 上下文长度 | 视觉 | 函数调用 | 特点 |
|---|---|---|---|---|
gpt-4o | 128K | ✅ | ✅ | 旗舰多模态,速度与质量平衡 |
gpt-4o-mini | 128K | ✅ | ✅ | 轻量高速,适合高频低复杂度任务 |
o3 | 200K | ✅ | ✅ | 深度推理旗舰 |
o4-mini | 200K | ✅ | ✅ | 推理模型,性价比高 |
gpt-4.1 | 1M | ✅ | ✅ | 超长上下文,代码能力强 |
Anthropic Claude 系列
| 模型 ID | 上下文长度 | 视觉 | 函数调用 | 特点 |
|---|---|---|---|---|
claude-opus-4 | 200K | ✅ | ✅ | 顶级推理与写作能力 |
claude-sonnet-4 | 200K | ✅ | ✅ | 能力与速度均衡,主力推荐 |
claude-haiku-3-5 | 200K | ✅ | ✅ | 极速轻量,适合实时交互 |
Google Gemini 系列
| 模型 ID | 上下文长度 | 视觉 | 函数调用 | 特点 |
|---|---|---|---|---|
gemini-2.5-pro | 1M | ✅ | ✅ | 超长上下文,多模态旗舰 |
gemini-2.5-flash | 1M | ✅ | ✅ | 高性价比,速度极快 |
DeepSeek 系列
| 模型 ID | 上下文长度 | 视觉 | 函数调用 | 特点 |
|---|---|---|---|---|
deepseek-v3 | 64K | — | ✅ | 综合能力强,中文优化 |
deepseek-r1 | 64K | — | — | 深度推理,思维链输出 |
通义千问系列
| 模型 ID | 上下文长度 | 视觉 | 函数调用 | 特点 |
|---|---|---|---|---|
qwen-max | 32K | — | ✅ | 阿里云旗舰,中文最优 |
qwen-vl-max | 32K | ✅ | ✅ | 视觉理解专项 |
qwen-long | 1M | — | ✅ | 超长文档处理 |
向量化模型
| 模型 ID | 输出维度 | 特点 |
|---|---|---|
text-embedding-3-small | 1536 | 通用语义检索,性价比高 |
text-embedding-3-large | 3072 | 高精度语义理解 |
text-embedding-ada-002 | 1536 | 兼容旧项目 |
图像生成模型
| 模型 ID | 最大分辨率 | 特点 |
|---|---|---|
dall-e-3 | 1792×1024 | OpenAI 出品,质量稳定 |
gpt-image-1 | 1536×1024 | 新一代图像模型 |
flux-1-pro | 2048×2048 | 开源生态,细节丰富 |
stable-diffusion-3 | 1024×1024 | 社区生态 |
语音模型
| 模型 ID | 类型 | 特点 |
|---|---|---|
tts-1 | TTS | 标准质量,低延迟 |
tts-1-hd | TTS | 高清质量 |
whisper-1 | STT | 多语言识别,支持 99 种语言 |
视频生成模型
| 模型 ID | 最大时长 | 特点 |
|---|---|---|
sora-2 | 20s | OpenAI 出品,高质量 |
kling-v2 | 10s | 中文提示词优化,运动自然 |
wan-2.1 | 8s | 开源视频模型 |
模型更新说明
平台持续接入最新模型,上表仅供参考。以控制台「价格列表」中的实时数据为准。