跳到主要内容

EVA Gateway 模型列表

EVA Gateway 通过统一的 OpenAI Compatible API 提供大语言模型(LLM)、语音识别(ASR)和语音合成(TTS)能力。

使用说明

  • 请求中的 model 必须使用表格里的模型名称,包括厂商前缀、连字符和版本号。
  • LLM 使用 /llm/v1 接口前缀;ASR 和 TTS 使用 /v1 接口前缀。调用方法参阅 EVA Gateway 接入文档

LLM

Chat Completions(/llm/v1/chat/completions

模型 ID上下文长度temperature最大输出长度 max_completion_tokens(包含模型回答与思考链)思考模式开关推理模式
aliyun-qwen3.6-flash1M tokens[0, 2);默认值思考模式 0.6、非思考模式 0.7[1, 65536];默认值动态变化enable_thinking: true/false;默认 false(非思考)-
aliyun-qwen3.7-plus1M tokens[0, 2);默认值思考模式 0.6、非思考模式 0.7[1, 131072];默认值动态变化enable_thinking: true/false;默认 false(非思考)-
volcengine-doubao-seed-2.0-mini256K tokens[0, 2];默认 1.0[1, 65536]thinking.type: enabled/disabled;默认 disabled(非思考)常规
volcengine-doubao-seed-2.0-mini-fast256K tokens[0, 2];默认 1.0[1, 65536]thinking.type: enabled/disabled;默认 disabled(非思考)低延迟
volcengine-doubao-seed-2.0-lite256K tokens[0, 2];默认 1.0[1, 65536]thinking.type: enabled/disabled;默认 disabled(非思考)常规
volcengine-doubao-seed-2.0-lite-fast256K tokens[0, 2];默认 1.0[1, 65536]thinking.type: enabled/disabled;默认 disabled(非思考)低延迟
volcengine-doubao-seed-2.1-pro256K tokens[0, 2];默认 1.0[1, 65536]thinking.type: enabled/disabled;默认 disabled(非思考)常规

-fast 模型与其他豆包模型的上下文长度、参数范围完全相同,区别在于启用了低延迟模式

Responses(/llm/v1/responses

模型 ID上下文长度temperature最大输出长度 max_output_tokens思考模式开关推理模式
aliyun-qwen3.6-flash1M tokens[0, 2);默认值思考模式 0.6、非思考模式 0.7模型回复内容的最大Token数;[16, 65536]enable_thinking: true/false;默认 false(非思考)-
aliyun-qwen3.7-plus1M tokens[0, 2);默认值思考模式 0.6、非思考模式 0.7模型回复内容的最大Token数;[16, 131072]enable_thinking: true/false;默认 false(非思考)-
volcengine-doubao-seed-2.0-mini256K tokens[0, 2];默认 1.0包含模型回答与思维链内容;[1, 65536];默认 32768thinking.type: enabled/disabled;默认 disabled(非思考)常规
volcengine-doubao-seed-2.0-mini-fast256K tokens[0, 2];默认 1.0包含模型回答与思维链内容;[1, 65536];默认 32768thinking.type: enabled/disabled;默认 disabled(非思考)低延迟
volcengine-doubao-seed-2.0-lite256K tokens[0, 2];默认 1.0包含模型回答与思维链内容;[1, 65536];默认 32768thinking.type: enabled/disabled;默认 disabled(非思考)常规
volcengine-doubao-seed-2.0-lite-fast256K tokens[0, 2];默认 1.0包含模型回答与思维链内容;[1, 65536];默认 32768thinking.type: enabled/disabled;默认 disabled(非思考)低延迟
volcengine-doubao-seed-2.1-pro256K tokens[0, 2];默认 1.0包含模型回答与思维链内容;[1, 65536];默认 32768thinking.type: enabled/disabled;默认 disabled(非思考)常规

ASR

模型 ID支持协议audio_formatsample_rate(Hz)热词stream=trueturn_detection(仅websocket模型)输入限制支持语言
ark-asr-flashHTTPpcmwav16000支持增量文本不适用不超过 30 秒多语种
ark-asr-plusHTTPpcmwav16000支持增量文本不适用不超过 30 秒多语种
aliyun-fun-asr-realtimeHTTP、WebSocketpcmwavmp3opusspeexaacamr800016000暂不支持全量文本server_vad不超过 20 MB;单声道多语种及方言
tencentcloud-16k-zh-enHTTPwavpcmogg-opusspeexsilkmp3m4aaacamr800016000支持不支持流式不适用Gateway 上传上限 20 MB中文、英文、粤语及 9 种中文方言
volcengine-bigmodelHTTP、WebSocketpcmwavoggmp316000支持全量文本server_vad不超过 20 MB;默认单声道中文、英文及 8 种中文方言
zhipu-glm-asr-2512HTTPwavmp3无要求支持增量文本不适用不超过 30 秒,Gateway 上传上限 20 MB中文(含主要方言)、英语及数十种其他语言

TTS

模型 ID支持语言输入限制音色response_formatsample_rate(Hz)speedpitch_rate
ark-tts-flash中文、英文等 10 种语言不超过 300 个字符默认 en_female_iris音色列表pcm;默认 pcm44100;默认 44100不支持,不传不支持,不传
ark-tts-plus中文、英文不超过 300 个字符默认 en_female_iris音色列表pcm;默认 pcm44100;默认 44100不支持,不传不支持,不传
aliyun-cosyvoice-v3-flash中文(普通话)、英文不超过 20000 个字符默认 longanyang音色列表pcmwavmp3;默认 pcm80001600022050240004410048000;默认 16000[0.5, 2.0];默认 1.0[0.5, 2.0];默认 1.0
aliyun-cosyvoice-v3-plus中文(普通话)、英文不超过 20000 个字符默认 longanyang音色列表pcmwavmp3;默认 pcm80001600022050240004410048000;默认 16000[0.5, 2.0];默认 1.0[0.5, 2.0];默认 1.0
minimax-speech-2.8-hd多语种不超过 10000 个字符默认 male-qn-qingse音色列表pcmmp3wavflac;默认 pcm80001600022050240003200044100;默认 32000[0.5, 2.0];默认 1.0不支持,不传
minimax-speech-2.8-turbo多语种不超过 10000 个字符默认 male-qn-qingse音色列表pcmmp3wavflac;默认 pcm80001600022050240003200044100;默认 32000[0.5, 2.0];默认 1.0不支持,不传
tencentcloud-tts中文、英文中文不超过 600 字;英文不超过 1800 字母默认 402000音色列表pcmmp3;默认 pcm800016000;默认 16000[-2, 6];默认 0不支持,不传
volcengine-seed-tts-2.0中文、英文不超过 300 个字符默认 zh_female_vv_uranus_bigtts音色列表pcm;默认 pcm8000160002205024000320004410048000;默认 24000[-50, 100];默认 0[-12, 12];默认 0
zhipu-glm-tts中文、英文不超过 1024 个字符默认 tongtong;可选 tongtongchuichuixiaochenjamkazidoujiluodo官方文档pcm;默认 pcm24000;默认 24000[0.5, 2.0];默认 1.0不支持,不传