qwen3-tts-vd-realtime-2026-01-15千问3实时文本转语音模型,通过 WebSocket 发送文本并接收音频。 能力包括声音设计。
标准化评测得分。百分比越高越好,并展示排名百分位。
指标来源:Artificial Analysis 2026-09-30·Qwen3 Tts Vd Realtime 2026 01.15
当前基准快照不包含此模型。
缺失的模型或测量值不代表零分。
基准图表保留来源中的模型选择和思考设置。缺失的模型或测量值不代表零分,基准成本或速度也不是本站的服务承诺。
千问3实时文本转语音模型,通过 WebSocket 发送文本并接收音频。 能力包括声音设计。
北京地域基准价:1 元 / 万计费字符;输出音频不另收费。按供应商返回的计费字符数结算。字符数不等于文本长度或 Token 数,汉字通常计 2 个字符,SSML 标签不计入。
系统内部价格以美元保存,本次按 1 美元 = 6.8 元换算;最终费用应用账户分组倍率。供应商账号免费额度和活动优惠不计入该基准价。
请求中的 model 使用 qwen3-tts-vd-realtime-2026-01-15,具体音色和参数请参考该模型文档。
/api-ws/v1/realtime?model={model}建立 WebSocket 后按文档发送会话设置、文本追加及结束事件;模型专用音色须与该模型和渠道账号匹配。
所有请求必须携带 Authorization: Bearer <TOKEN> 请求头。Anthropic 格式的端点也接受 x-api-key 请求头。
在「令牌」页面生成 API Key,可以按模型、分组、IP、速率等维度精细化授权。
| 供应商 | RPM | TPM | RPD |
|---|---|---|---|
| Alibaba | 无限制 | 无限制 | 无限制 |
无限制
千问3实时文本转语音模型,通过 WebSocket 发送文本并接收音频。 能力包括声音设计。
创建具有 qwen3-tts-vd-realtime-2026-01-15 访问权限的 API 密钥,然后使用 API 接入模块中的准确模型 ID 和受支持的接口。请求字段取决于所选接口。
费用取决于所选供应商分组和模型计费单位。注册前即可在本页查看当前输入、输出、单次请求或媒体价格。
请先参考本页的使用场景与提示词指南,再使用项目中的代表性输入评估模型。
