千问多模态向量模型,支持文本、图像和视频输入,用于跨模态检索与相似度计算。
Qwen tokenizer (tiktoken-compat)千问多模态向量模型,支持文本、图像和视频输入,用于跨模态检索与相似度计算。
Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.
Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.
/v1/chat/completions| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
inputrequis | string | — | Texte ou tableau de textes à vectoriser |
dimensions | integer | >= 1 | Tronquer les vecteurs à autant de dimensions |
encoding_format | enum | = float | Encodage filaire pour les vecteurs |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.
Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .
Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.
| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
inputrequis | string | — | Texte ou tableau de textes à vectoriser |
dimensions | integer | >= 1 | Tronquer les vecteurs à autant de dimensions |
encoding_format | enum | = float | Encodage filaire pour les vecteurs |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
| Fournisseur | RPM | TPM | RPD |
|---|---|---|---|
| Alibaba | 7.8K | 1.6M | 157K |
| official | 9.7K | 1.9M | 195K |
RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.
千问多模态向量模型,支持文本、图像和视频输入,用于跨模态检索与相似度计算。
Créez une clé API autorisée à utiliser qwen3-vl-embedding, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.
Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.
Le catalogue indique une fenêtre de contexte de 32000 tokens. Vérifiez les limites du point de terminaison sélectionné.
Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.
