BaiLian

qwen3.8-flash

AlibabaBasé sur les jetons

Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。

textimagevideofunction_callingtoolsstructured_outputjson_modeweb_searchcachingvisionreasoningcontext:1000000
Tarif à partir de
Entree / Sortie · 1M
Contexte
1M
Fenêtre d'entrée maximale
Sortie max
131.1K
Nombre maximal de jetons par réponse
Modalités
→

Tarification par fournisseur

official
官方接口直连
Entree$0.12/ 1M
Sortie$0.4/ 1M
Lecture du cache$0.015/ 1M

Capacités / Modalités prises en charge

Appel de fonctionOutilsSortie structuréeMode JSONRecherche webCache d'invitesVisionRaisonnement
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
Alibaba (Qwen)Documents
Tokeniseur
Qwen tokenizer (tiktoken-compat)
Licence
Tongyi Qianwen LicensePoids ouverts
Rétention des données5 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de qwen3.8-flash

Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Rédigez et révisez des textes avec un public, un ton et un format clairement définis.
  • Résumez les documents fournis et comparez les réponses aux sources originales.

Conseils pratiques

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.

Exemple de prompt

Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
official810322K16K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur qwen3.8-flash

Qu’est-ce que qwen3.8-flash ?

Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。

Comment appeler qwen3.8-flash ?

Créez une clé API autorisée à utiliser qwen3.8-flash, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment qwen3.8-flash est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Quelle est la fenêtre de contexte de qwen3.8-flash ?

Le catalogue indique une fenêtre de contexte de 1000000 tokens. Vérifiez les limites du point de terminaison sélectionné.

Quelle est la sortie maximale de qwen3.8-flash ?

Le catalogue indique une sortie maximale de 131072 tokens. Vos paramètres peuvent définir une limite inférieure.

Comment évaluer qwen3.8-flash pour mon projet ?

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.