Gemini

Gemma 4-26B-A4B

GoogleBasé sur les jetons

Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。

Tarif à partir de
Entree / Sortie · 1M
Contexte
—
Fenêtre d'entrée maximale
Modalités
→

Tarification par fournisseur

official
官方接口直连
Entree$0.15/ 1M
Sortie$0.6/ 1M
Lecture du cache$0.015/ 1M

Capacités / Modalités prises en charge

StreamingAppel de fonctionOutils
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
GoogleDocuments
Tokeniseur
SentencePiece (Gemini)
Licence
Proprietary (commercial)Propriétaire
Rétention des données3 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de Gemma 4-26B-A4B

Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Rédigez et révisez des textes avec un public, un ton et un format clairement définis.
  • Résumez les documents fournis et comparez les réponses aux sources originales.

Conseils pratiques

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.

Exemple de prompt

Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
official460184K9.2K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur Gemma 4-26B-A4B

Qu’est-ce que Gemma 4-26B-A4B ?

Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。

Comment appeler Gemma 4-26B-A4B ?

Créez une clé API autorisée à utiliser Gemma 4-26B-A4B, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment Gemma 4-26B-A4B est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Comment évaluer Gemma 4-26B-A4B pour mon projet ?

Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.