Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
SentencePiece (Gemini)Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.
Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.
Résumez le document suivant en cinq points. Séparez les faits confirmés des questions ouvertes, citez les passages pertinents et n’inventez pas les informations manquantes. Document : [collez votre texte]
/v1beta/models/gemini-2.5-flash-lite:generateContent| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.
Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .
Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.
| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
temperature | number | = 10 ~ 2 | Température d'échantillonnage ; plus c'est bas, plus c'est déterministe |
top_p | number | = 10 ~ 1 | Masse probabiliste de l'échantillonnage nucleus |
max_tokens | integer | >= 1 | Nombre maximum de jetons dans la réponse |
frequency_penalty | number | = 0-2 ~ 2 | Pénalise la répétition des jetons fréquents |
presence_penalty | number | = 0-2 ~ 2 | Encourage l'introduction de nouveaux sujets |
stop | array | — | Jusqu'à 4 chaînes qui arrêtent la génération |
seed | integer | — | Graine d'échantillonnage déterministe (meilleur effort) |
n | integer | = 1>= 1 | Nombre de complétions à générer |
stream | boolean | = false | Diffuser les jetons via Server-Sent Events |
response_format | object | — | Forcer une sortie JSON ou conforme à un schéma |
tools | array | — | Déclarations d'outils / fonctions que le modèle peut appeler |
tool_choice | string | autononerequired | Stratégie de choix d'outil ou nom d'outil spécifique |
logprobs | boolean | = false | Retourner les log-probabilités par jeton |
top_logprobs | integer | 0 ~ 20 | Nombre de log-probabilités retournées par jeton |
logit_bias | object | — | Carte de biais des logits par jeton |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
| Fournisseur | RPM | TPM | RPD |
|---|---|---|---|
| default | 850 | 338K | 17K |
| Google AI Studio | 480 | 191K | 9.5K |
| Google Vertex | 870 | 350K | 18K |
RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.
Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
Créez une clé API autorisée à utiliser gemini-2.5-flash-lite, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.
Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.
Le catalogue indique une fenêtre de contexte de 1048576 tokens. Vérifiez les limites du point de terminaison sélectionné.
Le catalogue indique une sortie maximale de 65536 tokens. Vos paramètres peuvent définir une limite inférieure.
Séparez les instructions des sources, décrivez le résultat attendu et fournissez un exemple. Testez les outils ou les sorties structurées uniquement si leur prise en charge est indiquée.
