Gemini

Gemini Flash Lite Latest

GoogleBasé sur les jetons
Alias:gemini-flash-lite-latest

Comparez sur Modelsell les tarifs de l'API gemini-flash-lite-latest, les points de terminaison, les fonctionnalités et les options d'accès.

ReasoningToolsFilesVisionAudio1M
Tarif à partir de
Entree / Sortie · 1M
Contexte
—
Fenêtre d'entrée maximale
Modalités
→

Tarification par fournisseur

Google AI Studio
-50%
谷歌官方接口
Entree$0.1$0.05/ 1M
Sortie$0.4$0.2/ 1M
Lecture du cache$0.025$0.0125/ 1M

Capacités / Modalités prises en charge

StreamingInvite systèmeAppel de fonctionOutilsMode JSONSortie structuréeCache d'invitesRaisonnementVision
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
GoogleDocuments
Tokeniseur
SentencePiece (Gemini)
Licence
Proprietary (commercial)Propriétaire
Rétention des données51 joursNon utilisé pour l'entraînement amont par défaut

Performances

Benchmarks

Scores sur des évaluations standardisées. Les pourcentages élevés sont meilleurs et le percentile de classement est indiqué.

Métriques fournies parArtificial Analysis 2026-09-30·Gemini Flash Lite Latest

Ce modèle ne figure pas dans l’instantané actuel.

Les modèles ou mesures manquants ne valent pas zéro.

Les graphiques conservent la sélection de modèles et les réglages de raisonnement de la source. Les modèles ou mesures manquants ne valent pas zéro ; le coût et la vitesse des benchmarks ne constituent pas un engagement de service du site.

À propos de Gemini Flash Lite Latest

Gemini Flash-Lite 适合把每天反复出现的小任务交给模型:判断工单类型、从邮件中找出订单号、缩短一段产品介绍,或把零散记录整理成固定格式。它侧重响应速度和高频处理,便于嵌入需要及时反馈的业务流程。

处理分类任务时,可以先列出允许的类别及各自定义,再给出几个边界案例。例如将售后咨询分为退款、物流、使用方法与其他,并要求每次只返回一个类别及一句判断依据。做信息提取时,明确字段、日期格式和缺失值规则,能减少下游程序清洗结果的工作。

它也适合批量内容整理:把用户评价归纳为优点、问题与建议,将长标题压缩为移动端短标题,或者把不同措辞的商品属性统一为标准字段。材料中的事实与用户要求应分开写,避免把原文里的指令误当成任务要求。

对于依赖多步推理、复杂代码修改或大量相互关联约束的任务,可以先让它完成材料归类和线索抽取,再把整理结果交给更适合深入分析的模型。latest 会随服务更新;需要长期复现实验结果时,可选择固定版本并保存测试样例。

Cas d’usage et prompts

可以这样提交工单分类任务:

“请将以下咨询分类为退款、物流、使用方法或其他。先遵循类别定义,信息不足时选其他。输出 JSON,字段为 category、reason、order_id;订单号未提供时填 null。类别定义:……咨询内容:……”

提取结果怎样接入程序?先给出准确字段及可选值,并在应用侧检查 JSON 格式和必填项。

长材料怎样处理更稳?按自然段或记录拆分,保留编号,分别提取后再汇总。类别经常混淆时,补充正反例通常比增加笼统要求更有效。

Accès API

Documentation API

Exemples de code

RequêtePOST/v1beta/models/gemini-flash-lite-latest:generateContent
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Google AI StudioIllimitéIllimitéIllimité

Aucune restriction

Questions fréquentes sur gemini-flash-lite-latest

Qu’est-ce que gemini-flash-lite-latest ?

Comparez sur Modelsell les tarifs de l'API gemini-flash-lite-latest, les points de terminaison, les fonctionnalités et les options d'accès.

Comment appeler gemini-flash-lite-latest ?

Créez une clé API autorisée à utiliser gemini-flash-lite-latest, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment gemini-flash-lite-latest est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Comment évaluer gemini-flash-lite-latest pour mon projet ?

Consultez les cas d’usage et les conseils de prompts de cette page, puis évaluez le modèle avec des entrées représentatives de votre projet.