Gemini

Gemini Flash Lite Latest

Googleトークンベース
エイリアス:gemini-flash-lite-latest
APIキーを作成

Modelsell で gemini-flash-lite-latest API の料金、対応エンドポイント、機能、アクセス方法を比較できます。

ReasoningToolsFilesVisionAudio1M
最低料金
入力 / 出力 · 1M
コンテキスト
—
最大入力ウィンドウ
モダリティ
→

サプライヤー別料金

Google AI Studio
-50%
谷歌官方接口
入力$0.1$0.05/ 1M
出力$0.4$0.2/ 1M
キャッシュ読み取り$0.025$0.0125/ 1M

機能 / サポートされるモダリティ

ストリーミングシステムプロンプト関数呼び出しツールJSON モード構造化出力プロンプトキャッシュ理由ビジョン
入力
出力

プロバイダーとデータ保護

プロバイダー
トークナイザー
SentencePiece (Gemini)
ライセンス
Proprietary (commercial)プロプライエタリ
データ保持51 日デフォルトで上流の学習には使用されません

パフォーマンス

ベンチマーク

標準化評価のスコアです。割合が高いほど良く、順位パーセンタイルを表示します。

指標の出典:Artificial Analysis 2026-09-30·Gemini Flash Lite Latest

このモデルは現在のベンチマークスナップショットに含まれていません。

モデルや測定値がないことは 0 点を意味しません。

ベンチマークグラフはソースのモデル選択と推論設定を保持しています。モデルや測定値がないことは 0 点を意味せず、ベンチマークのコストや速度は当サイトのサービス保証ではありません。

Gemini Flash Lite Latest について

Gemini Flash-Lite 适合把每天反复出现的小任务交给模型:判断工单类型、从邮件中找出订单号、缩短一段产品介绍,或把零散记录整理成固定格式。它侧重响应速度和高频处理,便于嵌入需要及时反馈的业务流程。

处理分类任务时,可以先列出允许的类别及各自定义,再给出几个边界案例。例如将售后咨询分为退款、物流、使用方法与其他,并要求每次只返回一个类别及一句判断依据。做信息提取时,明确字段、日期格式和缺失值规则,能减少下游程序清洗结果的工作。

它也适合批量内容整理:把用户评价归纳为优点、问题与建议,将长标题压缩为移动端短标题,或者把不同措辞的商品属性统一为标准字段。材料中的事实与用户要求应分开写,避免把原文里的指令误当成任务要求。

对于依赖多步推理、复杂代码修改或大量相互关联约束的任务,可以先让它完成材料归类和线索抽取,再把整理结果交给更适合深入分析的模型。latest 会随服务更新;需要长期复现实验结果时,可选择固定版本并保存测试样例。

使用例とプロンプト

可以这样提交工单分类任务:

“请将以下咨询分类为退款、物流、使用方法或其他。先遵循类别定义,信息不足时选其他。输出 JSON,字段为 category、reason、order_id;订单号未提供时填 null。类别定义:……咨询内容:……”

提取结果怎样接入程序?先给出准确字段及可选值,并在应用侧检查 JSON 格式和必填项。

长材料怎样处理更稳?按自然段或记录拆分,保留编号,分别提取后再汇总。类别经常混淆时,补充正反例通常比增加笼统要求更有效。

API を利用

API ドキュメント

コードサンプル

リクエストPOST/v1beta/models/gemini-flash-lite-latest:generateContent
リクエスト例
パラメータ
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

置換 <YOUR_API_KEY> をトークン設定の API キーに置き換えてください。

認証

すべてのリクエストには Authorization: Bearer <TOKEN> ヘッダーが必要です。Anthropic 形式のエンドポイントでは x-api-key ヘッダーも利用できます。

トークンページから API キーを発行できます。モデル、グループ、IP、レート制限ごとに細かく権限を設定可能です。

対応パラメータ

Generation parameters
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

レート制限

サプライヤーRPMTPMRPD
Google AI Studio無制限無制限無制限

制限なし

gemini-flash-lite-latest に関するよくある質問

gemini-flash-lite-latest とは?

Modelsell で gemini-flash-lite-latest API の料金、対応エンドポイント、機能、アクセス方法を比較できます。

gemini-flash-lite-latest を呼び出すには?

gemini-flash-lite-latest へのアクセス権がある API キーを作成し、API アクセス欄の正確なモデル ID と対応エンドポイントを使用してください。リクエスト項目は選択したエンドポイントによって異なります。

gemini-flash-lite-latest の料金体系は?

料金は選択したプロバイダーグループとモデルの課金単位で決まります。現在の入力、出力、リクエスト、またはメディア料金は登録前にこのページで確認できます。

自分のプロジェクトに gemini-flash-lite-latest が適しているか評価するには?

このページの使用例とプロンプトのガイドを参考に、プロジェクトの代表的な入力でモデルを評価してください。