Gemini

gemini-3-flash

GoogleНа основе токенов
Псевдоним:gemini-3-flash-preview
Создать ключ API

Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

textimageaudiovideofilecachingcode_interpreterfunction_callingtoolsweb_searchstructured_outputjson_modereasoningvisioncontext:1048576
Цена от
Вход / Выход · 1M
Контекст
1M
Максимальное окно ввода
Макс. вывод
65.5K
Максимум токенов на ответ
Модальности
→
Выпущено
Dec 2025

Цены по поставщикам

Google AI Studio
-50%
谷歌官方接口
Вход$0.5$0.25/ 1M
Выход$3$1.5/ 1M
Чтение кэша$0.05$0.025/ 1M
Google Vertex
-30%
谷歌官方接口
Вход$0.5$0.35/ 1M
Выход$3$2.1/ 1M
Чтение кэша$0.05$0.035/ 1M
Gemini Cli
-90%
Gemini cli 号池,适合 vibe coding学习等场景
Вход$0.5$0.05/ 1M
Выход$3$0.3/ 1M
Чтение кэша$0.05$0.005/ 1M

Возможности / Поддерживаемые модальности

Кэширование промптовИнтерпретатор кодаВызов функцийИнструментыВеб-поискСтруктурированный выводРежим JSONОбоснованиеЗрение
Вход
Выход

Поставщик и конфиденциальность

Провайдер
Токенизатор
SentencePiece (Gemini)
Лицензия
Proprietary (commercial)Проприетарная
Хранение данных73 днейПо умолчанию не используется для обучения у поставщика

Производительность

О модели gemini-3-flash

Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

Сценарии использования и промпты

Отправные точки для оценки; поддерживаемые входы и параметры перечислены в разделе доступа к API.

Возможные сценарии использования

  • Создавайте и редактируйте тексты с явными требованиями к аудитории, тону и формату.
  • Резюмируйте предоставленные документы и сверяйте ответы с первоисточниками.

Практические советы

Отделяйте инструкции от исходных материалов, описывайте желаемый результат и приводите пример. Проверяйте инструменты и структурированный вывод только при заявленной поддержке.

Пример промпта

Составьте резюме документа из пяти пунктов. Отделите подтверждённые факты от открытых вопросов, процитируйте нужные фрагменты и не выдумывайте отсутствующую информацию. Документ: [вставьте текст]

Доступ к API

Примеры кода

ЗапросPOST/v1beta/models/gemini-3-flash:generateContent
Пример запроса
Параметры
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Заменить <YOUR_API_KEY> на API-ключ из настроек токенов.

Аутентификация

Все запросы должны содержать Authorization: Bearer <TOKEN> . Эндпоинты формата Anthropic вместо этого принимают x-api-key .

Создавайте токены на странице «Токены». Их можно ограничить моделями, группами, IP и лимитами частоты.

Поддерживаемые параметры

Generation parameters
ПараметрТипПо умолчанию / диапазонОписание
temperature
number
=10 ~ 2
Температура сэмплирования; чем ниже, тем детерминированнее
top_p
number
=10 ~ 1
Накопленная вероятность для nucleus-сэмплинга
max_tokens
integer>= 1Максимальное число токенов в ответе
frequency_penalty
number
=0-2 ~ 2
Штрафует повторение частых токенов
presence_penalty
number
=0-2 ~ 2
Поощряет введение новых тем
stop
array—До 4 строк, останавливающих генерацию
seed
integer—Сид детерминированного сэмплирования (по возможности)
n
integer
=1>= 1
Число генерируемых вариантов
stream
boolean
=false
Стримить токены через Server-Sent Events
response_format
object—Принудительно вернуть JSON или соответствующий схеме вывод
tools
array—Объявления инструментов и функций, которые модель может вызывать
tool_choice
string
autononerequired
Политика выбора инструмента или конкретное имя
logprobs
boolean
=false
Возвращать логарифмические вероятности по токенам
top_logprobs
integer0 ~ 20Количество top-вероятностей на токен
logit_bias
object—Карта смещений логитов по токенам
user
string—Идентификатор конечного пользователя для мониторинга злоупотреблений

Ограничения частоты

ПоставщикRPMTPMRPD
default580231K12K
Gemini Cli920370K19K
Google AI Studio830334K17K
Google Vertex650260K13K

RPM = запросов в минуту, TPM = токенов в минуту, RPD = запросов в день. Ограничения применяются к каждой группе токенов.

Частые вопросы о gemini-3-flash

Что такое gemini-3-flash?

Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

Как вызвать gemini-3-flash?

Создайте API-ключ с доступом к gemini-3-flash, затем используйте точный ID модели и поддерживаемый эндпоинт из раздела доступа к API. Поля запроса зависят от выбранного эндпоинта.

Как тарифицируется gemini-3-flash?

Цена зависит от выбранной группы поставщиков и единицы тарификации модели. Текущая стоимость ввода, вывода, запроса или медиа показана на этой странице до регистрации.

Каков размер контекста gemini-3-flash?

В каталоге указано контекстное окно 1048576 токенов. Ограничения запроса уточняйте для выбранного эндпоинта.

Каков максимальный вывод gemini-3-flash?

В каталоге указан максимальный вывод 65536 токенов. Параметры запроса могут задавать меньший предел.

Как оценить gemini-3-flash для своего проекта?

Отделяйте инструкции от исходных материалов, описывайте желаемый результат и приводите пример. Проверяйте инструменты и структурированный вывод только при заявленной поддержке.