Gemini 3.7 Flash API

model: gemini/3-7-flash

Принимает переписку списком сообщений, изображения, звук и видео, возвращает текст. Контекст 1 048 576 токенов, ответ до 65 536, знания до марта 2026 года. Модель Google.

Цена: за миллион токенов, вход — 135 кр. ($0.675), выход — 675 кр. ($3.375).

кр. — кредиты, покупаются за рубли.

Песочница

Input

Модель gemini/3-7-flash

Потолок ответа. Стоит то же значение, что шлюз подставляет сам, если поле не прислать. Списывается всё равно фактический расход.

Вы платите за длину ответа. Деньги списываются после ответа, по факту — заранее ничего не замораживается. Сколько списано, приходит в самом ответе полем credits_consumed.

Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.


          
Вы платите за длину ответа. Деньги списываются после ответа, по факту — заранее ничего не замораживается. Сколько списано, приходит в самом ответе полем credits_consumed.
Output

Нажмите «Запустить» — ответ модели появится здесь

{ }

Цена Gemini 3.7 Flash

Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула.

Токены Наша цена Скидка Официальная
Вход 135 кр. · $0.67567,5 ₽ −10% $0.75
Выход 675 кр. · $3.375337,5 ₽ −10% $3.75

На 10% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.

Вызов через API

POST https://api.gen202.com/v1/chat/completions

Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и отличается от картинок. Ключ передаётся заголовком Authorization: Bearer sk-… и выпускается в кабинете. На один ключ шлюз пропускает 60 запросов в минуту.

Счёт идёт по токенам из поля usage ответа: вход и выход по своим ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ. Сколько списано, приходит в самом ответе полем credits_consumed. Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не тарифицируется вовсе.

Поля запроса

Все три лежат в корне тела запроса — вложенного input у текста нет. Остальные поля формата OpenAI — temperature, top_p, stop, seed, response_format, reasoning_effort и прочие — шлюз передаёт поставщику, проверив значение: temperature от 0 до 2 (у Claude до 1), top_p от 0 до 1, штрафы от −2 до 2, reasoning_effort — minimal, low, medium или high, стоп-слов не больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего: поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо на её странице.

stream работает: ответ приходит событиями, как это принято у Chat Completions, и заканчивается строкой data: [DONE]. У поставщика ответ при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём стоят на последнем событии, рядом с признаком конца.

tools передаётся всем моделям каталога. n и best_of не передаются: несколько вариантов ответа умножают расход, а перед вызовом проверено, что денег хватает на один.

ПолеТипОбяз.Допустимые значения
model текст обязательное gemini/3-7-flash либо другое имя из каталога текстовых моделей
messages массив обязательное Непустой список сообщений с ролями system, user, assistant. Пустой список или не массив — отказ 400
max_tokens целое опц. От 1 до 128000; вне границ — отказ 400. Синоним — max_completion_tokens · без него шлюз подставит 1024

Вызов

Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.

chat.sh
curl https://api.gen202.com/v1/chat/completions \
  -H "Authorization: Bearer sk-ваш-ключ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini/3-7-flash",
    "messages": [{"role": "user", "content": "Привет"}],
    "max_tokens": 200
  }'
chat.py
from openai import OpenAI

client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")

answer = client.chat.completions.create(
    model="gemini/3-7-flash",
    messages=[{"role": "user", "content": "Привет"}],
    max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage)  # по нему выставлен счёт

Ответ

Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.

chat-response.txt
{
  "choices": [
    {
      "index": 0,
      "message": { "role": "assistant", "content": "…" },
      "finish_reason": "stop"
    }
  ],
  "usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}

Текст лежит в choices[0].message.content, причина остановки — в finish_reason (stop или length). По usage выставляется счёт, так что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI (id, created, object) шлюз не добавляет.

Отказы

Тело отказа — объект error, как у OpenAI: {"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется: деньги списываются только после ответа модели, и возвращать после отказа нечего.

КодcodeКогда
400 model_not_found Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается.
400 invalid_messages Поле messages не передано, пустое или не массив.
400 invalid_max_tokens Поле max_tokens не целое число либо вне границ от 1 до 128000.
400 invalid_setting Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр.
400 key_required Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает.
400 Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект.
401 invalid_api_key Ключа нет в заголовке Authorization, либо он неверный или отключён.
402 insufficient_credits На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту.
413 Тело запроса больше предела в 512 КиБ.
415 Не тот тип содержимого. Заголовок Content-Type должен быть application/json.
429 Больше 60 запросов в минуту на один ключ.
502 upstream_error Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было.
503 service_overloaded Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After.
503 upstream_error Модель временно недоступна у поставщика. Запрос не тарифицируется.

Что Google говорит про Gemini 3.7 Flash

Gemini 3.7 Flash названа последней и самой способной моделью ряда Flash — тем уровнем, который держит скорость и при этом рассуждает.

Прибавку против прошлого выпуска Google описывает двумя вещами: переработана основа рассуждения и добавлена работа с видео в задачах, где модель действует по шагам.

Третье отличие — глубина обдумывания настраивается: ею меняют соотношение качества, цены и времени ответа.

Характеристики Gemini 3.7 Flash одной таблицей

Все числа ниже — из записи каталога, той же, по которой считается счёт за вызов.

ХарактеристикаЗначение
Что берёт на входтекст, картинки, звук и видео
Чем отвечаеттекстом
Имя для поля modelgemini/3-7-flash
Окно контекста1 048 576 токенов
Предел одного ответа65 536 токенов

Ставки за миллион токенов стоят в таблице цен на этой же странице, отдельно за присланное и за ответ.

Для чего Google предлагает Gemini 3.7 Flash

Разработчик называет четыре области: работа по шагам с вызовом инструментов, разбор видео, написание кода и внутренние процессы компаний.

Отдельной строкой сказано, кому модель адресована: обычному человеку, разработчику и компании — то есть отдельного уровня «для бизнеса» у неё нет.

До какого времени Gemini 3.7 Flash знает мир

Отсечка знаний — март 2026 года.

Google оговаривает, что в части областей знания модели заканчиваются раньше — январём 2025 года.

О чём Google предупреждает сам

Первое предупреждение — модель может выдумывать: назвать несуществующее и подать это утвердительно.

Второе — бывают задержки и обрывы ответа.

Третье разработчик формулирует как незаконченную работу: устойчивость к попыткам обойти собственные правила он продолжает улучшать.

Частые вопросы

Как вызвать Gemini 3.7 Flash через API из России?
Запрос уходит на api.gen202.com, и это адрес GEN202, а не адрес Google: обращения за границу в вызове Gemini 3.7 Flash нет, поэтому VPN не требуется. В поле model уходит идентификатор gemini/3-7-flash. Порядок вызова Gemini 3.7 Flash с примерами кода разобран в документации.
Сколько стоит Gemini 3.7 Flash
Цена за миллион токенов Gemini 3.7 Flash — от 135 кр. за вход до 675 кр. за выход. У Gemini 3.7 Flash списывается фактический расход, а задача, завершившаяся ошибкой, не тарифицируется вовсе.
Нужны ли VPN и иностранная карта для Gemini 3.7 Flash
Ни то, ни другое: обращение к Gemini 3.7 Flash идёт на наш адрес, а расчёты с Google ведём мы, поэтому договариваться с ним клиенту не о чем. Оплата рублями с карты российского банка.
Что Gemini 3.7 Flash принимает на вход
Обязательные поля запроса к Gemini 3.7 Flash: model — идентификатор модели; messages — переписка списком сообщений. Остальные поля необязательны.
Как подключить Gemini 3.7 Flash API и сделать первый вызов
Войти на сайт и выпустить ключ в кабинете: при первом входе начисляется 50 кредитов, и этот же ключ открывает Gemini 3.7 Flash вместе с остальным каталогом. Собственного ключа Google и договора с ним для вызова Gemini 3.7 Flash не нужно.