Grok 4.6 API
model: grok/4-6
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 500 000 токенов, знания до 1 февраля 2026 года. Модель xAI.
Цена: за миллион токенов, вход — 360 кр. ($1.8), выход — 1080 кр. ($5.4).
кр. — кредиты, покупаются за рубли.
Песочница
Модель grok/4-6
Потолок ответа. Стоит то же значение, что шлюз подставляет сам, если поле не прислать. Списывается всё равно фактический расход.
Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.
Нажмите «Запустить» — ответ модели появится здесь
{ }
Цена Grok 4.6
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула.
| Токены | Наша цена | Скидка | Официальная |
|---|---|---|---|
| Вход | 360 кр. · $1.8180 ₽ | −10% | $2 |
| Выход | 1080 кр. · $5.4540 ₽ | −10% | $6 |
На 10% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.
Длинный запрос. Поставщик считает его по второй цене: как только на вход уходит от 200 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Наша цена | Скидка | Официальная |
|---|---|---|---|
| Вход | 720 кр. · $3.6360 ₽ | −10% | $4 |
| Выход | 2160 кр. · $10.81080 ₽ | −10% | $12 |
Вызов через API
Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и
отличается от картинок. Ключ передаётся заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
60 запросов в минуту.
Счёт идёт по токенам из поля usage ответа: вход и выход по своим
ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому
короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ.
Сколько списано, приходит в самом ответе полем credits_consumed.
Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не
тарифицируется вовсе.
Поля запроса
Все три лежат в корне тела запроса — вложенного input у текста нет.
Остальные поля формата OpenAI — temperature,
top_p, stop,
seed, response_format,
reasoning_effort и прочие — шлюз передаёт поставщику, проверив
значение: temperature от 0 до 2 (у Claude до 1),
top_p от 0 до 1, штрафы от −2 до 2,
reasoning_effort — minimal, low, medium или high, стоп-слов не
больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего:
поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого
семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо
на её странице.
stream работает: ответ приходит событиями, как это принято у Chat
Completions, и заканчивается строкой data: [DONE]. У поставщика ответ
при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена
вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём
стоят на последнем событии, рядом с признаком конца.
tools передаётся всем моделям каталога.
n и
best_of не передаются: несколько вариантов ответа умножают расход, а
перед вызовом проверено, что денег хватает на один.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | grok/4-6 либо другое имя из каталога текстовых моделей |
| messages | массив | обязательное |
Непустой список сообщений с ролями system,
user, assistant. Пустой список
или не массив — отказ 400
|
| max_tokens | целое | опц. |
От 1 до 128000; вне границ — отказ 400.
Синоним — max_completion_tokens
· без него шлюз подставит 1024
|
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "grok/4-6",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="grok/4-6",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Ответ
Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.
{
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "…" },
"finish_reason": "stop"
}
],
"usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}
Текст лежит в choices[0].message.content, причина остановки — в
finish_reason (stop или
length). По usage выставляется счёт, так
что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI
(id, created,
object) шлюз не добавляет.
Отказы
Тело отказа — объект error, как у OpenAI:
{"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется:
деньги списываются только после ответа модели, и возвращать после отказа нечего.
| Код | code | Когда |
|---|---|---|
| 400 | model_not_found | Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается. |
| 400 | invalid_messages | Поле messages не передано, пустое или не массив. |
| 400 | invalid_max_tokens | Поле max_tokens не целое число либо вне границ от 1 до 128000. |
| 400 | invalid_setting | Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр. |
| 400 | key_required | Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает. |
| 400 | — | Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект. |
| 401 | invalid_api_key | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | insufficient_credits | На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту. |
| 413 | — | Тело запроса больше предела в 512 КиБ. |
| 415 | — | Не тот тип содержимого. Заголовок Content-Type должен быть application/json. |
| 429 | — | Больше 60 запросов в минуту на один ключ. |
| 502 | upstream_error | Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было. |
| 503 | service_overloaded | Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After. |
| 503 | upstream_error | Модель временно недоступна у поставщика. Запрос не тарифицируется. |
Что xAI говорит про Grok 4.6
Grok 4.6 у разработчика описана тремя словами: код, работа по шагам с инструментами и работа со знаниями.
Глубину обдумывания у неё выбирают из нескольких ступеней, и по умолчанию стоит высокая — модель думает много, если её не просить об обратном.
Характеристики Grok 4.6 одной таблицей
Значения взяты из записи каталога, по которой шлюз считает счёт.
| Характеристика | Значение |
|---|---|
| Что берёт на вход | текст и изображения |
| Чем отвечает | текстом |
| Имя для поля model | grok/4-6 |
| Окно контекста | 500 000 токенов |
| Отсечка знаний | февраль 2026 года |
Предела длины одного ответа xAI не называет нигде, поэтому строки о нём в таблице нет.
Где Grok 4.6 применяют
Разработчик ставит её под долгие рабочие циклы, в которых модель сама вызывает инструменты и доводит задачу до конца.
Второе применение — разбор большого материала за один заход: окно у неё полмиллиона токенов.
Что происходит с ценой на длинном запросе
У этой модели две ступени цены, и вторая наступает с двухсот тысяч токенов запроса.
Считается она по всему запросу, а не по той части, что вышла за порог: перевалив за него, дороже становится весь вызов.
Обе ступени стоят в таблице цен выше на этой странице.
О чём предупреждает xAI
Оговорка у разработчика одна и касается долгих циклов: чтобы модель не упёрлась в окно, накопленную переписку приходится сжимать.
То есть длина окна тут не отменяет работы с материалом — она только отодвигает момент, когда её придётся делать.