К результатам поиска

OpenAI

GPT Oss 20B 1 0

gpt-oss-20b — модель с открытыми весами на 21 млрд параметров, выпущенная OpenAI под лицензией Apache 2.0. Её ключевая особенность — архитектура Mixture-of-Experts (MoE), использующая только 3,6 млрд активных параметров, что обеспечивает вывод с низкой задержкой и развёртывание на потребительских GPU. Модель также поддерживает дообучение, вызов функций, использование инструментов и структурированные выходные данные.

  • РассужденияРассужденияВ данных модели подтверждён режим рассуждений. Его параметры зависят от подключённой операции.
  • Вызов инструментовВызов инструментовМодель может запрашивать несколько вызовов инструментов. Приложение проверяет права и выполняет действия.
  • Структурированный ответСтруктурированный ответМодель поддерживает заданную структуру ответа. Доступный формат проверяйте в параметрах API.
  • 128 000 токенов128 000 токеновКонтекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
  • Потоковый ответПотоковый ответОтвет можно получать по частям. Поддержка потока проверяется отдельно для каждой операции API.
Вход
13,93 ₽
Выход
69,63 ₽
Кэш
13,93 ₽
за 1 млн токенов
API ID
openai/gpt-oss-20b

Данные каталога получены .

Цена

Текстовый диалог · вход
13,93 ₽ / 1 млн токенов
Текстовый диалог · выход
69,63 ₽ / 1 млн токенов
Текстовый диалог · вход из кэша
13,93 ₽ / 1 млн токенов

Цена указана в рублях для выбранной операции и её параметров.

Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.

О модели

gpt-oss-20b — модель с открытыми весами на 21 млрд параметров, выпущенная OpenAI под лицензией Apache 2.0. Её ключевая особенность — архитектура Mixture-of-Experts (MoE), использующая только 3,6 млрд активных параметров, что обеспечивает вывод с низкой задержкой и развёртывание на потребительских GPU. Модель также поддерживает дообучение, вызов функций, использование инструментов и структурированные выходные данные.

Релиз

Характеристики

Тип модели
Текст
Вход модели
Текст

Данные, которые модель принимает вместе с запросом.

Выход модели
Текст

Форматы результата, которые создаёт модель.

Контекстное окно
128 000 токенов

Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.

Операции
Текстовый диалог
Возможности модели
Потоковый ответ, Рассуждения, Вызов инструментов, Вызов функций, Параллельные вызовы инструментов, Структурированный ответ, Ответ в JSON

Контрольные показатели

Для этой версии модели оценок пока нет.

Оценки относятся к этой версии модели и методике источника. Качество и скорость конкретного запроса они не гарантируют.

API-запрос

Операция доступна через API. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener

class NoRedirect(HTTPRedirectHandler):
    def redirect_request(self, req, fp, code, msg, headers, newurl):
        return None

opener = build_opener(NoRedirect)

def post(url, payload):
    request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    }, method="POST")
    with opener.open(request, timeout=120) as response:
        return json.load(response)

payload = {
  "model": "openai/gpt-oss-20b",
  "messages": [
    {
      "role": "user",
      "content": "Объясни задачу кратко."
    }
  ]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))
Документация APIСоздать API-ключ