heabsy
CyberHeabsy
Текстовая модель с низким уровнем отказов для авторизованных исследований безопасности, ролевых игр и творческого письма. Сохраняет вызов инструментов после удаления отказов, поддерживает опциональные рассуждения и имеет контекстное окно 1M токенов.
- Вход
- 180 ₽
- Выход
- 540 ₽
- Кэш
- 33 ₽
- Доступность
- 97,8%
heabsy/cyberheabsyДанные каталога получены .
Цена
- Текстовый диалог · вход
- 180,00 ₽ / 1 млн токенов
- Текстовый диалог · выход
- 540,00 ₽ / 1 млн токенов
- Текстовый диалог · вход из кэша
- 33,00 ₽ / 1 млн токенов
Цена указана в рублях для выбранной операции и её параметров.
Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.
О модели
Текстовая модель с низким уровнем отказов для авторизованных исследований безопасности, ролевых игр и творческого письма. Сохраняет вызов инструментов после удаления отказов, поддерживает опциональные рассуждения и имеет контекстное окно 1M токенов.
- Релиз
- Дата не указана
Характеристики
- 15 сентября: нет данных
- 16 сентября: нет данных
- 17 сентября: нет данных
- 18 сентября: нет данных
- 19 сентября: нет данных
- 20 сентября: нет данных
- 21 сентября: нет данных
- 22 сентября: нет данных
- 23 сентября: нет данных
- 24 сентября: нет данных
- 25 сентября: нет данных
- 26 сентября: нет данных
- 27 сентября: нет данных
- 28 сентября: 97,8%
- Тип модели
- Текст
- Вход модели
- Текст
Данные, которые модель принимает вместе с запросом.
- Выход модели
- Текст
Форматы результата, которые создаёт модель.
- Контекстное окно
- 1 048 576 токенов
Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
- Максимальный ответ
- 65 536 токенов
Максимальный размер ответа по данным каталога. Фактический предел запроса зависит от подключённой операции.
- Скорость генерации
- ≈ 72 токенов/с
Средняя скорость вывода по данным поставщика; зависит от нагрузки и длины ответа.
- Время до первого токена
- ≈ 7,8 с
Среднее время до начала ответа по данным поставщика.
- Операции
- Текстовый диалог
- Возможности модели
- Рассуждения, Вызов инструментов
Настройки
Контрольные показатели
Для этой версии пока нет сопоставленной проверенной оценки. Результаты других версий сюда не переносятся.
Результат бенчмарка относится к его методике и версии модели. Он не гарантирует качество ответа, скорость или доступность конкретного запроса в Kvantora.
API-запрос
Пример API-запроса подготовлен для этой операции. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.
import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener
class NoRedirect(HTTPRedirectHandler):
def redirect_request(self, req, fp, code, msg, headers, newurl):
return None
opener = build_opener(NoRedirect)
def post(url, payload):
request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
"Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
"Content-Type": "application/json",
"Idempotency-Key": os.environ["REQUEST_ID"],
}, method="POST")
with opener.open(request, timeout=120) as response:
return json.load(response)
payload = {
"model": "heabsy/cyberheabsy",
"messages": [
{
"role": "user",
"content": "Объясни задачу кратко."
}
]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))





