К результатам поиска

xiaomi

MiMo V2.6 Flash Uncensored Thinking

MiMo V2.6 Flash Uncensored с включённым максимальным режимом размышления. Поддерживает контекстное окно на 1M токенов и вызов инструментов.

  • РассужденияРассужденияВ данных модели подтверждён режим рассуждений. Его параметры зависят от подключённой операции.
  • Вызов инструментовВызов инструментовМодель может запросить вызов функции. Приложение проверяет права и выполняет действие.
  • 1 048 576 токенов1 048 576 токеновКонтекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
Вход
60 ₽
Выход
180 ₽
Кэш
23,94 ₽
за 1 млн токенов
Доступность
97,6%
API ID
xiaomi/mimo-v2.6-flash-uncensored:thinking

Данные каталога получены .

Цена

Текстовый диалог · вход
60,00 ₽ / 1 млн токенов
Текстовый диалог · выход
180,00 ₽ / 1 млн токенов
Текстовый диалог · вход из кэша
23,94 ₽ / 1 млн токенов

Цена указана в рублях для выбранной операции и её параметров.

Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.

О модели

MiMo V2.6 Flash Uncensored с включённым максимальным режимом размышления. Поддерживает контекстное окно на 1M токенов и вызов инструментов.

Релиз
Дата не указана

Характеристики

Доступность97,6%
  1. 15 сентября: нет данных
  2. 16 сентября: нет данных
  3. 17 сентября: нет данных
  4. 18 сентября: нет данных
  5. 19 сентября: нет данных
  6. 20 сентября: нет данных
  7. 21 сентября: нет данных
  8. 22 сентября: нет данных
  9. 23 сентября: нет данных
  10. 24 сентября: нет данных
  11. 25 сентября: нет данных
  12. 26 сентября: 97,9%
  13. 27 сентября: 98,2%
  14. 28 сентября: 92,6%
Доля успешных запросов к модели у поставщика за последние 24 часа. Обновляется каждый час.
Тип модели
Текст
Вход модели
Текст

Данные, которые модель принимает вместе с запросом.

Выход модели
Текст

Форматы результата, которые создаёт модель.

Контекстное окно
1 048 576 токенов

Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.

Максимальный ответ
65 536 токенов

Максимальный размер ответа по данным каталога. Фактический предел запроса зависит от подключённой операции.

Скорость генерации
≈ 184,7 токенов/с

Средняя скорость вывода по данным поставщика; зависит от нагрузки и длины ответа.

Время до первого токена
≈ 6,6 с

Среднее время до начала ответа по данным поставщика.

Операции
Текстовый диалог
Возможности модели
Рассуждения, Вызов инструментов

Настройки

Контрольные показатели

Для этой версии пока нет сопоставленной проверенной оценки. Результаты других версий сюда не переносятся.

Результат бенчмарка относится к его методике и версии модели. Он не гарантирует качество ответа, скорость или доступность конкретного запроса в Kvantora.

API-запрос

Пример API-запроса подготовлен для этой операции. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener

class NoRedirect(HTTPRedirectHandler):
    def redirect_request(self, req, fp, code, msg, headers, newurl):
        return None

opener = build_opener(NoRedirect)

def post(url, payload):
    request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    }, method="POST")
    with opener.open(request, timeout=120) as response:
        return json.load(response)

payload = {
  "model": "xiaomi/mimo-v2.6-flash-uncensored:thinking",
  "messages": [
    {
      "role": "user",
      "content": "Объясни задачу кратко."
    }
  ]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))
Документация APIСоздать API-ключ