К результатам поиска

minimax

MiniMax M3

MiniMax M3 — вариант без режима рассуждения для программирования, агентных задач, инструментов и мультимодального понимания. Поддерживает контекст до 1M токенов; заявлены результаты 59.0% на SWE-Bench Pro и 66.0% на Terminal Bench 2.1.

  • РассужденияРассужденияВ данных модели подтверждён режим рассуждений. Его параметры зависят от подключённой операции.
  • Понимание изображенийПонимание изображенийМодель умеет разбирать содержимое изображений.
  • Вызов инструментовВызов инструментовМодель может запрашивать несколько вызовов инструментов. Приложение проверяет права и выполняет действия.
  • Структурированный ответСтруктурированный ответМодель поддерживает заданную структуру ответа. Доступный формат проверяйте в параметрах API.
  • 512 000 токенов512 000 токеновКонтекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
  • Видео на входеВидео на входеНаправление работы с видео подтверждено данными модели. Длительность, размер и формат определяются операцией.
  • Потоковый ответПотоковый ответОтвет можно получать по частям. Поддержка потока проверяется отдельно для каждой операции API.
  • Пакетные запросыПакетные запросыПакетный режим указан в данных модели. Это не означает, что отдельный batch API уже подключён в Kvantora.
Вход
12,66 ₽
Выход
12,66 ₽
Кэш
12,66 ₽
за 1 млн токенов
Доступность
100%
API ID
minimax/minimax-m3

Данные каталога получены .

Цена

Текстовый диалог · вход
12,66 ₽ / 1 млн токенов
Текстовый диалог · выход
12,66 ₽ / 1 млн токенов
Текстовый диалог · вход из кэша
12,66 ₽ / 1 млн токенов

Цена указана в рублях для выбранной операции и её параметров.

Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.

О модели

MiniMax M3 — версия модели с открытыми весами без режима рассуждений для программирования, агентных задач, работы с инструментами и мультимодального понимания. MiniMax сообщает о 59.0% на SWE-Bench Pro и 66.0% на Terminal Bench 2.1. Sparse Attention рассчитан на контекст до 1M токенов; текущий лимит — 512K.

Релиз

Характеристики

Доступность100%
  1. 7 октября: 100%
  2. 8 октября: 100%
  3. 9 октября: 100%
Доля успешных запросов к модели за последние 72 часа. Обновляется каждые два часа.
Тип модели
Текст
Вход модели
Текст, Изображения

Данные, которые модель принимает вместе с запросом.

Выход модели
Текст

Форматы результата, которые создаёт модель.

Контекстное окно
512 000 токенов

Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.

Максимальный ответ
80 000 токенов

Максимальный размер ответа по данным каталога. Фактический предел запроса зависит от подключённой операции.

Операции
Текстовый диалог, Понимание изображений
Возможности модели
Потоковый ответ, Понимание изображений, Рассуждения, Вызов инструментов, Вызов функций, Параллельные вызовы инструментов, Структурированный ответ, Ответ в JSON, Пакетные запросы, Входные изображения, Входное видео

Контрольные показатели

Artificial Analysis

46 показателей

Источник ↗

Агентная работа

  • AA-Briefcase1 092 Elo

    Агентная работа со знаниями

    Проверено

  • AA-Briefcase1 091 Elo

    Агентная работа со знаниями (Elo)

    Проверено

  • AutomationBench-AA21,3 %

    Автоматизация рабочих процессов со штрафом за нарушение ограничений

    Проверено

  • AutomationBench-AA21,3 %

    Автоматизация рабочего процесса со штрафами за нарушение ограничений

    Проверено

  • AutomationBench-AA · полностью выполненные задачи4,4 %

    Полностью выполненные рабочие процессы без нарушений ограничений

    Проверено

  • AutomationBench-AA · полностью выполненные задачи4,4 %

    Процессы, выполненные полностью и без нарушений

    Проверено

  • GDPval-AA v21 230 Elo

    Экономически значимые рабочие задачи

    Проверено

  • GDPval-AA v21 245 Elo

    Экономически значимые задачи (Elo)

    Проверено

  • Harvey LAB-AA88,4 %

    Юридическая агентная работа: доля выполненных критериев

    Проверено

  • Harvey LAB-AA88,4 %

    Доля пройденных критериев юридической агентной работы

    Проверено

Рассуждение по документу

  • AA-LCR v1.183 %

    Рассуждение на длинном контексте с обновлённой оценкой

    Проверено

  • GDP.pdf9,8 %

    Профессиональное рассуждение по PDF: доля прохождения всех проверок

    Проверено

Работа с документами

  • AA-LCR v1.183 %

    Рассуждение в длинном контексте, обновлённая проверка

    Проверено

  • GDP.pdf9,8 %

    Профессиональные PDF-документы: доля полностью верных ответов

    Проверено

  • MLCR-AA17,2 %

    Медицинские рассуждения в длинном контексте

    Проверено

Архивные методики

  • AA-LCR (версия не указана, архивный)83 %

    Рассуждение в длинном контексте

    Проверено

  • GDPval-AA (версия не указана, архивный)36,5 %

    Экономически значимые рабочие задачи

    Проверено

  • GPQA Diamond (архивный)92,9 %

    Научные вопросы уровня аспирантуры

    Проверено

  • T²-Bench Telecom (архивный)88,9 %

    Диалоговые агенты, где действует и пользователь

    Проверено

  • Terminal-Bench Hard (архивный)42,4 %

    Агентное программирование и работа в терминале

    Проверено

Устаревшие тесты

  • AA-LCR (версия не указана, архивный)83 %

    Оценка рассуждений на длинном контексте

    Проверено

  • GDPval-AA (версия не указана, архивный)37,3 %

    Задачи с экономической ценностью

    Проверено

  • GPQA Diamond (архивный)92,9 %

    Научные рассуждения уровня выпускника

    Проверено

  • T²-Bench Telecom (архивный)88,9 %

    Разговорные ИИ-агенты в сценариях с двойным управлением

    Проверено

  • Terminal-Bench Hard (архивный)42,4 %

    Агентное программирование и работа в терминале

    Проверено

Знания

  • AA-Omniscience · точность16,7 %

    Доля вопросов с правильным ответом

    Проверено

  • AA-Omniscience · точность16,7 %

    Доля правильных ответов

    Проверено

  • AA-Omniscience · доля выдуманных ответов (меньше лучше)18,4 %

    Доля выдуманных ответов среди неверных

    Проверено

Знание

  • AA-Omniscience · доля выдуманных ответов (меньше лучше)18,4 %

    Доля неверных ответов среди некорректных ответов

    Проверено

Другие показатели

  • Индекс агентных задач29,5 индекс

    Сводная оценка Artificial Analysis по агентным задачам

    Проверено

  • Индекс агентных задач29,5 индекс

    Сводная оценка Artificial Analysis по агентным задачам

    Проверено

  • Индекс программирования58,6 индекс

    Сводная оценка Artificial Analysis по программированию

    Проверено

  • Индекс программирования58,6 индекс

    Сводная оценка Artificial Analysis по программированию

    Проверено

  • Индекс интеллекта29,2 индекс

    Сводная оценка Artificial Analysis по всем её тестам

    Проверено

  • Индекс интеллекта29,2 индекс

    Сводная оценка Artificial Analysis по всем её тестам

    Проверено

Рассуждения

  • CritPt3,7 %

    Исследовательские задачи по физике

    Проверено

  • HLE39 %

    Humanity’s Last Exam — вопросы экспертного уровня

    Проверено

  • HLE39 %

    Humanity’s Last Exam — вопросы экспертного уровня

    Проверено

  • IFBench82,9 %

    Точное выполнение инструкций

    Проверено

Рассуждение

  • CritPt3,7 %

    Рассуждения по физике исследовательского уровня

    Проверено

  • IFBench82,9 %

    Тест на следование инструкциям

    Проверено

Документ: рассуждение

  • MLCR-AA17,2 %

    Медицинское рассуждение на длинном контексте

    Проверено

Программирование

  • SciCode47,1 %

    Программирование на Python для научных вычислений

    Проверено

  • SciCode47,1 %

    Программирование на Python для научных расчётов

    Проверено

  • Terminal-Bench v4.02 %

    Практические задачи по программированию и работе в терминале

    Проверено

  • Terminal-Bench v4.02 %

    Практические задачи программирования и работы в терминале

    Проверено

Design Arena

48 показателей

Рейтинг Elo и доля побед в попарных сравнениях, оценённых людьми

Источник ↗

Агентные системы

  • Разработка игр агентами · Elo1 158 Elo

    Проверено

  • Разработка игр агентами · Elo1 158 Elo

    Проверено

  • Разработка игр агентами · доля побед44,6 %

    Проверено

  • Разработка игр агентами · доля побед44,6 %

    Проверено

  • Полный цикл разработки · Elo1 195 Elo

    Проверено

  • Полный цикл разработки · Elo1 204 Elo

    Проверено

  • Полный цикл разработки · доля побед47,1 %

    Проверено

  • Полный цикл разработки · доля побед47,1 %

    Проверено

  • Мобильные приложения · Elo1 195 Elo

    Проверено

  • Мобильные приложения · Elo1 198 Elo

    Проверено

  • Мобильные приложения · доля побед47 %

    Проверено

  • Мобильные приложения · доля побед46,3 %

    Проверено

  • Нативные приложения · Elo1 164 Elo

    Проверено

  • Нативные приложения · Elo1 171 Elo

    Проверено

  • Нативные приложения · доля побед43,5 %

    Проверено

  • Нативные приложения · доля побед44,3 %

    Проверено

  • Веб-приложения · Elo1 208 Elo

    Проверено

  • Веб-приложения · Elo1 199 Elo

    Проверено

  • Веб-приложения · доля побед47,6 %

    Проверено

  • Веб-приложения · доля побед47,8 %

    Проверено

Модели

  • 3D · Elo1 235 Elo

    Проверено

  • 3D · Elo1 227 Elo

    Проверено

  • 3D · доля побед50,5 %

    Проверено

  • 3D · доля побед50,2 %

    Проверено

  • ASCII-графика · Elo1 172 Elo

    Проверено

  • ASCII-графика · Elo1 181 Elo

    Проверено

  • ASCII-графика · доля побед46,7 %

    Проверено

  • ASCII-графика · доля побед47,4 %

    Проверено

  • Визуализация данных · Elo1 243 Elo

    Проверено

  • Визуализация данных · Elo1 248 Elo

    Проверено

  • Визуализация данных · доля побед51,1 %

    Проверено

  • Визуализация данных · доля побед51,4 %

    Проверено

  • Разработка игр · Elo1 240 Elo

    Проверено

  • Разработка игр · Elo1 227 Elo

    Проверено

  • Разработка игр · доля побед47 %

    Проверено

  • Разработка игр · доля побед46,4 %

    Проверено

  • SVG · Elo1 175 Elo

    Проверено

  • SVG · Elo1 183 Elo

    Проверено

  • SVG · доля побед46,5 %

    Проверено

  • SVG · доля побед47,5 %

    Проверено

  • UI-компоненты · Elo1 256 Elo

    Проверено

  • UI-компоненты · Elo1 260 Elo

    Проверено

  • UI-компоненты · доля побед51,1 %

    Проверено

  • UI-компоненты · доля побед51,1 %

    Проверено

  • Сайты · Elo1 265 Elo

    Проверено

  • Сайты · Elo1 269 Elo

    Проверено

  • Сайты · доля побед52,3 %

    Проверено

  • Сайты · доля побед51,9 %

    Проверено

Оценки относятся к этой версии модели и методике источника. Качество и скорость конкретного запроса они не гарантируют.

API-запрос

Операция доступна через API. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener

class NoRedirect(HTTPRedirectHandler):
    def redirect_request(self, req, fp, code, msg, headers, newurl):
        return None

opener = build_opener(NoRedirect)

def post(url, payload):
    request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    }, method="POST")
    with opener.open(request, timeout=120) as response:
        return json.load(response)

payload = {
  "model": "minimax/minimax-m3",
  "messages": [
    {
      "role": "user",
      "content": "Объясни задачу кратко."
    }
  ]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))
Документация APIСоздать API-ключ