К результатам поиска

zhipu

GLM 4.5 Air

GLM-4.5-Air содержит 106 млрд параметров, из них 12 млрд активны. Предназначена для рассуждений, программирования и агентных задач.

  • РассужденияРассужденияВ данных модели подтверждён режим рассуждений. Его параметры зависят от подключённой операции.
  • Вызов инструментовВызов инструментовМодель может запросить вызов функции. Приложение проверяет права и выполняет действие.
  • Структурированный ответСтруктурированный ответМодель поддерживает заданную структуру ответа. Доступный формат проверяйте в параметрах API.
  • 128 000 токенов128 000 токеновКонтекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
  • Потоковый ответПотоковый ответОтвет можно получать по частям. Поддержка потока проверяется отдельно для каждой операции API.
Вход
17,72 ₽
Выход
106,34 ₽
Кэш
17,72 ₽
за 1 млн токенов
Интеллект
11,1
API ID
zhipu/glm-4.5-air

Данные каталога получены .

Цена

Текстовый диалог · вход
17,72 ₽ / 1 млн токенов
Текстовый диалог · выход
106,34 ₽ / 1 млн токенов
Текстовый диалог · вход из кэша
17,72 ₽ / 1 млн токенов

Цена указана в рублях для выбранной операции и её параметров.

Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.

О модели

GLM-4.5-Air — модель с 106B общих и 12B активных параметров, созданная для объединения передовых рассуждений, программирования и агентных возможностей. В бенчмарке SWE-bench Verified показывает лучший результат в своём масштабе при конкурентоспособном соотношении производительности и затрат.

Релиз

Характеристики

Тип модели
Текст
Вход модели
Текст

Данные, которые модель принимает вместе с запросом.

Выход модели
Текст

Форматы результата, которые создаёт модель.

Контекстное окно
128 000 токенов

Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.

Максимальный ответ
98 304 токенов

Максимальный размер ответа по данным каталога. Фактический предел запроса зависит от подключённой операции.

Операции
Текстовый диалог
Возможности модели
Потоковый ответ, Рассуждения, Вызов инструментов, Вызов функций, Структурированный ответ

Контрольные показатели

Artificial Analysis

16 показателей · проверено

Источник ↗
Индекс интеллекта
11,1 индексСводная оценка Artificial Analysis по всем её тестам

Рассуждение по документу

  • AA-LCR v1.146,7 %

    Рассуждение на длинном контексте с обновлённой оценкой

Устаревшие тесты

  • AA-LCR (версия не указана, архивный)46,7 %

    Оценка рассуждений на длинном контексте

  • GPQA Diamond (архивный)73,3 %

    Научные рассуждения уровня выпускника

Знания

  • AA-Omniscience · точность16,3 %

    Доля вопросов с правильным ответом

  • MMLU-Pro81,5 %

    Профессиональные и академические предметные знания

Знание

  • AA-Omniscience · доля выдуманных ответов (меньше лучше)92,9 %

    Доля неверных ответов среди некорректных ответов

Математика

  • AIME67,3 %

    Американский пригласительный экзамен по математике

  • Math-50096,5 %

    Набор задач для проверки решения разнообразных математических задач

Рассуждения

  • AIME 202580,7 %
  • HLE7 %

    Humanity’s Last Exam — вопросы экспертного уровня

Рассуждение

  • CritPt0 %

    Рассуждения по физике исследовательского уровня

  • IFBench37,6 %

    Тест на следование инструкциям

Программирование

  • LiveCodeBench68,4 %

    Бенчмарк по программированию без загрязнения данных

  • Terminal-Bench Hard (архивный)20,5 %

    Устаревший резервный вариант · Агентное программирование и работа в терминале

Агентная работа

  • T²-Bench Telecom (архивный)46,5 %

    Устаревший резервный вариант · Разговорные ИИ-агенты в сценариях с двойным управлением

Design Arena

12 показателей · проверено

Рейтинг Elo и доля побед в попарных сравнениях, оценённых людьми

Источник ↗

Модели

  • 3D · Elo1 141 Elo
  • 3D · доля побед54,1 %
  • Визуализация данных · Elo1 198 Elo
  • Визуализация данных · доля побед58,5 %
  • Разработка игр · Elo1 107 Elo
  • Разработка игр · доля побед48,4 %
  • SVG · Elo1 076 Elo
  • SVG · доля побед50,8 %
  • UI-компоненты · Elo1 132 Elo
  • UI-компоненты · доля побед54,4 %
  • Сайты · Elo1 154 Elo
  • Сайты · доля побед51,3 %

Оценки относятся к этой версии модели и методике источника. Качество и скорость конкретного запроса они не гарантируют.

API-запрос

Операция доступна через API. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener

class NoRedirect(HTTPRedirectHandler):
    def redirect_request(self, req, fp, code, msg, headers, newurl):
        return None

opener = build_opener(NoRedirect)

def post(url, payload):
    request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    }, method="POST")
    with opener.open(request, timeout=120) as response:
        return json.load(response)

payload = {
  "model": "zhipu/glm-4.5-air",
  "messages": [
    {
      "role": "user",
      "content": "Объясни задачу кратко."
    }
  ]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))
Документация APIСоздать API-ключ