К результатам поиска

DeepSeek

DeepSeek Ocr

DeepSeek-OCR — визуально-языковая модель DeepSeek AI для распознавания текста и сжатого представления контекста изображений. Принимает изображения документов и преобразует их в структурированный текст, включая Markdown.

  • Понимание изображенийПонимание изображенийМодель умеет разбирать содержимое изображений.
  • 8 000 токенов8 000 токеновКонтекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.
  • Потоковый ответПотоковый ответОтвет можно получать по частям. Поддержка потока проверяется отдельно для каждой операции API.
Вход
2,53 ₽
Выход
2,53 ₽
Кэш
2,53 ₽
за 1 млн токенов
Доступность
93,4%
API ID
deepseek/deepseek-ocr

Данные каталога получены .

Цена

Текстовый диалог · вход
2,53 ₽ / 1 млн токенов
Текстовый диалог · выход
2,53 ₽ / 1 млн токенов
Текстовый диалог · вход из кэша
2,53 ₽ / 1 млн токенов
Распознавание текста · вход
2,53 ₽ / 1 млн токенов
Распознавание текста · выход
2,53 ₽ / 1 млн токенов

Цена указана в рублях для выбранной операции и её параметров.

Перед оплачиваемым запросом создаётся резерв. Итоговый расход привязан к сохранённым параметрам и тарифу запроса. При неизвестном результате резерв удерживается до проверки; такой запрос не следует повторять с новым идентификатором.

О модели

DeepSeek-OCR — визуально-языковая модель DeepSeek AI для распознавания текста и сжатого представления контекста изображений. Принимает изображения документов и преобразует их в структурированный текст, включая Markdown. Разработчик: deepseek. Вход: текст, изображения. Выход: текст. Контекст: 8000 токенов.

Релиз

Характеристики

Доступность93,4%
  1. 7 октября: 80,1%
  2. 8 октября: 100%
  3. 9 октября: 100%
Доля успешных запросов к модели за последние 72 часа. Обновляется каждые два часа.
Тип модели
Текст
Вход модели
Текст, Изображения

Данные, которые модель принимает вместе с запросом.

Выход модели
Текст

Форматы результата, которые создаёт модель.

Контекстное окно
8 000 токенов

Контекстное окно по данным каталога. Лимит ответа и допустимый объём запроса проверяйте отдельно.

Операции
Текстовый диалог, Понимание изображений, Распознавание текста
Возможности модели
Потоковый ответ, Понимание изображений, Входные изображения

Контрольные показатели

Для этой версии модели оценок пока нет.

Оценки относятся к этой версии модели и методике источника. Качество и скорость конкретного запроса они не гарантируют.

API-запрос

Операция доступна через API. Ключ храните в переменной окружения на своём сервере. REQUEST_ID: уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, HTTPRedirectHandler, build_opener

class NoRedirect(HTTPRedirectHandler):
    def redirect_request(self, req, fp, code, msg, headers, newurl):
        return None

opener = build_opener(NoRedirect)

def post(url, payload):
    request = Request(url, data=json.dumps(payload).encode("utf-8"), headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    }, method="POST")
    with opener.open(request, timeout=120) as response:
        return json.load(response)

payload = {
  "model": "deepseek/deepseek-ocr",
  "messages": [
    {
      "role": "user",
      "content": "Объясни задачу кратко."
    }
  ]
}
print(post("https://api.kvantora.ai/v1/chat/completions", payload))
Документация APIСоздать API-ключ