Создать ответ

POST https://api.deepseek.com/chat/completions
Создает ответ для заданного чата.

Обязательные параметры:

messages Тип: object[] Массив сообщений, представляющих беседу.
model Тип: string Возможные значения: [deepseek-chat, deepseek-reasoner] Идентификатор модели, которую следует использовать. Например, можно использовать deepseek-chat.

Дополнительные параметры:

frequency_penalty Тип: number (может быть null) Возможные значения: от -2 до 2 Значение по умолчанию: 0 Число от -2.0 до 2.0. Положительные значения штрафуют новые токены на основе их частоты в тексте, уменьшая вероятность повторения моделью одних и тех же фраз.
max_tokens Тип: integer (может быть null) Возможные значения: больше 1 Максимальное количество токенов, которые могут быть сгенерированы в ответе. Общая длина входных и сгенерированных токенов ограничена длиной контекста модели. Если max_tokens не указан, используется значение по умолчанию 4096.
presence_penalty Тип: number (может быть null) Возможные значения: от -2 до 2 Значение по умолчанию: 0 Число от -2.0 до 2.0. Положительные значения штрафуют новые токены на основе их появления в тексте, увеличивая вероятность того, что модель будет говорить на новые темы.
response_format Тип: object (может быть null) Формат ответа.
stop Тип: object (может быть null) Условия остановки генерации.
stream Тип: boolean (может быть null) Если включено, частичные сообщения будут отправляться по мере их генерации. Токены будут отправляться как события сервера (SSE) и завершаться сообщением data: [DONE].
stream_options Тип: object (может быть null) Опции для потоковой передачи.
temperatureТип: number (может быть null) Возможные значения: меньше или равно 2 Значение по умолчанию: 1 Температура выборки, от 0 до 2. Более высокие значения (например, 0.8) делают вывод более случайным, а низкие значения (например, 0.2) — более сфокусированным и детерминированным. Рекомендуется изменять либо temperature, либо top_p, но не оба одновременно.
top_p Тип: number (может быть null) Возможные значения: меньше или равно 1 Значение по умолчанию: 1 Альтернатива выборки с температурой, называемая ядерной выборкой. Модель рассматривает токены с наибольшей вероятностью (например, 0.1 означает, что рассматриваются только токены с верхними 10% вероятности). Рекомендуется изменять либо top_p, либо temperature, но не оба одновременно.
tools Тип: object[] (может быть null) Инструменты, доступные для модели.
tool_choice Тип: object (может быть null) Выбор инструмента.
logprobs Тип: boolean (может быть null) Возвращать ли логарифмические вероятности выходных токенов. Если true, возвращает логарифмические вероятности для каждого токена в ответе.
top_logprobs Тип: integer (может быть null) Возможные значения: меньше или равно 20 Целое число от 0 до 20, указывающее количество наиболее вероятных токенов для возврата на каждой позиции токена, каждый с соответствующей логарифмической вероятностью. Параметр logprobs должен быть true, если используется этот параметр.

Ответ

200 (Без потоковой передачи)
200 (С потоковой передачей)
Успешный ответ, возвращает объект завершения чата.
Тип содержимого: application/json
Схема ответа:

id
Тип: string
Уникальный идентификатор завершения чата.

choices
Тип: object[]
Массив вариантов ответа.

created
Тип: integer
Временная метка Unix (в секундах) создания завершения чата.

model
Тип: string
Модель, использованная для завершения чата.

system_fingerprint
Тип: string
Этот отпечаток представляет конфигурацию серверной части, с которой работает модель.

object
Тип: string
Возможные значения: [chat.completion]
Тип объекта, всегда chat.completion.

usage
Тип: object
Информация об использовании токенов.

Пример запроса (cURL)
bash
Copy
curl -L -X POST 'https://api.deepseek.com/chat/completions' \
-H 'Content-Type: application/json' \
-H 'Accept: application/json' \
-H 'Authorization: Bearer ' \
--data-raw '{
  "messages": [
    {
      "content": "You are a helpful assistant",
      "role": "system"
    },
    {
      "content": "Hi",
      "role": "user"
    }
  ],
  "model": "deepseek-chat",
  "frequency_penalty": 0,
  "max_tokens": 2048,
  "presence_penalty": 0,
  "response_format": {
    "type": "text"
  },
  "stop": null,
  "stream": false,
  "stream_options": null,
  "temperature": 1,
  "top_p": 1,
  "tools": null,
  "tool_choice": "none",
  "logprobs": false,
  "top_logprobs": null
}'
Пример запроса (JSON)
json
Copy
{
  "messages": [
    {
      "content": "You are a helpful assistant",
      "role": "system"
    },
    {
      "content": "Hi",
      "role": "user"
    }
  ],
  "model": "deepseek-chat",
  "frequency_penalty": 0,
  "max_tokens": 2048,
  "presence_penalty": 0,
  "response_format": {
    "type": "text"
  },
  "stop": null,
  "stream": false,
  "stream_options": null,
  "temperature": 1,
  "top_p": 1,
  "tools": null,
  "tool_choice": "none",
  "logprobs": false,
  "top_logprobs": null
}