ПРОТОК

Chat Completions

POST /v1/chat/completions — основной эндпоинт. Поддержаны параметры model, messages, system (через role), temperature, max_tokens, stream, вызовы инструментов и JSON-режим у моделей, которые это умеют (см. карточку модели).

Стриминг

При "stream": true ответ приходит серверными событиями (SSE) в формате OpenAI; итоговая стоимость — в финальном событии и в заголовке x-pt-cost-rub.

curl https://dualchat.pro/v1/chat/completions \
  -H "Authorization: Bearer sk-dc-…" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.2-pro",
    "stream": true,
    "temperature": 0.7,
    "max_tokens": 1024,
    "messages": [
      {"role": "system", "content": "Отвечай кратко."},
      {"role": "user", "content": "Что такое кэширование промпта?"}
    ]
  }'