1
Авторизация
Получите API-токен в личном кабинете Palatine Speech
2
Выбор модели
GET /models — получите список доступных моделей
3
Отправка запроса
POST /chat/completions — отправьте сообщения и получите ответ
Использование через OpenAI SDK
Самый простой способ интеграции — использовать официальный OpenAI Python SDK, указав базовый URL Palatine API.Структурированный вывод (Pydantic)
Для получения ответа в виде структурированного объекта используйтеresponse_format с JSON Schema или Pydantic-моделью.
Подробное описание API
Все запросы требуют авторизации через токен в заголовке:
Authorization: Bearer <ваш_токен>Получение списка моделей
Получение списка моделей
Запросите список доступных LLM моделей.Пример ответа:
- Python
- cURL
Отправка сообщений (Chat Completions)
Отправка сообщений (Chat Completions)
Отправьте историю диалога и получите ответ от модели.Пример ответа:
- Python
- cURL
Режим структурированного вывода (JSON)
Режим структурированного вывода (JSON)
Для получения ответа в формате JSON используйте параметр
response_format.- Python
- cURL
Расширенный режим рассуждений (Thinking)
Расширенный режим рассуждений (Thinking)
Включите параметр
thinking для сложных задач, требующих глубокого анализа.- Python
- cURL
Параметры запроса
Параметры запроса
Роли сообщений:
Обработка ошибок
Обработка ошибок
Пример ответа с ошибкой:
Тарификация
Входящие и исходящие токены тарифицируются отдельно:- Входящие токены (
prompt_tokens) — токены в вашем запросе (системный промпт + история диалога + текущее сообщение) - Исходящие токены (
completion_tokens) — токены в ответе модели
usage каждого ответа.
Эндпоинт GET /models не тарифицируется.