Перейти к содержанию

Справочник API

Claudin.io — это совместимый с OpenAI API. Если вы использовали OpenAI API, здесь всё знакомо — просто укажите базовый URL Claudin.io и используйте модель claudinio.

Базовый URL

https://api.claudin.io

Маршруты в стиле OpenAI находятся по пути /v1.

Аутентификация

Отправляйте свой API-ключ с каждым запросом в виде заголовка:

Authorization: Bearer YOUR_API_KEY
x-api-key: YOUR_API_KEY

Модель

Идентификатор модели Контекстное окно
claudinio 256K токенов

Используйте claudinio везде. (Некоторые клиенты ожидают формат provider/model — для них используйте claudinio/claudinio.)

Эндпоинты

Метод и путь Описание
POST /v1/chat/completions Чат-завершения — основной эндпоинт
POST /v1/completions Устаревшие текстовые завершения
POST /v1/messages Формат сообщений Anthropic
POST /v1/responses API ответов (Codex)
POST /v1/embeddings Текстовые эмбеддинги
GET /v1/models Список доступных моделей

Чат-завершения

curl https://api.claudin.io/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "claudinio",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Write a haiku about proxies."}
    ],
    "temperature": 0.7
  }'

Поддерживаются стандартные параметры OpenAI: messages, temperature, top_p, max_tokens, stream, stop, tools / tool_choice (вызов функций), response_format и так далее.

max_tokens и рассуждение

Модели Claudinio сначала рассуждают, а затем отвечают, и токены рассуждения учитываются в max_tokens — один и тот же бюджет покрывает внутреннюю цепочку мыслей и видимый ответ. Поэтому небольшое значение max_tokens может быть потрачено почти целиком на рассуждение, оставляя ответ оборванным на полуслове.

Чтобы этого избежать, значения ниже 4000 автоматически повышаются до 4000. Большие значения передаются без изменений, а опускать параметр всегда допустимо.

Если вы разбираете структурированный вывод (JSON, XML, строгий формат), проверяйте finish_reason перед разбором — "length" означает, что ответ достиг лимита токенов и неполон, поэтому ошибка разбора ожидаема и не связана с проблемой модели:

choice = response.choices[0]
if choice.finish_reason == "length":
    ...  # truncated — retry with a larger max_tokens
data = json.loads(choice.message.content)

Потоковая передача

Установите "stream": true, чтобы получать события, отправляемые сервером, в формате потоковой передачи OpenAI (чанки data: {...}, завершающиеся data: [DONE]).

Вызов инструментов / функций

claudinio поддерживает вызовы инструментов. Передавайте tools и читайте tool_calls из ответа — точно так же, как с API OpenAI. Именно это позволяет ему работать внутри агентных редакторов, таких как Claude Code, Kilo и Cursor.

Мультимодальный ввод

claudinio — текстовая модель, но Claudin.io прозрачно обрабатывает блоки изображений, аудио и видео: если вы их отправляете, прокси преобразует их в текстовые описания/транскрипции до того, как их увидит модель. Вам не нужно делать ничего особенного — отправляйте стандартные блоки контента OpenAI, и всё работает.

Ошибки

Ошибки следуют формату ошибок OpenAI:

{ "error": { "message": "…", "type": "…", "code": "…" } }
Статус Значение Что делать
401 Неверный или отсутствующий API-ключ Проверьте ключ и заголовок аутентификации
403 Эндпоинт не разрешён Используйте один из поддерживаемых путей /v1/*
429 Достигнут лимит бюджета или превышение скорости Дождитесь сброса окна или повысьте тариф
400 Некорректный запрос Проверьте JSON / параметры
5xx Сбой провайдера Повторите с экспоненциальной задержкой

Данные о провайдере скрыты намеренно

Сообщения об ошибках очищаются, чтобы не раскрывать базового провайдера модели. Вы всегда будете видеть ошибки в стиле Claudin.io, по форме OpenAI.

Достижение лимита бюджета

Когда вы исчерпываете защиту расходов текущего окна, запросы возвращают ошибку бюджета (обычно 429). Ваша панель управления показывает точное время сброса и оставшийся бюджет. Смотрите Тарифы и лимиты для информации о работе окон.

Ограничение скорости

Claudin.io не блокирует нормальное использование жёстко. Аномальные частоты запросов замедляются (прозрачный троттлинг), а не отклоняются, поэтому корректные клиенты никогда не штрафуются. На практике вам не нужно ничего делать — просто повторите при редком 429.