Справочник API¶
Claudin.io — это совместимый с OpenAI API. Если вы использовали OpenAI API,
здесь всё знакомо — просто укажите базовый URL Claudin.io и используйте
модель claudinio.
Базовый URL¶
Маршруты в стиле OpenAI находятся по пути /v1.
Аутентификация¶
Отправляйте свой API-ключ с каждым запросом в виде заголовка:
Модель¶
| Идентификатор модели | Контекстное окно |
|---|---|
claudinio |
256K токенов |
Используйте claudinio везде. (Некоторые клиенты ожидают формат provider/model — для
них используйте claudinio/claudinio.)
Эндпоинты¶
| Метод и путь | Описание |
|---|---|
POST /v1/chat/completions |
Чат-завершения — основной эндпоинт |
POST /v1/completions |
Устаревшие текстовые завершения |
POST /v1/messages |
Формат сообщений Anthropic |
POST /v1/responses |
API ответов (Codex) |
POST /v1/embeddings |
Текстовые эмбеддинги |
GET /v1/models |
Список доступных моделей |
Чат-завершения¶
curl https://api.claudin.io/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "claudinio",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Write a haiku about proxies."}
],
"temperature": 0.7
}'
Поддерживаются стандартные параметры OpenAI: messages, temperature, top_p,
max_tokens, stream, stop, tools / tool_choice (вызов функций),
response_format и так далее.
max_tokens и рассуждение¶
Модели Claudinio сначала рассуждают, а затем отвечают, и токены рассуждения учитываются
в max_tokens — один и тот же бюджет покрывает внутреннюю цепочку мыслей и
видимый ответ. Поэтому небольшое значение max_tokens может быть потрачено почти целиком
на рассуждение, оставляя ответ оборванным на полуслове.
Чтобы этого избежать, значения ниже 4000 автоматически повышаются до 4000. Большие значения передаются без изменений, а опускать параметр всегда допустимо.
Если вы разбираете структурированный вывод (JSON, XML, строгий формат),
проверяйте finish_reason перед разбором — "length" означает, что ответ достиг лимита
токенов и неполон, поэтому ошибка разбора ожидаема и не связана с проблемой модели:
choice = response.choices[0]
if choice.finish_reason == "length":
... # truncated — retry with a larger max_tokens
data = json.loads(choice.message.content)
Потоковая передача¶
Установите "stream": true, чтобы получать события, отправляемые сервером, в формате потоковой передачи OpenAI (чанки data: {...}, завершающиеся data: [DONE]).
Вызов инструментов / функций¶
claudinio поддерживает вызовы инструментов. Передавайте tools и читайте tool_calls из ответа — точно так же, как с API OpenAI. Именно это позволяет ему работать внутри агентных редакторов, таких как Claude Code, Kilo и Cursor.
Мультимодальный ввод¶
claudinio — текстовая модель, но Claudin.io прозрачно обрабатывает блоки изображений,
аудио и видео: если вы их отправляете, прокси преобразует их в текстовые
описания/транскрипции до того, как их увидит модель. Вам не нужно делать
ничего особенного — отправляйте стандартные блоки контента OpenAI, и всё работает.
Ошибки¶
Ошибки следуют формату ошибок OpenAI:
| Статус | Значение | Что делать |
|---|---|---|
401 |
Неверный или отсутствующий API-ключ | Проверьте ключ и заголовок аутентификации |
403 |
Эндпоинт не разрешён | Используйте один из поддерживаемых путей /v1/* |
429 |
Достигнут лимит бюджета или превышение скорости | Дождитесь сброса окна или повысьте тариф |
400 |
Некорректный запрос | Проверьте JSON / параметры |
5xx |
Сбой провайдера | Повторите с экспоненциальной задержкой |
Данные о провайдере скрыты намеренно
Сообщения об ошибках очищаются, чтобы не раскрывать базового провайдера модели. Вы всегда будете видеть ошибки в стиле Claudin.io, по форме OpenAI.
Достижение лимита бюджета¶
Когда вы исчерпываете защиту расходов текущего окна, запросы возвращают
ошибку бюджета (обычно 429). Ваша панель управления показывает точное время сброса и
оставшийся бюджет. Смотрите Тарифы и лимиты для информации о работе окон.
Ограничение скорости¶
Claudin.io не блокирует нормальное использование жёстко. Аномальные частоты запросов замедляются
(прозрачный троттлинг), а не отклоняются, поэтому корректные клиенты никогда
не штрафуются. На практике вам не нужно ничего делать — просто повторите при редком
429.