API संदर्भ¶
Claudin.io एक OpenAI-संगत API है। यदि आपने OpenAI API का उपयोग किया है, तो यहाँ सब कुछ परिचित है — बस Claudin.io बेस URL की ओर इंगित करें और claudinio मॉडल का उपयोग करें।
बेस URL¶
OpenAI-शैली के रूट /v1 के अंतर्गत रहते हैं।
प्रमाणीकरण¶
प्रत्येक अनुरोध के साथ अपनी API कुंजी भेजें, या तो हेडर के रूप में:
मॉडल¶
| मॉडल आईडी | संदर्भ विंडो |
|---|---|
claudinio |
256K टोकन |
हर जगह claudinio का उपयोग करें। (कुछ क्लाइंट provider/model प्रारूप की अपेक्षा करते हैं — उनके लिए, claudinio/claudinio का उपयोग करें।)
एंडपॉइंट्स¶
| विधि और पथ | विवरण |
|---|---|
POST /v1/chat/completions |
चैट पूर्णताएँ — प्राथमिक एंडपॉइंट |
POST /v1/completions |
लीगेसी टेक्स्ट पूर्णताएँ |
POST /v1/messages |
Anthropic Messages प्रारूप |
POST /v1/responses |
प्रतिक्रिया API (Codex) |
POST /v1/embeddings |
टेक्स्ट एम्बेडिंग |
GET /v1/models |
उपलब्ध मॉडलों की सूची बनाएँ |
चैट पूर्णताएँ¶
curl https://api.claudin.io/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "claudinio",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Write a haiku about proxies."}
],
"temperature": 0.7
}'
मानक OpenAI पैरामीटर समर्थित हैं: messages, temperature, top_p,
max_tokens, stream, stop, tools / tool_choice (फंक्शन कॉलिंग),
response_format, और इसी प्रकार।
max_tokens और तर्क¶
Claudinio मॉडल उत्तर देने से पहले तर्क करते हैं, और reasoning टोकन max_tokens में गिने जाते हैं — वही बजट आंतरिक chain-of-thought और दृश्य उत्तर को कवर करता है। इसलिए एक छोटा max_tokens लगभग पूरी तरह से reasoning पर खर्च हो सकता है, जिससे उत्तर बीच में ही कट जाता है।
इसे रोकने के लिए, 4000 से कम मान स्वचालित रूप से 4000 तक बढ़ा दिए जाते हैं। बड़े मान बिना किसी बदलाव के पारित हो जाते हैं, और पैरामीटर को छोड़ना हमेशा ठीक है।
यदि आप संरचित आउटपुट (JSON, XML, एक सख्त प्रारूप) को पार्स करते हैं, तो पार्स करने से पहले finish_reason जाँचें — "length" का अर्थ है कि प्रतिक्रिया टोकन सीमा तक पहुँच गई है और अपूर्ण है, इसलिए पार्स विफलता एक दोषपूर्ण मॉडल समस्या के बजाय अपेक्षित है:
choice = response.choices[0]
if choice.finish_reason == "length":
... # truncated — retry with a larger max_tokens
data = json.loads(choice.message.content)
स्ट्रीमिंग¶
प्राप्त करने के लिए "stream": true सेट करें सर्वर-भेजी गई घटनाएँ OpenAI स्ट्रीमिंग प्रारूप में (data: {...} खंड data: [DONE] द्वारा समाप्त होते हैं)।
टूल / फंक्शन कॉलिंग¶
claudinio टूल कॉल्स का समर्थन करता है। tools पास करें और प्रतिक्रिया से tool_calls वापस पढ़ें, बिल्कुल OpenAI API की तरह। यही इसे Claude Code, Kilo, और Cursor जैसे एजेंटिक एडिटर के अंदर काम करने में सक्षम बनाता है।
मल्टीमॉडल इनपुट¶
claudinio एक टेक्स्ट मॉडल है, लेकिन Claudin.io पारदर्शी रूप से संभालता है छवियों, ऑडियो और वीडियो ब्लॉक: यदि आप उन्हें भेजते हैं, तो प्रॉक्सी उन्हें मॉडल के देखने से पहले टेक्स्ट विवरण/प्रतिलेखन में बदल देता है। आपको कुछ विशेष करने की आवश्यकता नहीं है — मानक OpenAI सामग्री ब्लॉक भेजें और यह काम करता है।
त्रुटियाँ¶
त्रुटियाँ OpenAI त्रुटि संरचना का अनुसरण करती हैं:
| स्थिति | अर्थ | क्या करें |
|---|---|---|
401 |
अमान्य या गुम API कुंजी | कुंजी और प्रमाणीकरण हेडर जाँचें |
403 |
एंडपॉइंट की अनुमति नहीं | समर्थित /v1/* पथों में से एक का उपयोग करें |
429 |
बजट सीमा पहुँच गई या दर सीमित | विंडो रीसेट की प्रतीक्षा करें या अपग्रेड करें |
400 |
विकृत अनुरोध | अपने JSON / पैरामीटर जाँचें |
5xx |
अपस्ट्रीम/प्रदाता में रुकावट | बैकऑफ़ के साथ पुनः प्रयास करें |
प्रदाता विवरण डिज़ाइन द्वारा छिपाए गए हैं
त्रुटि संदेशों को स्वच्छ किया जाता है ताकि वे अंतर्निहित मॉडल प्रदाता को लीक न करें। आपको हमेशा Claudin.io-ब्रांडेड, OpenAI-आकार की त्रुटियाँ दिखाई देंगी।
बजट सीमा से टकराना¶
जब आप वर्तमान विंडो की व्यय सुरक्षा समाप्त कर देते हैं, तो अनुरोध एक बजट त्रुटि (आमतौर पर 429) लौटाते हैं। आपका डैशबोर्ड सटीक रीसेट समय और शेष बजट दिखाता है। विंडो कैसे काम करती हैं, इसके लिए योजनाएँ और सीमाएँ देखें।
दर सीमित करना¶
Claudin.io सामान्य उपयोग को कठोरता से अवरुद्ध नहीं करता है। दुरुपयोगी अनुरोध दरों को अस्वीकार करने के बजाय धीमा किया जाता है (एक पारदर्शी थ्रॉटल), इसलिए अच्छे व्यवहार वाले क्लाइंट को कभी दंडित नहीं किया जाता है। व्यवहार में आपको कुछ भी करने की आवश्यकता नहीं है — बस दुर्लभ 429 पर पुनः प्रयास करें।