API referansı¶
Claudin.io, OpenAI uyumlu bir API'dir. OpenAI API'yi kullandıysanız
buradaki her şey size tanıdık gelir — tek yapmanız gereken Claudin.io temel
URL'sini işaret etmek ve claudinio modelini kullanmak.
Temel URL¶
OpenAI tarzı yollar /v1 altında bulunur.
Kimlik doğrulama¶
API anahtarınızı her istekte aşağıdaki başlıklardan biri olarak gönderin:
Model¶
| Model kimliği | Bağlam penceresi |
|---|---|
claudinio |
256K token |
Her yerde claudinio kullanın. (Bazı istemciler provider/model biçimini
bekler — bunlar için claudinio/claudinio kullanın.)
Uç noktalar¶
| Yöntem ve yol | Açıklama |
|---|---|
POST /v1/chat/completions |
Sohbet tamamlamaları — birincil uç nokta |
POST /v1/completions |
Eski metin tamamlamaları |
POST /v1/messages |
Anthropic Messages biçimi |
POST /v1/responses |
Responses API (Codex) |
POST /v1/embeddings |
Metin gömme vektörleri |
GET /v1/models |
Kullanılabilir modelleri listele |
Sohbet tamamlamaları¶
curl https://api.claudin.io/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "claudinio",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Write a haiku about proxies."}
],
"temperature": 0.7
}'
Standart OpenAI parametreleri desteklenir: messages, temperature, top_p,
max_tokens, stream, stop, tools / tool_choice (fonksiyon çağrısı),
response_format ve diğerleri. Göndermeden önce bilmeye değer sınırları olan iki
parametre vardır: max_tokens bir alt ve bir üst
sınıra sabitlenir, n ise 1 olmalıdır.
max_tokens ve akıl yürütme¶
Claudinio modelleri yanıtlamadan önce akıl yürütür ve akıl yürütme token'ları
max_tokens'tan düşülür — aynı bütçe iç düşünce zincirini ve görünür yanıtı
kapsar. Bu nedenle küçük bir max_tokens neredeyse tamamen akıl yürütmeye
harcanabilir ve yanıt cümlenin ortasında kesilebilir.
Bunu önlemek için 32000'in altındaki değerler otomatik olarak 32000'e yükseltilir. Diğer uçta, 393216'nın üzerindeki değerler 393216'ya — modellerin kabul ettiği maksimuma — düşürülür; çünkü daha büyük bir sayı "ne kadar istersen o kadar" olarak değil, doğrudan reddedilir. İkisi arasındaki her değer olduğu gibi iletilir ve parametreyi atlamak her zaman sorunsuzdur.
max_tokens bir rezervasyon değil, bir tavandır: yalnızca gerçekte üretilen
token'lar için faturalandırılırsınız; bu nedenle cömert bir değerin ek maliyeti
yoktur.
Yapılandırılmış çıktıyı (JSON, XML, katı bir biçim) ayrıştırıyorsanız,
ayrıştırmadan önce finish_reason'ı kontrol edin — "length", yanıtın token
sınırına ulaştığı ve eksik olduğu anlamına gelir; bu nedenle ayrıştırma hatası
bozuk model sorunu değil, beklenen bir durumdur:
choice = response.choices[0]
if choice.finish_reason == "length":
... # truncated — retry with a larger max_tokens
data = json.loads(choice.message.content)
Birden çok tamamlama (n)¶
Yalnızca n = 1 desteklenir. n değerini 1'den büyük göndermek,
"code": "unsupported_parameter" ile 400 döndürür; parametreyi atlamak her
zaman güvenlidir.
Claudinio modelleri yanıtlamadan önce akıl yürütür ve akıl yürütme geçişi tek
bir düşünce hattı üretir — bunu birkaç bağımsız adaya dallandırmanın ucuz bir
yolu yoktur, bu yüzden yukarı akış sağlayıcıları da böyle bir seçenek sunmaz.
Birden fazla aday istiyorsanız, isteği birden çok kez gönderin (daha yüksek bir
temperature size çeşitlilik sağlar) ve her birinin ayrıca faturalandırıldığını
unutmayın.
n > 1 değerini sessizce tek bir seçenek döndürmek yerine reddederiz: dört
isteyen ve bir alan bir istemci genellikle daha sonra kendi kodunun içinde,
nedenini açıklayan bizden bir hata olmadan başarısız olur.
Akış¶
OpenAI akış biçiminde sunucu tarafından gönderilen olayları almak için
"stream": true olarak ayarlayın (data: {...} parçaları data: [DONE] ile
sonlandırılır).
Araç / fonksiyon çağrısı¶
claudinio araç çağrılarını destekler. Tıpkı OpenAI API'de olduğu gibi tools
parametresini iletin ve yanıttan tool_calls değerini okuyun. Claude Code, Kilo
ve Cursor gibi ajan tabanlı editörlerin içinde çalışmasını sağlayan şey budur.
Çok modlu girdi¶
claudinio bir metin modelidir, ancak Claudin.io görsel, ses ve video
bloklarını şeffaf bir şekilde işler: bunları gönderirseniz, proxy bunları
model görmeden önce metin açıklamalarına/yazıya dökümlerine dönüştürür. Özel bir
şey yapmanıza gerek yok — standart OpenAI içerik blokları gönderin ve her şey
çalışır.
Hatalar¶
Hatalar OpenAI hata biçimini izler:
| Durum | Anlam | Ne yapmalı |
|---|---|---|
401 |
Geçersiz veya eksik API anahtarı | Anahtarı ve kimlik doğrulama başlığını kontrol edin |
403 |
Uç noktaya izin verilmiyor | Desteklenen /v1/* yollarından birini kullanın |
402 |
Etkin abonelik yok | Abone olun — yeniden denemek işe yaramaz |
429 |
Bütçe sınırına ulaşıldı veya hız sınırlaması uygulandı | Pencere sıfırlanmasını bekleyin (Retry-After başlığına bakın) veya yükseltin |
400 |
Hatalı istek | JSON / parametrelerinizi kontrol edin — max_tokens ve n bölümlerine bakın |
5xx |
Yukarı akış/sağlayıcı aksaması | Geri çekilme (backoff) ile yeniden deneyin |
Sağlayıcı ayrıntıları tasarım gereği gizlidir
Hata mesajları, altta yatan model sağlayıcısını sızdırmamak için temizlenir. Her zaman Claudin.io markalı, OpenAI biçimli hatalar görürsünüz.
Bütçe sınırına ulaşma¶
Geçerli pencerenin harcama korumasını tükettiğinizde, istekler pencere
sıfırlanana kadarki saniyeleri veren bir Retry-After başlığıyla 429
döndürür. Panonuz tam sıfırlanma zamanını ve kalan bütçeyi gösterir. Hemen
yeniden denemek yerine bu başlığa göre bekleyin. Pencerelerin nasıl çalıştığı
için Planlar ve limitler bölümüne bakın.
429 yerine bir mesaj¶
Az sayıda hesapta aynı duruma farklı bir yanıt deniyoruz. Hata yerine istek tamamlanıyor ve yanıtın kendisi tavana ulaşıldığını ve ne zaman sıfırlanacağını açıklıyor. Bunun, ajanlarının sessizce yuttuğu bir hataya kıyasla bilgiyi insanlara daha güvenilir şekilde ulaştırıp ulaştırmadığını ölçüyoruz — ve açıkça söylendiğinde kendilerine uygun bir plana geçmeyi tercih edip etmediklerini.
Otomasyon geliştiriyorsan bir 2xx'i "iş yapıldı" diye okuma. Tavana
ulaşıldığını söyleyen bir yanıtı tavana ulaşılmış say ve pencere sıfırlanana
kadar bekle. Yukarıdaki 429 varsayılan davranış olmayı sürdürüyor ve hemen
hemen her hesabın aldığı yanıt bu.
Hız sınırlama¶
Claudin.io normal kullanımı kesin olarak engellemez. Kötüye kullanılan istek
hızları reddedilmek yerine yavaşlatılır (şeffaf bir kısma mekanizması),
böylece düzgün davranan istemciler asla cezalandırılmaz. Pratikte hiçbir şey
yapmanıza gerek yok — nadir görülen 429 durumunda yalnızca yeniden deneyin.