होम/दस्तावेज़
Llama API: पाँच मिनट में पहला अनुरोध
पाँच मिनट से कम समय में एक बिना सेंसर LLM से अपना पहला उत्तर प्राप्त करें। यह क्विकस्टार्ट दिखाता है कि आप अपने मौजूदा OpenAI क्लाइंट कॉन्फ़िगरेशन को हमारे बेस URL और API कुंजी के साथ कैसे बदलें।
https://api.llamaapis.com/v1uncensored
इंस्टॉलेशन
औपचारिक OpenAI Python क्लाइंट को इंस्टॉल करके शुरू करें। यह आपके लिए HTTP अनुरोधों और JSON पarsing संभालता है।
- pip install openai
आप Node.js के लिए JavaScript SDK का भी उपयोग कर सकते हैं। दोनों लाइब्रेरीं हमारे API के साथ पूरी तरह संगत हैं क्योंकि हम OpenAI chat-completions स्पेसिफिकेशन का सटीक पालन करते हैं।
प्रमाणीकरण सेटअप
हमारा API मानक API कुंजी प्रमाणीकरण का उपयोग करता है। https://llamaapis.com पर साइन इन करने के बाद, आपको तुरंत एक कुंजी मिल जाती है। ट्रायल टियर के लिए कोई क्रेडिट कार्ड की आवश्यकता नहीं है।
इस कुंजी को एक एन्वायरनमेंट वेरिएबल में स्टोर करें या इसे सीधे अपने क्लाइंट में पास करें। यह कुंजी /v1 एंडपॉइंट्स को सभी अनुरोधों के लिए प्रमाणीकृत करती है। यदि आपकी कुंजी खो जाती है, तो आप अपने डैशबोर्ड से इसे रीजेनरेट कर सकते हैं, जिससे पुरानी कुंजी तुरंत अमान्य हो जाती है।
बेसिक चैट कंप्लीशन अनुरोध
चैट कंप्लीशन एंडपॉइंट पर एक अनुरोध करें। आपको बेस URL को हमारे सर्वर पर सेट करना होगा और अपनी API कुंजी प्रदान करनी होगी।
मॉडल आईडी uncensored है। यह मॉडल कानूनी वयस्क उपयोग के लिए मानक कंटेंट फिल्टर्स लागू नहीं करता है।
यहाँ curl का उपयोग करके एक सरल अनुरोध कैसे करें, यह दिया गया है:
curl https://api.llamaapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'प्रतिक्रिया एक जनरेटेड टेक्स्ट स्ट्रिंग लौटाती है। यदि आपको फ़ंक्शन कॉलिंग की आवश्यकता है, तो संरचना OpenAI के प्रारूप के समान ही है।
स्ट्रीमिंग प्रतिक्रियाएँ (SSE)
रियल-टाइम आउटपुट के लिए, stream: true सेट करके स्ट्रीमिंग सक्षम करें। सर्वर आंशिक डेल्टा वाले सर्वर-सेंट इवेंट्स (SSE) भेजता है।
यह उन चैट इंटरफेस के लिए उपयोगी है जहाँ आप टेक्स्ट को जनरेट होते हुए दिखाना चाहते हैं। कॉन्टेक्स्ट विंडो 100,000 टोकन तक का समर्थन करती है, इसलिए लंबी बातचीत के लिए भी स्ट्रीमिंग कुशलतापूर्वक काम करती है।
उदाहरण स्ट्रीमिंग इम्प्लीमेंटेशन:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)कनेक्शन को साफ़ तरीके से बंद करने के लिए stop इवेंट को हैंडल करना न भूलें।
टूल/फ़ंक्शन कॉलिंग सहायता
हमारा API संरचित टूल कॉलिंग का समर्थन करता है। अपने फ़ंक्शन्स को tools पैरामीटर में परिभाषित करें और मॉडल को फ़ंक्शन कॉल के साथ प्रतिक्रिया देने के लिए सेट करें।
क्लाइंट लाइब्रेरी स्वचालित रूप से JSON तर्कों को पार्स करेगी। यह OpenAI स्पेसिफिकेशन में दस्तावेज़ीकृत के बिल्कुल समान काम करता है।
Python SDK का उपयोग करके उदाहरण:
from openai import OpenAI
client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)मॉडल फ़ंक्शन नाम और तर्क लौटाएगा। आप फ़ंक्शन निष्पादित करते हैं और अगले संदेश में परिणाम वापस भेजते हैं।
सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट
निम्नलिखित सीमाओं के बारे में जागरूक रहें:
- रेट लिमिट: प्रति मिनट प्रति API कुंजी 300 अनुरोध।
- मैक्स रिक्वेस्ट बॉडी: 8 MB।
- कॉन्टेक्स्ट विंडो: 100,000 टोकन कुल (इनपुट + आउटपुट)।
सामान्य त्रुटियाँ:
- 401 अनअथोराइज्ड: अमान्य या अनुपलब्ध API कुंजी।
- 402 पेमेंट रिक्वायर्ड: अपर्याप्त प्रीपेड क्रेडिट।
- 429 Too Many Requests: आपने 300 rpm की सीमा को पार कर लिया है।
हम एम्बेडिंग्स, इमेज जनरेशन या ऑडियो प्रोसेसिंग नहीं प्रदान करते हैं। यह एक टेक्स्ट-ओनली LLM API है।
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.llamaapis.com/v1 |
| मॉडल ID | uncensored |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| अनुरोध का आकार | 8 MB तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| बोनस | $50 से +5%, $100 से +10% |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| साइन इन | Google या ईमेल और पासवर्ड |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
यदि मैं अपनी प्रीपेड क्रेडिट से अधिक उपयोग कर लेता हूँ तो क्या होता है?
आपके अनुरोधों को 402 त्रुटि मिलेगी जब तक कि आप अपने खाते में टॉप-अप न करें। आप $10 से शुरू होने वाली क्रिप्टो (USDT या USDC) के माध्यम से क्रेडिट जोड़ सकते हैं। मौजूदा प्रीपेड क्रेडिट कभी समाप्त नहीं होता।
क्या बिना सेंसर मॉडल फाइन-ट्यून्ड है या बेस?
यह एक ओपन-वेट मॉडल है जो हमारे अपने GPU सर्वरों पर चलाया जाता है, विशेष रूप से कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है। यह GPT या Claude की सीधी प्रतिलिपि नहीं है।
क्या मैं OpenAI के साथ उपयोग करने वाला ही SDK कोड उपयोग कर सकता हूँ?
हाँ। <code>base_url</code> को <code>https://api.llamaapis.com/v1</code> पर बदलें और API कुंजी अपडेट करें। अनुरोध और प्रतिक्रिया प्रारूप संगत हैं।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।