HI ▾
API कुंजी पाएँ

होमदस्तावेज़

Llama API: पाँच मिनट में पहला अनुरोध

पाँच मिनट से कम समय में एक बिना सेंसर LLM से अपना पहला उत्तर प्राप्त करें। यह क्विकस्टार्ट दिखाता है कि आप अपने मौजूदा OpenAI क्लाइंट कॉन्फ़िगरेशन को हमारे बेस URL और API कुंजी के साथ कैसे बदलें।

https://api.llamaapis.com/v1uncensored

llamaapis.com

इंस्टॉलेशन

औपचारिक OpenAI Python क्लाइंट को इंस्टॉल करके शुरू करें। यह आपके लिए HTTP अनुरोधों और JSON पarsing संभालता है।

  • pip install openai

आप Node.js के लिए JavaScript SDK का भी उपयोग कर सकते हैं। दोनों लाइब्रेरीं हमारे API के साथ पूरी तरह संगत हैं क्योंकि हम OpenAI chat-completions स्पेसिफिकेशन का सटीक पालन करते हैं।

प्रमाणीकरण सेटअप

हमारा API मानक API कुंजी प्रमाणीकरण का उपयोग करता है। https://llamaapis.com पर साइन इन करने के बाद, आपको तुरंत एक कुंजी मिल जाती है। ट्रायल टियर के लिए कोई क्रेडिट कार्ड की आवश्यकता नहीं है।

इस कुंजी को एक एन्वायरनमेंट वेरिएबल में स्टोर करें या इसे सीधे अपने क्लाइंट में पास करें। यह कुंजी /v1 एंडपॉइंट्स को सभी अनुरोधों के लिए प्रमाणीकृत करती है। यदि आपकी कुंजी खो जाती है, तो आप अपने डैशबोर्ड से इसे रीजेनरेट कर सकते हैं, जिससे पुरानी कुंजी तुरंत अमान्य हो जाती है।

बेसिक चैट कंप्लीशन अनुरोध

चैट कंप्लीशन एंडपॉइंट पर एक अनुरोध करें। आपको बेस URL को हमारे सर्वर पर सेट करना होगा और अपनी API कुंजी प्रदान करनी होगी।

मॉडल आईडी uncensored है। यह मॉडल कानूनी वयस्क उपयोग के लिए मानक कंटेंट फिल्टर्स लागू नहीं करता है।

यहाँ curl का उपयोग करके एक सरल अनुरोध कैसे करें, यह दिया गया है:

curl https://api.llamaapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

प्रतिक्रिया एक जनरेटेड टेक्स्ट स्ट्रिंग लौटाती है। यदि आपको फ़ंक्शन कॉलिंग की आवश्यकता है, तो संरचना OpenAI के प्रारूप के समान ही है।

स्ट्रीमिंग प्रतिक्रियाएँ (SSE)

रियल-टाइम आउटपुट के लिए, stream: true सेट करके स्ट्रीमिंग सक्षम करें। सर्वर आंशिक डेल्टा वाले सर्वर-सेंट इवेंट्स (SSE) भेजता है।

यह उन चैट इंटरफेस के लिए उपयोगी है जहाँ आप टेक्स्ट को जनरेट होते हुए दिखाना चाहते हैं। कॉन्टेक्स्ट विंडो 100,000 टोकन तक का समर्थन करती है, इसलिए लंबी बातचीत के लिए भी स्ट्रीमिंग कुशलतापूर्वक काम करती है।

उदाहरण स्ट्रीमिंग इम्प्लीमेंटेशन:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

कनेक्शन को साफ़ तरीके से बंद करने के लिए stop इवेंट को हैंडल करना न भूलें।

टूल/फ़ंक्शन कॉलिंग सहायता

हमारा API संरचित टूल कॉलिंग का समर्थन करता है। अपने फ़ंक्शन्स को tools पैरामीटर में परिभाषित करें और मॉडल को फ़ंक्शन कॉल के साथ प्रतिक्रिया देने के लिए सेट करें।

क्लाइंट लाइब्रेरी स्वचालित रूप से JSON तर्कों को पार्स करेगी। यह OpenAI स्पेसिफिकेशन में दस्तावेज़ीकृत के बिल्कुल समान काम करता है।

Python SDK का उपयोग करके उदाहरण:

from openai import OpenAI

client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

मॉडल फ़ंक्शन नाम और तर्क लौटाएगा। आप फ़ंक्शन निष्पादित करते हैं और अगले संदेश में परिणाम वापस भेजते हैं।

सीमाएँ, त्रुटियाँ और कॉन्टेक्स्ट

निम्नलिखित सीमाओं के बारे में जागरूक रहें:

  • रेट लिमिट: प्रति मिनट प्रति API कुंजी 300 अनुरोध।
  • मैक्स रिक्वेस्ट बॉडी: 8 MB।
  • कॉन्टेक्स्ट विंडो: 100,000 टोकन कुल (इनपुट + आउटपुट)।

सामान्य त्रुटियाँ:

  • 401 अनअथोराइज्ड: अमान्य या अनुपलब्ध API कुंजी।
  • 402 पेमेंट रिक्वायर्ड: अपर्याप्त प्रीपेड क्रेडिट।
  • 429 Too Many Requests: आपने 300 rpm की सीमा को पार कर लिया है।

हम एम्बेडिंग्स, इमेज जनरेशन या ऑडियो प्रोसेसिंग नहीं प्रदान करते हैं। यह एक टेक्स्ट-ओनली LLM API है।

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.llamaapis.com/v1
मॉडल IDuncensored
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
अनुरोध का आकार8 MB तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
बोनस$50 से +5%, $100 से +10%
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार
साइन इनGoogle या ईमेल और पासवर्ड

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

llamaapis.com
यदि मैं अपनी प्रीपेड क्रेडिट से अधिक उपयोग कर लेता हूँ तो क्या होता है?

आपके अनुरोधों को 402 त्रुटि मिलेगी जब तक कि आप अपने खाते में टॉप-अप न करें। आप $10 से शुरू होने वाली क्रिप्टो (USDT या USDC) के माध्यम से क्रेडिट जोड़ सकते हैं। मौजूदा प्रीपेड क्रेडिट कभी समाप्त नहीं होता।

क्या बिना सेंसर मॉडल फाइन-ट्यून्ड है या बेस?

यह एक ओपन-वेट मॉडल है जो हमारे अपने GPU सर्वरों पर चलाया जाता है, विशेष रूप से कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है। यह GPT या Claude की सीधी प्रतिलिपि नहीं है।

क्या मैं OpenAI के साथ उपयोग करने वाला ही SDK कोड उपयोग कर सकता हूँ?

हाँ। <code>base_url</code> को <code>https://api.llamaapis.com/v1</code> पर बदलें और API कुंजी अपडेट करें। अनुरोध और प्रतिक्रिया प्रारूप संगत हैं।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएँ, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ