Beranda/Dokumen
API Llama: Permintaan pertama dalam lima menit
Dapatkan respons pertama dari LLM tanpa sensor dalam waktu kurang dari lima menit. Quickstart ini menunjukkan cara mengganti konfigurasi klien OpenAI Anda dengan URL dasar dan kunci API kami.
https://api.llamaapis.com/v1uncensored
Instalasi
Mulailah dengan menginstal klien Python OpenAI resmi. Ini menangani permintaan HTTP dan parsing JSON untuk Anda.
- pip install openai
Anda juga dapat menggunakan SDK JavaScript untuk Node.js. Kedua pustaka ini sepenuhnya kompatibel dengan API kami karena kami mengikuti spesifikasi chat-completions OpenAI secara tepat.
Pengaturan Autentikasi
API kami menggunakan autentikasi kunci API standar. Setelah mendaftar di https://llamaapis.com, Anda menerima kunci secara instan. Tidak diperlukan kartu kredit untuk tier uji coba.
Simpan kunci ini dalam variabel lingkungan atau berikan langsung ke klien Anda. Kunci ini mengautentikasi semua permintaan ke endpoint /v1. Jika Anda kehilangan kunci, Anda dapat membuat ulang kunci tersebut dari dasbor Anda, yang akan membuat kunci lama tidak berlaku secara instan.
Permintaan Penyelesaian Chat Dasar
Buat permintaan ke endpoint penyelesaian chat. Anda harus mengatur URL dasar ke server kami dan menyediakan kunci API Anda.
ID model adalah uncensored. Model ini tidak menerapkan filter konten standar untuk penggunaan dewasa yang sah.
Berikut cara membuat permintaan sederhana menggunakan curl:
curl https://api.llamaapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Respons mengembalikan string teks yang dihasilkan. Jika Anda memerlukan pemanggilan fungsi, strukturnya identik dengan format OpenAI.
Respons Streaming (SSE)
Untuk output waktu nyata, aktifkan streaming dengan mengatur stream: true. Server mengirim Event yang Dikirim Server (SSE) yang berisi delta parsial.
Ini berguna untuk antarmuka chat di mana Anda ingin menampilkan teks saat teks tersebut dihasilkan. Jendela konteks mendukung hingga 100.000 token, sehingga streaming bekerja secara efisien bahkan untuk percakapan panjang.
Contoh implementasi streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Ingatlah untuk menangani peristiwa stop untuk menutup koneksi dengan bersih.
Dukungan Pemanggilan Alat/Fungsi
API kami mendukung pemanggilan alat terstruktur. Tentukan fungsi Anda dalam parameter tools dan atur model untuk merespons dengan panggilan fungsi.
Pustaka klien akan mengurai argumen JSON secara otomatis. Ini bekerja persis seperti yang didokumentasikan dalam spesifikasi OpenAI.
Contoh menggunakan SDK Python:
from openai import OpenAI
client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Model akan mengembalikan nama fungsi dan argumen. Anda menjalankan fungsi tersebut dan mengirimkan hasilnya kembali dalam pesan berikutnya.
Batas, Error, dan Konteks
Perhatikan batas berikut:
- Batas laju: 300 permintaan per menit per kunci API.
- Ukuran badan permintaan maksimum: 8 MB.
- Jendela konteks: 100.000 token total (input + output).
Error umum:
- 401 Tidak Sah: Kunci API tidak valid atau hilang.
- 402 Pembayaran Diperlukan: Saldo prabayar tidak mencukupi.
- 429 Terlalu Banyak Permintaan: Anda melebihi batas 300 rpm.
Kami tidak menawarkan embedding, pembuatan gambar, atau pemrosesan audio. Ini adalah API LLM hanya teks.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.llamaapis.com/v1 |
| ID model | uncensored |
| Jendela konteks | 100.000 token (input + output) |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Batas laju | 300 permintaan per menit per kunci |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Ukuran permintaan | hingga 8 MB |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
| Masuk | Google atau email dan kata sandi |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apa yang terjadi jika saldo prabayar Anda habis?
Permintaan Anda akan menerima error 402 hingga Anda isi saldo akun. Anda dapat menambahkan kredit melalui kripto (USDT atau USDC) mulai dari $10. Saldo prabayar yang ada tidak pernah kedaluwarsa.
Apakah model tanpa sensor adalah model yang telah di-fine-tune atau model dasar?
Ini adalah model bobot terbuka yang dijalankan di server GPU kami sendiri, yang secara khusus disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah. Ini bukan salinan langsung dari GPT atau Claude.
Bisakah saya menggunakan kode SDK yang sama dengan yang saya gunakan di OpenAI?
Ya. Ubah <code>base_url</code> menjadi <code>https://api.llamaapis.com/v1</code> dan perbarui kunci API. Format permintaan dan respons kompatibel.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.