หน้าแรก/คู่มือ
API Llama: คำขอแรกในห้านาที
รับคำตอบแรกจาก LLM แบบไม่เซ็นเซอร์ในเวลาน้อยกว่าห้านาที คู่มือเริ่มต้นอย่างรวดเร็วนี้แสดงวิธีแทนที่การกำหนดค่าไคลเอนต์ OpenAI ที่มีอยู่ด้วย base URL และคีย์ API ของเรา
https://api.llamaapis.com/v1uncensored
การติดตั้ง
เริ่มต้นด้วยการติดตั้งไคลเอนต์ Python ของ OpenAI อย่างเป็นทางการ ไคลเอนต์นี้จะจัดการคำขอ HTTP และการแยกวิเคราะห์ JSON ให้คุณ
- pip install openai
คุณสามารถใช้ SDK JavaScript สำหรับ Node.js ได้เช่นกัน ไลบรารีทั้งสองเข้ากันได้กับ API ของเราอย่างสมบูรณ์เนื่องจากเราปฏิบัติตามข้อกำหนด chat-completions ของ OpenAI อย่างถูกต้อง
การตั้งค่าการตรวจสอบสิทธิ์
API ของเราใช้การตรวจสอบสิทธิ์ด้วยคีย์ API มาตรฐาน หลังจากสมัครสมาชิกที่ https://llamaapis.com คุณจะได้รับคีย์ทันที ไม่จำเป็นต้องใช้บัตรเครดิตสำหรับระดับทดลองใช้
เก็บคีย์นี้ในตัวแปรสภาพแวดล้อมหรือส่งตรงไปยังไคลเอนต์ของคุณ คีย์นี้จะตรวจสอบสิทธิ์คำขอทั้งหมดไปยังเอนด์พอยต์ /v1 หากคุณทำคีย์หาย คุณสามารถสร้างคีย์ใหม่จากแดชบอร์ดของคุณ ซึ่งจะทำให้คีย์เก่าหมดอายุทันที
คำขอการสนทนาพื้นฐาน
ส่งคำขอไปยังเอนด์พอยต์การสนทนา คุณต้องตั้งค่า base URL เป็นเซิร์ฟเวอร์ของเราและระบุคีย์ API
รหัสโมเดลคือ uncensored โมเดลนี้ไม่ใช้ตัวกรองเนื้อหามาตรฐานสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย
นี่คือวิธีส่งคำของ่ายๆ โดยใช้ curl:
curl https://api.llamaapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'การตอบสนองจะส่งคืนสตริงข้อความที่สร้าง หากต้องการเรียกใช้ฟังก์ชัน โครงสร้างจะเหมือนกับรูปแบบของ OpenAI
การตอบสนองแบบสตรีมมิง (SSE)
สำหรับการเอาต์พุตแบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true เซิร์ฟเวอร์จะส่งเหตุการณ์ที่ส่งจากเซิร์ฟเวอร์ (SSE) ที่มีเดลตาบางส่วน
สิ่งนี้มีประโยชน์สำหรับอินเทอร์เฟซการสนทนาที่คุณต้องการแสดงข้อความเมื่อสร้างข้อความ หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคน ดังนั้นการสตรีมมิงจึงทำงานได้อย่างมีประสิทธิภาพแม้สำหรับการสนทนาที่ยาวนาน
ตัวอย่างการนำไปใช้การสตรีมมิง:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)โปรดจัดการเหตุการณ์ stop เพื่อปิดการเชื่อมต่ออย่างเรียบร้อย
การรองรับการเรียกใช้เครื่องมือ/ฟังก์ชัน
API ของเรารองรับการเรียกใช้เครื่องมือแบบมีโครงสร้าง กำหนดฟังก์ชันของคุณในพารามิเตอร์ tools และตั้งค่าโมเดลให้ตอบสนองด้วยการเรียกใช้ฟังก์ชัน
ไลบรารีไคลเอนต์จะแยกวิเคราะห์อาร์กิวเมนต์ JSON โดยอัตโนมัติ สิ่งนี้ทำงานเหมือนกับที่อธิบายไว้ในข้อกำหนดของ OpenAI
ตัวอย่างการใช้ SDK Python:
from openai import OpenAI
client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)โมเดลจะส่งคืนชื่อฟังก์ชันและอาร์กิวเมนต์ คุณดำเนินการฟังก์ชันและส่งผลลัพธ์กลับในข้อความถัดไป
ขีดจำกัด ข้อผิดพลาด และบริบท
โปรดทราบขีดจำกัดต่อไปนี้:
- ขีดจำกัดอัตรา: 300 คำขอต่อนาทีต่อคีย์ API
- ขนาดสูงสุดของร่างกายคำขอ: 8 MB
- หน้าต่างบริบท: โทเคนรวม 100,000 โทเคน (อินพุต + เอาต์พุต)
ข้อผิดพลาดทั่วไป:
- 401 ไม่ได้รับอนุญาต: คีย์ API ไม่ถูกต้องหรือหายไป
- 402 ต้องการการชำระเงิน: เครดิตเติมเงินไม่เพียงพอ
- 429 คำขอมากเกินไป: คุณเกินขีดจำกัด 300 rpm
เราไม่เสนอการฝังตัว การสร้างภาพ หรือการประมวลผลเสียง นี่คือ API LLM สำหรับข้อความเท่านั้น
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.llamaapis.com/v1 |
| ID โมเดล | uncensored |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
เกิดอะไรขึ้นหากเครดิตเติมเงินหมด?
คำขอของคุณจะรับข้อผิดพลาด 402 จนกว่าคุณจะเติมเงินบัญชี คุณสามารถเพิ่มเครดิตผ่านคริปโต (USDT หรือ USDC) เริ่มต้นที่ $10 เครดิตเติมเงินที่มีอยู่ไม่หมดอายุ
โมเดลไม่เซ็นเซอร์ผ่านการปรับแต่งหรือเป็นโมเดลฐาน?
เป็นโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเราเอง ซึ่งปรับแต่งเฉพาะเพื่อตอบโดยไม่ปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ไม่ใช่การคัดลอก GPT หรือ Claude โดยตรง
ฉันสามารถใช้โค้ด SDK เดียวกับที่ใช้กับ OpenAI ได้หรือไม่?
ใช่ เปลี่ยน <code>base_url</code> เป็น <code>https://api.llamaapis.com/v1</code> และอัปเดตคีย์ API รูปแบบคำขอและการตอบสนองเข้ากันได้
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน แค่นี้ก็พร้อมใช้งานแล้ว