TH ▾
รับคีย์ API

หน้าแรกคู่มือ

API Llama: คำขอแรกในห้านาที

รับคำตอบแรกจาก LLM แบบไม่เซ็นเซอร์ในเวลาน้อยกว่าห้านาที คู่มือเริ่มต้นอย่างรวดเร็วนี้แสดงวิธีแทนที่การกำหนดค่าไคลเอนต์ OpenAI ที่มีอยู่ด้วย base URL และคีย์ API ของเรา

https://api.llamaapis.com/v1uncensored

llamaapis.com

การติดตั้ง

เริ่มต้นด้วยการติดตั้งไคลเอนต์ Python ของ OpenAI อย่างเป็นทางการ ไคลเอนต์นี้จะจัดการคำขอ HTTP และการแยกวิเคราะห์ JSON ให้คุณ

  • pip install openai

คุณสามารถใช้ SDK JavaScript สำหรับ Node.js ได้เช่นกัน ไลบรารีทั้งสองเข้ากันได้กับ API ของเราอย่างสมบูรณ์เนื่องจากเราปฏิบัติตามข้อกำหนด chat-completions ของ OpenAI อย่างถูกต้อง

การตั้งค่าการตรวจสอบสิทธิ์

API ของเราใช้การตรวจสอบสิทธิ์ด้วยคีย์ API มาตรฐาน หลังจากสมัครสมาชิกที่ https://llamaapis.com คุณจะได้รับคีย์ทันที ไม่จำเป็นต้องใช้บัตรเครดิตสำหรับระดับทดลองใช้

เก็บคีย์นี้ในตัวแปรสภาพแวดล้อมหรือส่งตรงไปยังไคลเอนต์ของคุณ คีย์นี้จะตรวจสอบสิทธิ์คำขอทั้งหมดไปยังเอนด์พอยต์ /v1 หากคุณทำคีย์หาย คุณสามารถสร้างคีย์ใหม่จากแดชบอร์ดของคุณ ซึ่งจะทำให้คีย์เก่าหมดอายุทันที

คำขอการสนทนาพื้นฐาน

ส่งคำขอไปยังเอนด์พอยต์การสนทนา คุณต้องตั้งค่า base URL เป็นเซิร์ฟเวอร์ของเราและระบุคีย์ API

รหัสโมเดลคือ uncensored โมเดลนี้ไม่ใช้ตัวกรองเนื้อหามาตรฐานสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย

นี่คือวิธีส่งคำของ่ายๆ โดยใช้ curl:

curl https://api.llamaapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

การตอบสนองจะส่งคืนสตริงข้อความที่สร้าง หากต้องการเรียกใช้ฟังก์ชัน โครงสร้างจะเหมือนกับรูปแบบของ OpenAI

การตอบสนองแบบสตรีมมิง (SSE)

สำหรับการเอาต์พุตแบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true เซิร์ฟเวอร์จะส่งเหตุการณ์ที่ส่งจากเซิร์ฟเวอร์ (SSE) ที่มีเดลตาบางส่วน

สิ่งนี้มีประโยชน์สำหรับอินเทอร์เฟซการสนทนาที่คุณต้องการแสดงข้อความเมื่อสร้างข้อความ หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคน ดังนั้นการสตรีมมิงจึงทำงานได้อย่างมีประสิทธิภาพแม้สำหรับการสนทนาที่ยาวนาน

ตัวอย่างการนำไปใช้การสตรีมมิง:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

โปรดจัดการเหตุการณ์ stop เพื่อปิดการเชื่อมต่ออย่างเรียบร้อย

การรองรับการเรียกใช้เครื่องมือ/ฟังก์ชัน

API ของเรารองรับการเรียกใช้เครื่องมือแบบมีโครงสร้าง กำหนดฟังก์ชันของคุณในพารามิเตอร์ tools และตั้งค่าโมเดลให้ตอบสนองด้วยการเรียกใช้ฟังก์ชัน

ไลบรารีไคลเอนต์จะแยกวิเคราะห์อาร์กิวเมนต์ JSON โดยอัตโนมัติ สิ่งนี้ทำงานเหมือนกับที่อธิบายไว้ในข้อกำหนดของ OpenAI

ตัวอย่างการใช้ SDK Python:

from openai import OpenAI

client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

โมเดลจะส่งคืนชื่อฟังก์ชันและอาร์กิวเมนต์ คุณดำเนินการฟังก์ชันและส่งผลลัพธ์กลับในข้อความถัดไป

ขีดจำกัด ข้อผิดพลาด และบริบท

โปรดทราบขีดจำกัดต่อไปนี้:

  • ขีดจำกัดอัตรา: 300 คำขอต่อนาทีต่อคีย์ API
  • ขนาดสูงสุดของร่างกายคำขอ: 8 MB
  • หน้าต่างบริบท: โทเคนรวม 100,000 โทเคน (อินพุต + เอาต์พุต)

ข้อผิดพลาดทั่วไป:

  • 401 ไม่ได้รับอนุญาต: คีย์ API ไม่ถูกต้องหรือหายไป
  • 402 ต้องการการชำระเงิน: เครดิตเติมเงินไม่เพียงพอ
  • 429 คำขอมากเกินไป: คุณเกินขีดจำกัด 300 rpm

เราไม่เสนอการฝังตัว การสร้างภาพ หรือการประมวลผลเสียง นี่คือ API LLM สำหรับข้อความเท่านั้น

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ข้อมูลจำเพาะทางเทคนิค

ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน

รายการค่า
รูปแบบ APIรองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์
การยืนยันตัวตนAuthorization: Bearer YOUR_KEY
เอนด์พอยต์POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.llamaapis.com/v1
ID โมเดลuncensored
หน้าต่างบริบท100,000 โทเคน (อินพุตรวมเอาต์พุต)
เอาต์พุตสูงสุดได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก)
การเรียกใช้ฟังก์ชันรองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool
โหมด JSONresponse_format: {"type": "json_object"}
พารามิเตอร์temperature, top_p, stop, seed, presence_penalty, frequency_penalty
สตรีมมิงรองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้
ขีดจำกัดอัตรา300 คำขอต่อนาทีต่อคีย์
คำขอพร้อมกันสูงสุด 8 คำขอพร้อมกันต่อคีย์
ขนาดคำขอไม่เกิน 8 MB
เฮดเดอร์ของคำตอบX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
โบนัส+5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100
ราคา$0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต
การคิดเงินเครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน
เติมเงินUSDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500
อายุเครดิตเครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน
เครดิตทดลองใช้ฟรี$0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก
คีย์หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม
เนื้อหาอนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์
เข้าสู่ระบบGoogle หรืออีเมลและรหัสผ่าน

รหัสข้อผิดพลาด

ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน

รหัสประเภทความหมาย
400bad_requestJSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท
401missing_key · invalid_key · key_revokedไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว
402no_creditเครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที
403content_blockedเนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน
404not_foundไม่รู้จักเอนด์พอยต์
413request_too_largeขนาดเกิน 8 MB
429rate_limited · concurrencyเกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่
503upstream_busyโมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที

ถาม-ตอบ

llamaapis.com
เกิดอะไรขึ้นหากเครดิตเติมเงินหมด?

คำขอของคุณจะรับข้อผิดพลาด 402 จนกว่าคุณจะเติมเงินบัญชี คุณสามารถเพิ่มเครดิตผ่านคริปโต (USDT หรือ USDC) เริ่มต้นที่ $10 เครดิตเติมเงินที่มีอยู่ไม่หมดอายุ

โมเดลไม่เซ็นเซอร์ผ่านการปรับแต่งหรือเป็นโมเดลฐาน?

เป็นโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเราเอง ซึ่งปรับแต่งเฉพาะเพื่อตอบโดยไม่ปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ไม่ใช่การคัดลอก GPT หรือ Claude โดยตรง

ฉันสามารถใช้โค้ด SDK เดียวกับที่ใช้กับ OpenAI ได้หรือไม่?

ใช่ เปลี่ยน <code>base_url</code> เป็น <code>https://api.llamaapis.com/v1</code> และอัปเดตคีย์ API รูปแบบคำขอและการตอบสนองเข้ากันได้

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน แค่นี้ก็พร้อมใช้งานแล้ว

รับคีย์ API