ホーム/ドキュメント
Llama API:5分で初リクエスト
無検閲 LLM から 5 分以内に最初のレスポンスを取得します。このクイックスタートでは、既存の OpenAI クライアント設定を当社のベース URL と API キーに置き換える方法を示します。
https://api.llamaapis.com/v1uncensored
インストール
まず公式の OpenAI Python クライアントをインストールしてください。HTTP リクエストと JSON パースを処理します。
- pip install openai
Node.js 用 JavaScript SDK も使用可能です。当社は OpenAI の chat-completions 仕様に完全に準拠しているため、両方のライブラリは API と完全に互換性があります。
認証設定
当社のAPIは標準のAPIキー認証を使用します。https://llamaapis.comでサインアップすると、すぐにキーが発行されます。トライアルティアではクレジットカードは不要です。
このキーを環境変数に保存するか、クライアントに直接渡してください。キーは/v1エンドポイントへのすべてのリクエストを認証します。キーを紛失した場合は、ダッシュボードから再生成できます。その際、古いキーは直ちに無効になります。
基本的なチャット完了リクエスト
チャット完了エンドポイントにリクエストを送信します。ベース URL を当社のサーバーに設定し、API キーを提供する必要があります。
モデルIDはuncensoredです。このモデルは、法的な成人向けコンテンツに対して標準的なコンテンツフィルタを適用しません。
curl を使用した簡単なリクエストの例は以下の通りです:
curl https://api.llamaapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'レスポンスには生成されたテキスト文字列が返されます。関数呼び出しが必要な場合、構造は OpenAI の形式と同一です。
ストリーミングレスポンス(SSE)
リアルタイム出力には、stream: trueを設定してストリーミングを有効にします。サーバーは部分デルタを含むServer-Sent Events(SSE)を送信します。
生成されたテキストをリアルタイムで表示するチャットインターフェースに最適です。コンテキストウィンドウは最大100,000トークンをサポートしており、長い会話でもストリーミングが効率的に動作します。
ストリーミング実装の例:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)stopイベントを処理して、接続をクリーンに閉じることを忘れないでください。
ツール/関数呼び出しサポート
当社のAPIは構造化された関数呼び出しをサポートしています。toolsパラメータに関数を定義し、モデルに関数呼び出しで応答するように設定してください。
クライアントライブラリは JSON 引数を自動的に解析します。これは OpenAI 仕様で文書化されている方法と完全に同じです。
Python SDK を使用した例:
from openai import OpenAI
client = OpenAI(base_url="https://api.llamaapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)モデルは関数名と引数を返します。関数を実行し、その結果を次のメッセージで送信します。
制限、エラー、コンテキスト
以下の制限にご注意ください:
- レート制限:API キーあたり 1 分あたり 300 リクエスト。
- リクエストボディの最大サイズ:8 MB。
- コンテキストウィンドウ:合計 100,000 トークン(入力+出力)。
一般的なエラー:
- 401 Unauthorized: APIキーが無効、または未設定です。
- 402 Payment Required: 前払いクレジットが不足しています。
- 429 リクエスト数過多: 300 rpm の制限を超えました。
埋め込み、画像生成、音声処理は提供していません。これはテキストのみの LLM API です。
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llamaapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| 認証 | Authorization: Bearer YOUR_KEY |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.llamaapis.com/v1 |
| モデル ID | uncensored |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| JSON モード | response_format: {"type": "json_object"} |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| レート制限 | キーごとに毎分 300 リクエスト |
| 同時実行 | キーごとに同時 8 リクエストまで |
| リクエストサイズ | 最大 8 MB |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
前払いクレジットを使い果たした場合どうなりますか?
アカウントにチャージするまで、リクエストは402エラーを受信します。暗号通貨(USDTまたはUSDC)でクレジットを追加可能。10ドルから。既存の前払いクレジットは期限切れになりません。
無検閲モデルはファインチューニング済みですか、ベースモデルですか?
当社の GPU サーバーで動作するオープンウェイトモデルで、法的な成人向け利用においてコンテンツ拒否なしで回答するように特別に調整されています。GPT や Claude の単なるコピーではありません。
OpenAI で使用している SDK コードをそのまま使えますか?
はい。<code>base_url</code> を <code>https://api.llamaapis.com/v1</code> に変更し、API キーを更新してください。リクエストとレスポンスの形式は互換性があります。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベース URL を変更します。これだけです。