Démarrage rapide : Intégration de l'API de petite amie IA
Intégrez notre API LLM sans censure en quelques minutes en utilisant des endpoints compatibles OpenAI. Obtenez votre clé API, définissez votre URL de base et commencez à générer des réponses textuelles pour votre application de jeu de rôle.
- par 1M de tokens d'entrée
- $0.25
- Tokens de sortie / 1M
- $1.00
- fenêtre de contexte de tokens
- 100,000
- crédit d'essai gratuit
- $0.50
- requêtes par minute
- 300
URL de base et authentification
Notre API suit le standard OpenAI chat-completions, rendant l'intégration simple pour les clients existants. Vous devez inclure votre clé API dans l'en-tête Authorization de chaque requête. L'URL de base pour tous les endpoints est https://api.roleplayapi.com/v1. Lors de l'utilisation des SDK officiels, mettez à jour la configuration base_url pour pointer vers cette adresse et fournissez votre clé en tant que api_key. Cette configuration garantit que vos requêtes atteignent notre endpoint sans censure dédié sans modifier votre logique standard.
Envoyer une complétion
Initiez une conversation en envoyant une requête POST vers /v1/chat/completions. L'identifiant du modèle est uncensored. Vous pouvez passer autant de messages que nécessaire dans le tableau messages pour établir le contexte ou commencer une nouvelle conversation. La réponse contient la sortie textuelle du modèle, que vous pouvez streamer ou analyser comme un objet JSON. Cet endpoint gère l'interaction principale texte en, texte out requise pour les applications basées sur des personnages.
curl https://api.roleplayapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
Utilisez la bibliothèque Python officielle openai pour interagir avec l'API avec un minimum de code boilerplate. Configurez le client avec notre URL de base et votre clé API. Ensuite, appelez chat.completions.create avec l'ID du modèle uncensored. Cette approche exploite les hints de type et les mécanismes de gestion d'erreurs existants, vous permettant de vous concentrer sur la logique de votre application plutôt que sur l'analyse HTTP. L'objet réponse fournit un accès direct au contenu généré.
from openai import OpenAI
client = OpenAI(base_url="https://api.roleplayapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Pour les projets JavaScript et TypeScript, le SDK Node.js OpenAI fournit une interface propre pour les appels API. Initialisez le client avec l'URL de base personnalisée et votre clé secrète. Invoquez l'endpoint de complétions de chat en utilisant le modèle uncensored. Cette méthode est idéale pour les serveurs web ou les fonctions edge où vous devez gérer efficacement les requêtes asynchrones. Le SDK gère automatiquement la sérialisation et la désérialisation du payload JSON.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.roleplayapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Activer le streaming
Réduisez la latence perçue en activant les événements envoyés par le serveur (SSE). Définissez le paramètre stream sur true dans votre requête. L'API retournera un flux de chunks au lieu d'une réponse complète unique. Cela est particulièrement utile pour les interfaces de chat où les utilisateurs s'attendent à des réponses immédiates des personnages. Vous pouvez traiter chaque chunk à mesure qu'il arrive, en mettant à jour l'interface utilisateur de manière incrémentale. Le flux se termine lorsque le modèle termine la génération de la séquence de tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et contexte
Vos requêtes sont soumises à une limite de débit de 300 requêtes par minute par clé. Si vous dépassez cette limite, l'API renvoie un code d'état 429. Les échecs d'authentification entraînent une erreur 401, tandis qu'un crédit prépayé insuffisant déclenche une erreur 402. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Si vous devez vérifier les modèles disponibles, envoyez une requête GET vers /v1/models. Assurez-vous que le corps de votre requête ne dépasse pas 8 Mo.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Base URL | https://api.roleplayapi.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quel est l'ID du modèle pour l'API sans censure ?
L'ID du modèle est « uncensored ». Il s'agit d'un modèle à poids ouverts ajusté pour le jeu de rôle adulte et n'est ni GPT, ni Claude, ni le modèle d'un autre fournisseur. Vous devez spécifier cet ID dans vos requêtes.
Comment fonctionne la tarification ?
Tarification en paiement à l'usage sans frais mensuels. Les tokens d'entrée coûtent 0,25 $ par million, et les tokens de sortie coûtent 1,00 $ par million. Le crédit prépayé n'expire jamais, et vous pouvez recharger à partir de 10 $.
L'API est-elle vraiment sans censure ?
Oui, le modèle ne refuse pas les sujets adultes licites, fictifs ou controversés. Cependant, le contenu sexuel impliquant des mineurs est toujours bloqué. La nature sans censure s'applique à la génération de texte sans les filtres de contenu standard.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.