Ablité : Guide de démarrage rapide
Commencez à envoyer des requêtes à l'API ablité en quelques minutes. Ce guide couvre les endpoints essentiels, l'authentification et le streaming pour votre intégration de LLM sans censure.
URL de base et authentification
L'API Ablité est entièrement compatible avec OpenAI, ce qui signifie que vous pouvez utiliser des SDK standard en les pointant simplement vers notre URL de base. Le service accepte des entrées textuelles et renvoie des sorties textuelles via l'endpoint chat-completions. Vous devez inclure votre clé API dans l'en-tête Authorization pour chaque requête. Votre clé est générée immédiatement après vous être inscrit avec Google ou par e-mail sur la page Obtenir la clé API. Il n'y a pas d'abonnements mensuels ; vous ne payez que pour les tokens que vous consommez réellement.
- URL de base :
https://api.abliterated.top/v1 - En-tête :
Authorization: Bearer YOUR_API_KEY - ID du modèle :
uncensored
Première requête
Envoyez une requête de complétion simple pour vérifier la connectivité. Le modèle est conçu pour répondre sans refus de contenu pour une utilisation adulte légale, ce qui le rend idéal pour des tâches de codage avec des LLM sans censure ou pour l'écriture créative. Notez que l'ID du modèle est strictement uncensored. Il s'agit d'un modèle à poids ouverts, et non de GPT, Claude ou tout autre modèle d'un autre fournisseur. Les requêtes sont facturées en fonction du nombre de tokens d'entrée et de sortie. Les erreurs et les refus (sauf la limite stricte sur le contenu sexuel impliquant des mineurs) sont gratuits.
Intégration SDK Python
Utilisez la bibliothèque Python officielle d'OpenAI pour interagir avec le LLM Ablité. Initialisez le client avec votre clé API et l'URL de base personnalisée. Cette approche fonctionne sans problème pour les modèles sans censure qui suivent le schéma de chat OpenAI. Vous pouvez passer des paramètres comme temperature ou top_p pour contrôler la créativité. L'objet de réponse contient le texte généré dans content. Cette méthode est efficace pour le traitement par lots ou l'intégration de l'API dans des services backend.
Intégration SDK Node.js
Pour les projets JavaScript ou TypeScript, le SDK Node d'OpenAI fonctionne avec une configuration minimale. Définissez baseURL sur notre endpoint et fournissez votre clé. Ceci est utile pour les serveurs web ou les fonctions edge qui doivent générer du texte dynamiquement. L'API Ablité prend en charge des paramètres standard comme les séquences stop et seed pour la reproductibilité. N'oubliez pas que l'ID du modèle doit être uncensored. Vous pouvez également activer le mode JSON en définissant response_format sur {"type": "json_object"} pour des sorties structurées.
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des données via Server-Sent Events (SSE), ce qui vous permet d'afficher les tokens au fur et à mesure de leur génération. Cela améliore la latence perçue pour les utilisateurs. Le dernier fragment du flux inclut l'utilisation totale des tokens pour la requête, ce qui est crucial pour une facturation précise. Le streaming est pris en charge pour tous les paramètres standard. Cette fonctionnalité est essentielle pour créer des interfaces de type chat qui semblent réactives.
Limites de débit, erreurs et contexte
Respectez les limites de débit pour éviter les erreurs 429. Chaque clé permet 300 requêtes par minute et jusqu'à 8 requêtes simultanées. La taille maximale du corps de la requête est de 8 Mo. Si votre clé est invalide, vous recevrez une erreur 401. Si vous disposez d'un crédit insuffisant, vous recevrez une erreur 402. Les erreurs et les refus ne consomment pas de tokens. La fenêtre de contexte est de 100 000 tokens au total (prompt + complétion). Le nombre maximum de tokens par requête est de 32 000 (ou 2 048 si max_tokens n'est pas défini). Le crédit est prépayé et n'expire jamais.
cURL
curl https://api.abliterated.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.abliterated.top/v1 |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Mode JSON | response_format: {"type": "json_object"} |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Le modèle Ablité prend-il en charge la génération d'images ou d'audio ?
Non. L'API propose un seul modèle textuel. Il ne prend pas en charge les embeddings, la génération d'images, l'audio, la vidéo ou le fine-tuning. Il s'agit strictement d'un service texte en entrée, texte en sortie.
Comment est calculée la facturation pour le modèle IA sans censure ?
La facturation est basée sur l'utilisation réelle des tokens. Les tokens d'entrée coûtent 0,25 $ par 1M, et les tokens de sortie coûtent 1,00 $ par 1M. Les erreurs et les refus sont gratuits. Il n'y a pas d'abonnements mensuels et le crédit prépayé n'expire jamais.
Puis-je payer par carte bancaire ?
Non. Les recharges sont exclusivement en crypto (USDT sur TRC20 ou USDC sur Base). Vous pouvez ajouter n'importe quel montant entier de 10 $ à 500 $. Le crédit d'essai gratuit ne nécessite pas de carte.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.