Une API LLM sans censure
Une API LLM sans censure pour les développeurs
Endpoint compatible OpenAI en mode prêt à l’emploi pour un modèle unique et dédié sans censure. Modifiez votre base_url et votre clé, gardez votre code.
Une API sans censure, compatible en mode prêt à l’emploi.
Essayez avec une seule requête
curl https://api.onekeyllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.onekeyllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.onekeyllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- Fenêtre de contexte de 100k
- 0,25 $ par 1 M de tokens d’entrée
- Sans dépendance à un fournisseur
- par 1 M de tokens d’entrée
- $0.25
- Tokens de sortie / 1 M
- $1.00
- contexte de tokens
- 100,000
- crédit d’essai
- $0.50
- requêtes par minute
- 300
Ce que vous obtenez
Compatibilité prêt à l’emploi
Fonctionne avec les SDK officiels OpenAI en modifiant uniquement le base_url et la clé API. Aucune réécriture de code requise.
Modèle dédié unique
Nous ne routons pas vers des dizaines de fournisseurs. Vous obtenez un modèle à poids ouverts sans censure, optimisé pour un usage adulte légal.
Pas de coûts supplémentaires
Crédit prépayé en paiement à l'usage. Pas de frais mensuels, pas d’abonnement, et le crédit prépayé n’expire jamais.
Streaming et outils
Prend en charge le streaming SSE et l’appel de fonctions via l’endpoint standard chat-completions.
Limites transparentes
300 requêtes par minute par clé. Limite du corps de la requête à 8 Mo. Des contraintes simples et prévisibles.
Confidentialité d’abord
Les prompts ne sont pas utilisés pour l'apprentissage. Inscrivez-vous simplement avec une adresse e-mail et un mot de passe.
Comment ça marche
Inscrivez-vous
Créez un compte avec e-mail et mot de passe pour recevoir votre clé API instantanément.
Mettre à jour l’URL de base
Pointez votre code client existant vers https://api.onekeyllmapi.com/v1.
Envoyer des requêtes
Utilisez le même format de requête qu’OpenAI pour discuter avec le modèle sans censure.
Ce que les développeurs construisent avec cela
Écriture créative
Générez des histoires et des scripts sans filtres de contenu bloquant les thèmes matures ou controversés. Idéal pour la fiction où les taux de refus comptent.
Extraction de données
Analysez de grands documents en utilisant la fenêtre de contexte de 100k. Obtenez des sorties brutes sans refus stylistiques inutiles ni couches de sécurité.
Applications de jeu de rôle
Créez des applications axées sur les personnages qui restent dans le personnage. Le modèle sans censure gère les sujets adultes légalement sans blocage.
Analyse de recherche
Analysez la recherche en sécurité ou les textes politiques sans filtres de biais. Obtenez des réponses directes à des prompts complexes.
Compatibilité prêt à l’emploi
Nous proposons un endpoint dédié et sans censure, entièrement compatible avec le format chat-completions d'OpenAI. Cela vous permet de changer de fournisseur sans réécrire la logique de votre application. Il vous suffit de mettre à jour votre base_url vers https://api.onekeyllmapi.com/v1 et d'insérer votre nouvelle clé API. L'ID du modèle est uncensored. Nous prenons en charge le streaming via les Server-Sent Events (SSE) et l'appel de fonctions, conformément au comportement attendu des développeurs par les principaux fournisseurs.
Contrairement aux agrégateurs qui routent les requêtes vers des dizaines de modèles de fournisseurs différents, nous proposons un modèle à poids ouverts cohérent exécuté sur nos propres serveurs GPU. Cela élimine la complexité de la gestion de multiples endpoints et garantit un comportement prévisible. Vous avez un accès direct au modèle sans censure sans couches de routage cachées ni dépendance à un fournisseur. Notre API prend en charge les opérations texte en, texte sortant avec des capacités complètes de fenêtre de contexte, ce qui en fait un remplacement direct des intégrations LLM standard.
Sans censure et légal
Notre modèle est ajusté pour répondre sans refus de contenu pour un usage adulte légal. Il ne bloque pas les sujets controversés, fictifs ou liés à la recherche en sécurité simplement parce qu’ils sont sensibles. Cependant, nous maintenons une limite claire : les requêtes impliquant du contenu sexuel avec des mineurs sont toujours bloquées. Il s’agit d’une limite stricte qui s’applique à toutes les requêtes. Vous bénéficiez de la liberté de générer du contenu mature sans que le modèle ne refuse en fonction d’interprétations de politiques subjectives courantes dans d’autres modèles.
Nous ne proposons pas d’embeddings, de génération d’images, d’audio ou de vidéo. Il s’agit d’une API textuelle uniquement. Si vous avez besoin de fonctionnalités multimodales, ce n’est pas l’outil adapté. Notre objectif est de fournir un endpoint de génération de texte fiable et sans censure. Nous n’utilisons pas vos prompts pour l’apprentissage, garantissant que vos données restent privées. Le modèle n’est pas GPT, Claude, Gemini ou tout autre modèle de fournisseur ; c’est un modèle à poids ouverts distinct optimisé pour ce cas d’utilisation spécifique.
Fenêtre de contexte de 100k
Notre API prend en charge une fenêtre de contexte de 100 000 tokens, combinant les tokens de prompt et de complétion. Cela vous permet de traiter de grands documents, de longues conversations ou des bases de code complexes en une seule requête. La limite de 8 Mo du corps de la requête garantit des performances stables pour ces grandes entrées. Vous n’avez pas besoin de fractionner manuellement vos données si elles tiennent dans cette fenêtre, simplifiant l’architecture de votre application.
Cette capacité est cruciale pour les tâches nécessitant un contexte profond, comme la synthèse de livres entiers ou le maintien d’un état à long terme dans des applications de chat. Le modèle traite le contexte complet pour générer des réponses pertinentes et cohérentes. Nous ne facturons pas supplémentaire pour la fenêtre de contexte ; le prix est basé sur le volume de tokens. Cela rend l’utilisation rentable pour gérer de grandes entrées par rapport aux fournisseurs qui facturent des tarifs premium pour un contexte étendu.
Streaming et outils
Notre API prend en charge le streaming et l’appel d’outils
Tarification simple
Nous proposons une tarification transparente et au paiement à l'usage, sans frais mensuels. Les tokens d'entrée coûtent 0,25 $ par million de tokens, et les tokens de sortie coûtent 1,00 $ par million de tokens. Vous pouvez recharger votre compte à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Nous offrons des crédits bonus : +5 % pour les dépôts de 50 $ ou plus, et +10 % pour les dépôts de 100 $ ou plus. Votre crédit payé n'expire jamais, vous pouvez donc l'utiliser quand vous en avez besoin.
Chaque nouveau compte reçoit 0,50 $ de crédit d'essai gratuit valable 7 jours, sans carte bancaire requise. Cela vous permet de tester l'API immédiatement. Nous ne proposons pas de niveaux gratuits illimités ni d'abonnements. Vous ne payez que ce que vous utilisez. Ce modèle est idéal pour les développeurs qui souhaitent des coûts prévisibles sans la complexité des plans par paliers ou des frais cachés. Si vous avez besoin de SLA ou d'un support entreprise, cette structure de tarification simple ne conviendra peut-être pas à vos besoins.
Questions et réponses
Cette API est-elle compatible avec le SDK OpenAI ?
Oui. Elle utilise le même format d'endpoint <code>/v1/chat/completions</code>. Vous devez uniquement modifier le <code>base_url</code> et la clé API dans votre code existant. Nous prenons en charge le streaming et l'appel de fonctions, conformément aux comportements standard d'OpenAI.
Quelle est la taille de la fenêtre de contexte ?
L'API prend en charge une fenêtre de contexte de 100 000 tokens pour l'entrée et la sortie. Cela vous permet de traiter de grands documents ou de longues conversations dans une seule requête, à condition que le corps de la requête fasse moins de 8 Mo.
Proposez-vous la génération d'images ou d'audio ?
Non. Il s'agit d'une API textuelle uniquement. Nous ne proposons pas d'embeddings, de génération d'images, d'audio ou de vidéo. Si vous avez besoin de fonctionnalités multimodales, vous devrez utiliser un autre fournisseur.
Combien cela coûte-t-il ?
Les tokens d'entrée coûtent 0,25 $ par million de tokens, et les tokens de sortie coûtent 1,00 $ par million de tokens. Il n'y a pas de frais mensuels. Vous pouvez commencer avec 0,50 $ de crédit d'essai ou recharger avec 10 $ ou plus.
Cette API est-elle faite pour moi ?
Cette API s'adresse aux développeurs qui souhaitent un modèle sans censure unique sans complexité de routage. Elle n'est pas faite pour vous si vous avez besoin d'embeddings, de génération d'images ou de SLA entreprise. Elle n'est pas non plus faite pour vous si vous préférez un niveau gratuit ou un modèle d'abonnement.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.