FR ▾
Obtenir une clé API

FAQ API de grand modèle : trouvez des réponses par thème

Première utilisation de l'API grands modèles ? Questions multiples : clé, images, coupure, longueur. Cinq groupes de questions. Réponses courtes. Liens vers les détails. Accédez directement au groupe qui vous intéresse.

Mis à jour le

Points clés

  • Inscription par e-mail et mot de passe, clé affichée instantanément. Une clé par compte, régénérable.
  • Le service est dédié au chat textuel avec un seul modèle. Il supporte le streaming et l'appel de fonctions, mais pas les images, l'audio, les embeddings vectoriels ni le fine-tuning.
  • Le prompt et la réponse cumulés ne dépassent pas 100 000 tokens. Chaque clé API est limitée à 300 requêtes par minute.
  • Le contenu adulte légal est autorisé, mais le contenu sexuel impliquant des mineurs est toujours bloqué. Le service est réservé aux adultes.

Comptes et clés

Comment obtenir sa première clé ?

Rendez-vous sur la pageObtenir une clé, inscrivez-vous avec e-mail et mot de passe. La clé s'affiche immédiatement sans besoin de carte bancaire.

Peut-on créer plusieurs clés par compte ?

Non, une seule clé par compte. Pour distinguer l'usage par projet, étiquetez les requêtes dans votre backend plutôt que de multiplier les clés.

Que faire en cas de fuite de clé ?

Générez-en immédiatement une nouvelle. L'ancienne devient invalide instantanément. Déployez d'abord la nouvelle valeur avant de révoquer l'ancienne.

Les nouveaux utilisateurs peuvent-ils essayer avant de payer ?

Oui. Un crédit d'essai gratuit de $0,50 est offert pour 7 jours, sans liaison de moyen de paiement.

Pour voir le processus complet de l'inscription à la première requête, suivez le guide de projet dansChatbot.

Si vous gérez plusieurs projets, ne comptez pas sur les clés pour les isoler. Ajoutez plutôt une étiquette de projet à chaque requête dans votre backend et enregistrez usage. Cela permet un rapport mensuel précis par étiquette, plus fiable que les statistiques brutes du panneau de contrôle.

Capacités supportées et non supportées

Quel est l'endpoint et le nom du modèle ?

L'endpoint est https://api.apidamoxing.com/v1,模型名固定为 uncensored. Un seul modèle est disponible.

Quels endpoints sont disponibles ?

Deux : POST /v1/chat/completions pour le chat, et GET /v1/models pour la liste des modèles. Les autres chemins renvoient 404.

Peut-on envoyer des images, de l'audio ou faire de la recherche vectorielle ?

Non. Le service traite uniquement le texte. Pas d'images, d'audio, de vidéo, d'embeddings vectoriels ni de fine-tuning.

Le streaming et l'appel de fonctions sont-ils supportés ?

Oui. Activez le streaming avec stream: true (réponse via SSE). L'appel de fonctions suit le format OpenAI tools.

Peut-on utiliser directement les SDK OpenAI ?

Oui. Pointez base_url vers l'endpoint ci-dessus et définissez api_key avec votre clé. Fonctionne avec Python, Node.js ou curl.

Une erreur courante est de croire que la compatibilité OpenAI implique toutes les fonctionnalités OpenAI. La compatibilité concerne le format des requêtes et réponses, pas les capacités. Comme le service est limité au chat textuel, les codes existants utilisant la compréhension d'images, la transcription audio ou la recherche vectorielle doivent être adaptés.

Longueur, fréquence et paramètres

Quelle est la capacité maximale ?

100 000 tokens au total pour l'entrée et la sortie. Le corps de la requête est limité à 8 MB, mais la limite de tokens est atteinte en premier dans les cas textuels.

Pourquoi la réponse s'arrête-t-elle en cours de route ?

Vous avez atteint max_tokens (2048 par défaut). Augmentez cette valeur jusqu'à 32 000, en veillant à ne pas dépasser 100 000 tokens au total.

Combien de requêtes par minute pouvez-vous envoyer ?

300 par clé. Pour les tâches par lots, il est conseillé de gérer la file d'attente et le débit côté client plutôt que d'attendre d'être limité pour réagir.

Les paramètres temperature, top_p et stop sont-ils pris en charge ?

Oui, ces champs de sampling standards sont transmis tels quels au modèle, avec un comportement conforme à vos attentes pour l'endpoint de complétion de chat.

Où consulter les détails de chaque paramètre ?

Le tableau détaillé des paramètres de l'endpoint est disponible dans la section dédiée, tandis que la page de documentation offre une référence concise.

Concernant la notion de « long » : 100 000 tokens correspondent approximativement à plusieurs dizaines de milliers de caractères chinois, selon le contenu. Il s'agit d'un ordre de grandeur, non d'une conversion exacte. Pour traiter de très longs documents, il est plus sûr de les découper en segments puis de les synthétiser.

Tarification et solde

Comment est calculé le prix ?

Au token : 0,25 $ par million de tokens en entrée, 1,00 $ par million de tokens en sortie, sans frais mensuels ni abonnement.

Faut-il payer d'avance ou après ?

Avance. Rechargez le solde prépayé de votre compte ; le montant est débité à l'usage. Le solde n'expire jamais.

Que se passe-t-il si le solde est épuisé ?

La requête échoue avec le code d'état 402 et le code d'erreur no_credit. Le crédit d'essai gratuit se comporte de la même manière à son expiration ; le service reprend dès que vous rechargez le solde.

Comment estimer le coût d'une fonctionnalité ?

Consultez les exemples de calcul dans tokens et facturation. L'essentiel est de lire le champ usage dans la réponse, puis de le multiplier par le tarif unitaire.

Conseil budgétaire supplémentaire : rechargez en fonction de votre « consommation prévue par période » plutôt que de faire un gros rechargement unique. Comme il s'agit d'un paiement prépayé, votre solde constitue une limite stricte : les requêtes s'arrêtent dès qu'il est vide, évitant ainsi les factures surprises.

Mise en production et dépannage

Puis-je utiliser la même clé API en développement et en production ?

Un compte ne disposant qu'une seule clé, elles sont de facto partagées. Placez impérativement la clé dans une variable d'environnement côté serveur ; ne la commitez pas dans le dépôt de code ni ne l'exposez dans le frontend. Notez que la régénération invalidera la clé sur tous les environnements simultanément.

Faut-il réessayer immédiatement en cas d'erreur 503 ?

Non. Le 503 indique que le service est temporairement surchargé. Attendez quelques secondes avant de réessayer et définissez un nombre maximal de tentatives. Envoyer des requêtes en rafale gaspille votre quota de requêtes simultanées.

L'appel à l'endpoint est lent : y a-t-il un problème ?

La génération de texte long prend naturellement du temps ; plus la sortie est longue, plus cela prend du temps. Activez le streaming pour afficher les premiers tokens au fur et à mesure, et augmentez le délai d'attente (timeout) côté client.

La conversation s'allonge : comment éviter de dépasser la limite ?

Coupez l'historique dans votre backend en ne conservant que les dernières tournures ; les contenus plus anciens peuvent être résumés. Estimez le volume total avant d'envoyer la requête, plutôt que d'attendre un retour 400 pour agir.

Comment vérifier combien de tokens une requête a consommés ?

Lisez le champ usage de la réponse, qui détaille les tokens en entrée, en sortie et le total. Pour le streaming, ces données sont incluses dans le dernier bloc de données ; aucun paramètre supplémentaire n'est nécessaire.

Ces questions reviennent souvent car elles surviennent après la phase « le code fonctionne ». Utilisez cette section comme une liste de contrôle avant la mise en production pour vérifier que votre application gère chaque cas.

Limites de contenu et éligibilité

Quels contenus sont refusés ?

Contenu adulte légal, romans et sujets controversés sont autorisés. Contenu sexuel impliquant des mineurs est bloqué (403), y compris dans les romans et le jeu de rôle.

Qui peut utiliser le service ?

Exclusivement les adultes de 18 ans et plus. Si votre produit est ouvert au public, vérifiez l'âge à l'entrée.

Mes prompts seront-ils utilisés pour l'entraînement ?

Non, les prompts ne servent pas à l'entraînement.

Où regarder en premier en cas d'erreur ?

Lisez d'abord le code et le message de l'objet error dans le corps de la réponse, puis vérifiez le code d'état : 401 indique un problème de clé, 402 un problème de solde, 403 un problème de contenu, 429 une limite de débit atteinte, et 503 une surcharge temporaire du service (réessayez après quelques secondes).

Questions fréquentes

Que faut-il pour appeler l'endpoint ?

Une clé issue d'un compte enregistré, une requête HTTPS pointant vers https://api.apidamoxing.com/v1, et un en-tête HTTP contenant le jeton Bearer. Le reste du format est identique à celui de la complétion de chat.

Quelles fonctionnalités sont prises en charge ou non ?

Prise en charge de la conversation textuelle, du streaming et de l'appel de fonctions. Non pris en charge : images, audio, vidéo, embeddings vectoriels et fine-tuning.

Pourquoi la réponse est-elle tronquée ?

Vous avez généralement atteint la limite de max_tokens (2048 par défaut, extensible jusqu'à 32 000). Le total des tokens du prompt et de la sortie ne doit pas dépasser 100 000 tokens.

Que se passe-t-il si le solde est épuisé ?

La requête renvoie 402 et no_credit. Rechargez votre solde prépayé pour continuer ; le solde n'expire jamais.

Qui ne peut pas utiliser ce service ?

Les mineurs de moins de 18 ans. La pédopornographie, qu'elle soit fictive ou non, est bloquée et renvoie un 403.

Remplissez simplement le formulaire pour obtenir votre clé API

Créez un compte, copiez votre clé, modifiez l'URL de base. La configuration est aussi simple que cela.

Obtenir une clé API