Preguntas frecuentes sobre la API de modelos grandes: busca respuestas por tema
Cuando un desarrollador se enfrenta por primera vez a una API de modelo grande, surgen de golpe varias dudas: de dónde obtener la clave, si se pueden enviar imágenes, si se detiene de repente o cuál es la longitud máxima. Las hemos agrupado en cinco temas con respuestas concisas; para más detalles, enlaza a los artículos correspondientes y salta directamente a lo que te interesa.
Actualizado el
Puntos clave
- El acceso es con correo y contraseña; la clave secreta se muestra al instante. Hay una clave secreta por cuenta y se puede regenerar.
- Capacidad de chat de texto puro con un único modelo, compatible con streaming y llamadas a funciones. No admite imágenes, audio, embeddings vectoriales ni fine-tuning.
- El prompt y la salida juntos no superan 100,000 token por petición. Cada clave de API soporta 300 peticiones por minuto.
- Contenido adulto legal permitido, pero se bloquea el contenido sexual que involucre a menores. Servicio solo para adultos.
Cuentas y claves
¿Cómo obtengo mi primera clave de API?
Ve a la página de obtención de claves, regístrate con correo y contraseña; al completar el registro, la clave secreta se muestra sin necesidad de datos de pago.
¿Puedo crear varias claves por cuenta?
No. Cada cuenta tiene una clave secreta. Para separar el uso por proyecto, etiqueta y lleva la contabilidad desde tu backend, no uses varias claves secretas.
¿Qué hago si se filtra mi clave de API?
Regenera la clave secreta inmediatamente. La clave secreta antigua queda inválida al instante, así que primero despliega el nuevo valor en todos lados y luego hazlo.
¿Puedo probar antes de pagar?
Sí. Las cuentas nuevas tienen un crédito de prueba de $0.50 válido por 7 días, sin necesidad de vincular un método de pago.
Para ver el proceso completo desde el registro hasta la primera petición, sigue la configuración completa del proyecto en el artículoChatbot.
Si gestionas varios proyectos, no uses múltiples claves para aislarlos. Etiqueta las llamadas en tu backend y guarda usage para reportes mensuales más precisos que las estadísticas del panel.
Qué se puede y qué no
¿Cuál es la URL del endpoint y el nombre del modelo?
La URL es https://api.apidamoxing.com/v1,模型名固定为 uncensored. Solo hay un modelo disponible.
¿Qué endpoints están disponibles?
Dos: POST /v1/chat/completions para chat y GET /v1/models para listar modelos. Otras rutas devuelven 404.
¿Puedo enviar imágenes, audio o hacer búsqueda vectorial?
No. Solo procesamos texto; no hay imágenes, audio, video, embeddings vectoriales ni fine-tuning.
¿Admite streaming y llamadas a funciones?
Sí. Activa streaming con stream: true y usa SSE. Las llamadas a funciones usan el formato de herramientas de OpenAI.
¿Puedo usar el SDK de OpenAI directamente?
Sí, apunta base_url a la dirección anterior y cambia api_key por tu clave secreta. Funciona con Python, Node o curl.
Un error común es pensar que la compatibilidad con OpenAI implica todas sus funciones. La compatibilidad es solo de formato. Al ser solo chat de texto, el código que usa imágenes, audio o búsqueda vectorial debe adaptarse.
Longitud, frecuencia y parámetros
¿Cuánto texto cabe en una petición?
Entrada y salida suman máximo 100,000 token. El cuerpo de la petición tiene un límite de 8 MB, pero el token es el límite real.
¿Por qué se corta la respuesta a mitad?
Probablemente alcanzaste max_tokens, cuyo valor por defecto es 2048. Auméntalo; el máximo por petición es 32,000. Vigila que el total no supere 100,000.
¿Cuántas peticiones por minuto puedo enviar?
300 por clave. Para tareas por lotes, se recomienda implementar una cola y limitar la tasa en tu lado antes de que se active el límite de peticiones.
¿Funcionan los parámetros temperature, top_p y stop?
Sí, estos campos de muestreo estándar se pasan directamente al modelo; su comportamiento es el mismo que esperarías en el endpoint de chat completions.
¿Dónde puedo ver los detalles de cada campo?
EnDetalle de parámetros de la interfaz hay una tabla por cada parámetro;la página de documentación es una referencia concisa.
Sobre qué significa "largo": 100,000 tokens equivalen aproximadamente a decenas de miles de caracteres en chino, dependiendo del contenido. Es solo una estimación de magnitud, no una conversión exacta. Para documentos muy largos, la práctica más segura es dividirlos y luego resumir.
Costos y saldo
¿Cómo se cobra?
Por token: $0.25 por cada millón de tokens de entrada y $1.00 por cada millón de tokens de salida. Sin cuotas mensuales ni suscripciones.
¿Se paga antes o después?
Antes. Recarga el saldo de crédito prepago en tu cuenta; se descuenta según el uso. El saldo no caduca.
¿Qué pasa cuando se acaba el dinero?
La petición fallará con código de estado 402 y error no_credit. El crédito de prueba gratis expirado se comporta igual; tras recargar el saldo, vuelve a funcionar.
¿Cómo estimar cuánto costará una función?
Consulta los ejemplos enTokens y facturación: lee el usage de la respuesta y multiplícalo por el precio unitario.
Un hábito de presupuesto adicional: recarga según el "uso estimado por ciclo"; no hace falta recargar demasiado de una vez. Al ser prepago, el saldo es tu límite estricto: se detiene al agotarse y no habrá facturas sorpresa.
Problemas prácticos de lanzamiento y depuración
¿Puedo usar la misma clave para desarrollo y producción?
Dado que una cuenta solo tiene una clave, de hecho se comparte. Asegúrate de guardar la clave solo en las variables de entorno del servidor, no en repositorios de código ni en la interfaz frontend, y ten en cuenta que regenerarla invalidará todas las instancias simultáneamente.
¿Debo reintentar inmediatamente ante un 503?
No. Esto indica que el servicio está temporalmente ocupado. Espera unos segundos y configura un número máximo de reintentos. Enviar peticiones masivas de golpe solo desperdicia tu cuota de peticiones.
La llamada a la API es lenta, ¿es un problema?
La generación de texto largo requiere tiempo; cuanto más largo sea el output, más tardará. Se recomienda habilitar streaming para que el usuario vea el texto a medida que se genera, y ajustar un tiempo de espera más generoso en el cliente.
La conversación se alarga demasiado, ¿cómo evito exceder el límite?
Recorta el historial en tu backend, manteniendo solo las últimas rondas. El contenido anterior puede comprimirse en un resumen. Estima el total antes de enviar la petición; no esperes a recibir un 400 para actuar.
¿Cómo confirmo cuántos tokens usó una petición?
Lee el campo usage de la respuesta, que incluye entrada, salida y total. En respuestas streaming, esta lectura aparece en el último bloque de datos, sin necesidad de parámetros adicionales.
Estas preguntas aparecen repetidamente porque surgen en el paso siguiente a "el código funciona". Trata esta sección como una lista de verificación previa al lanzamiento para confirmar que tu programa maneja cada caso.
Límites de contenido y usuarios
¿Qué contenido se rechazará?
Contenido adulto legal, novelas y temas controvertidos no se rechazarán. El contenido sexual que involucre a menores se bloqueará siempre, devolviendo 403, tanto en novelas como en roleplay.
¿Quién puede usarlo?
Solo adultos de 18 años o más. Si tu producto es de acceso público, añade una verificación de edad en la entrada.
¿Usarán mis prompts para entrenar?
No, los prompts no se usan para entrenamiento.
¿Dónde miro primero ante un error?
Lee primero el código y el message del objeto error en el cuerpo de la respuesta, luego compara con el código de estado: 401 es problema de clave, 402 es saldo, 403 es contenido, 429 es límite de peticiones, 503 es servicio ocupado; espera unos segundos y vuelve a intentarlo.
Preguntas frecuentes
¿Qué necesito para llamar a la API?
Una clave de API de una cuenta registrada, junto con una petición HTTPS hacia https://api.apidamoxing.com/v1, con un token Bearer en el Header, y el resto igual al formato de chat completion.
¿Qué funciones admite y cuáles no?
Admite chat de texto, streaming y llamadas a funciones. No admite imágenes, audio, video, embeddings vectoriales ni fine-tuning.
¿Por qué se corta la respuesta?
Normalmente porque se alcanzó max_tokens (por defecto 2048, ajustable hasta 32,000). La suma de prompt y output no debe exceder 100,000 tokens.
¿Qué pasa cuando se acaba el saldo?
La petición devuelve 402 y no_credit. Tras recargar el crédito prepago, se reanuda; el saldo no caduca.
¿Quiénes no pueden usar este servicio?
Menores de 18 años. El contenido sexual que involucre a menores se bloqueará siempre, devolviendo 403, sea ficticio o no.
Completa el formulario para obtener tu clave
Crea una cuenta, copia la clave y modifica la Base URL. La configuración es así de sencilla.