PT ▾
Obter chave de API

FAQ da API de LLM: encontre respostas por tema

Para desenvolvedores que estão começando com APIs de LLM, surgem várias dúvidas: de onde vem a chave, se suporta imagem, se para de repente, qual o limite de texto. Agrupamos em cinco temas, com respostas objetivas e links para artigos. Você pode pular diretamente para o grupo de seu interesse.

Atualizado em

Pontos principais

  • O acesso é feito com e-mail e senha. A chave aparece na hora, uma por conta, e pode ser regenerada.
  • Suporte a chat de texto, streaming e chamada de funções. Sem imagens, áudio, vetores ou fine-tuning.
  • A soma do prompt e da saída por requisição não excede 100.000 tokens. Cada chave permite 300 requisições por minuto.
  • Conteúdo adulto legal é permitido, mas conteúdo sexual envolvendo menores é sempre bloqueado. O serviço é restrito a adultos.

Conta e chave de API

Como obter a primeira chave de API?

Acesse a página de obtenção de chave em , registre-se com e-mail e senha. A chave aparece após o registro, sem necessidade de preencher informações de pagamento.

Posso criar várias chaves por conta?

Não. Uma conta gera uma chave. Para separar custos por projeto, use tags no seu backend em vez de múltiplas chaves.

O que fazer se a chave de API vazar?

Regenere imediatamente. A chave antiga se torna inválida naquele momento, então prepare o novo valor para implantação antes de agir.

Posso testar antes de pagar?

Sim. Novas contas recebem $0,50 de crédito de teste válido por 7 dias, sem necessidade de vincular nenhum método de pagamento.

Para ver o processo completo do registro até a primeira chamada, siga o tutorial de configuração completa do projeto no artigo do chatbot .

Se você gerencia vários projetos simultaneamente, não confie apenas em múltiplas chaves para isolamento. Adicione tags de projeto ao backend para cada chamada e registre o uso. Assim, o resumo mensal por tag é mais claro que as estatísticas grosseiras do console.

O que é suportado e o que não é

Qual é o endpoint e o nome do modelo?

Endpoint: https://api.apidamoxing.com/v1,模型名固定为 uncensored. Apenas um único modelo disponível.

Quais endpoints estão disponíveis?

Dois: POST /v1/chat/completions para conversas e GET /v1/models para listar modelos. Demais caminhos retornam 404.

Posso enviar imagens, áudio ou fazer busca vetorial?

Não. O serviço é apenas para texto. Sem imagens, áudio, vídeo, embeddings vetoriais ou fine-tuning.

Suporta streaming e chamada de funções?

Sim. Use stream: true para streaming via SSE. Chamada de funções segue o formato tools do OpenAI.

Posso usar o SDK do OpenAI existente?

Sim. Altere base_url para o endpoint e api_key para sua chave. Compatível com Python, Node.js e curl.

Um equívoco comum é achar que, por ser compatível com o formato OpenAI, ele suporta todas as funcionalidades da OpenAI. A compatibilidade refere-se apenas ao formato de requisição e resposta, não ao escopo de funções. Aqui há apenas chat de texto, então código que usa visão, transcrição ou vetores precisa ser adaptado.

Comprimento, frequência e parâmetros

Qual o limite de conteúdo por requisição?

Máximo de 100.000 tokens (input + output). Limite de corpo de 8 MB, mas o limite de tokens é atingido primeiro.

Por que a resposta é interrompida?

Provavelmente você atingiu o max_tokens (padrão: 2048). Aumente o valor para até 32,000 por vez, mas não exceda 100,000 tokens no total.

Quantas requisições você pode enviar por minuto?

300 requisições por chave. Para tarefas em lote, recomendamos fazer o rate limit no seu lado antes de enviar, em vez de remediar após o limite ser atingido.

Os parâmetros temperature, top_p e stop funcionam?

Sim, esses campos de amostragem padrão são passados diretamente ao modelo, com comportamento consistente com o que você espera da API de chat completions.

Onde você pode ver os detalhes de cada parâmetro?

Tabelas detalhadas estão em detalhes dos parâmetros da interface. A página de documentação serve como referência concisa.

Sobre o que significa "longo": 100.000 tokens equivalem aproximadamente a dezenas de milhares de caracteres em chinês, dependendo do conteúdo. É apenas uma estimativa de magnitude, não uma conversão exata. Para documentos muito longos, a abordagem mais segura é dividir em partes e depois resumir.

Custos e saldo

Como é a cobrança?

Por token: $0,25 por milhão de tokens de entrada, $1,00 por milhão de tokens de saída. Sem mensalidade, sem assinatura.

O pagamento é adiantado ou posterior?

Adiantado. Recarregue o saldo pré-pago na sua conta. O valor é descontado conforme o uso. O saldo nunca expira.

O que acontece quando o saldo acaba?

As requisições falham com o código de status 402 e o código de erro no_credit. O crédito de teste grátis tem o mesmo comportamento. O serviço é restaurado após o recarregamento do saldo.

Como estimar o custo de uma funcionalidade?

Consulte os exemplos de cálculo em Tokens e cobrança. O essencial é ler o campo usage na resposta e multiplicar pelo preço unitário.

Uma dica de orçamento: recarregue com base no "uso estimado do período". Não é necessário recarregar muito de uma vez. Como é pré-pago, o saldo é seu limite rígido. Quando acabar, as requisições param, sem faturas surpresa.

Problemas práticos de lançamento e depuração

Desenvolvimento e produção podem usar a mesma chave?

Como cada conta tem apenas uma chave, na prática elas são compartilhadas. Mantenha a chave apenas nas variáveis de ambiente do servidor. Não a coloque no repositório de código ou na interface front-end. Lembre-se que regenerar a chave invalida todas as instâncias simultaneamente.

Devo tentar novamente imediatamente ao receber 503?

Não. Isso indica que o serviço está ocupado. Aguarde alguns segundos e tente novamente, configurando um número máximo de tentativas. Enviar requisições em massa apenas desperdiça a cota de requisições.

A chamada à API está lenta. Há algum problema?

A geração de texto longo naturalmente leva tempo; quanto maior a saída, mais demora. Recomendamos ativar o streaming para que o usuário veja o texto à medida que é gerado. Ajuste também o tempo limite (timeout) do cliente para um valor mais generoso.

A conversa fica muito longa. Como evitar o limite?

Corte o histórico no seu backend, mantendo apenas as últimas rodadas. Conteúdos mais antigos podem ser resumidos. Estime o total antes de enviar a requisição. Não espere receber o erro 400 para agir.

Como confirmar quantos tokens uma requisição consumiu?

Leia o campo usage na resposta, que contém os totais de entrada, saída e combinado. Em respostas com streaming, essa leitura está presente no último bloco de dados, sem necessidade de parâmetros adicionais.

Essas perguntas surgem frequentemente porque ocorrem no passo seguinte ao "o código funciona". Recomendamos usar esta seção como uma lista de verificação pré-lançamento para confirmar se seu programa trata cada cenário.

Limites de conteúdo e público-alvo

Que tipo de conteúdo é bloqueado?

Conteúdo adulto legal, romances e temas controversos não são bloqueados. Conteúdo sexual envolvendo menores é sempre bloqueado com 403, incluindo romances e roleplay.

Quem pode usar?

Exclusivamente adultos com 18 anos ou mais. Se o seu produto for aberto ao público, implemente uma verificação de idade na entrada.

Meus prompts serão usados para treinamento?

Não, os prompts não são usados para treinamento.

Onde olhar primeiro ao encontrar um erro?

Leia o código e a mensagem do objeto error no corpo da resposta. Consulte os códigos de status: 401 é problema de chave, 402 é saldo, 403 é conteúdo, 429 é limite excedido, 503 é serviço ocupado.

Perguntas frequentes

O que é necessário para chamar a API?

Uma chave de conta registrada, mais uma requisição HTTPS para https://api.apidamoxing.com/v1 com o Bearer token no Header, seguindo o formato de chat completion.

Quais funcionalidades são suportadas e quais não são?

Suporta chat de texto, streaming e chamada de funções. Não suporta imagem, áudio, vídeo, embeddings vetoriais ou fine-tuning.

Por que a resposta é truncada?

Geralmente, o limite max_tokens foi atingido. O padrão é 2048, ajustável até 32.000. O total combinado de prompt e saída não pode exceder 100.000 tokens.

O que acontece quando o saldo acaba?

A requisição retorna 402 e no_credit. Recarregue o saldo pré-pago para continuar. O saldo nunca expira.

Quem não pode usar este serviço?

Menores de 18 anos. Conteúdo sexual envolvendo menores é interceptado, independentemente de ser fictício, retornando 403.

Preencha o formulário para obter sua chave de API

Crie uma conta, copie a chave e defina o Base URL. A configuração é simples.

Obter chave de API