IT ▾
Ottieni chiave API

FAQ API LLM: trova la risposta per argomento

I developer alle prime armi con l'API LLM hanno spesso molte domande: dove trovare la chiave, si possono inviare immagini, il servizio si ferma, qual è il limite di lunghezza. Le abbiamo divise in 5 gruppi. Le risposte sono concise e rimandano agli articoli specifici. Salta direttamente all'argomento che ti interessa.

Aggiornato il

Punti chiave

  • L'ingresso avviene con registrazione email e password. La chiave appare subito: una per account, rigenerabile.
  • Funzionalità: chat testuale, modello singolo, streaming e chiamata di funzioni. Nessuna immagine, audio, vettori o fine-tuning.
  • Una richiesta: prompt + output ≤ 100.000 token. Ogni chiave: 300 richieste al minuto.
  • Contenuti adulti consentiti, ma i contenuti sessuali che coinvolgono minori sono bloccati. Servizio solo per adulti.

Account e chiavi

Come ottenere la prima chiave?

Vai alla pagina Ottieni chiave, registrati con email e password. La chiave appare subito, senza dati di pagamento.

Posso creare più chiavi per lo stesso account?

No, un account una chiave. Per distinguere l'utilizzo per progetto, etichetta nel tuo backend, non usare più chiavi.

Cosa fare se la chiave viene compromessa?

Rigenerala subito. La vecchia chiave diventa invalida istantaneamente. Prepara la nuova chiave e distribuila ovunque prima di rigenerare.

Posso fare una prova prima di pagare?

Sì. I nuovi account ricevono $0.50 di credito di prova gratuito, valido per 7 giorni, senza bisogno di collegare un metodo di pagamento.

Per vedere l'intero flusso dalla registrazione alla prima richiesta, segui la guida completa nel progettoChatbot.

Per isolare i costi di più progetti, etichetta ogni chiamata nel tuo backend e registra l'uso. Riassumi per etichetta: più chiaro delle statistiche della console.

Funzionalità supportate e non

Qual è l'URL dell'endpoint e il nome del modello?

L'indirizzo è https://api.apidamoxing.com/v1,模型名固定为 senza censura. Offriamo un solo modello.

Quali endpoint sono disponibili?

Due: POST /v1/chat/completions per la chat e GET /v1/models per la lista dei modelli. Altri percorsi restituiscono 404.

Posso inviare immagini, audio o fare ricerca vettoriale?

No. Elaboriamo solo testo. Nessuna immagine, audio, video, embedding vettoriale o fine-tuning.

Supportano lo streaming e la chiamata di funzioni?

Sì. Attiva lo streaming con stream: true (risposta via SSE). La chiamata di funzioni usa il formato standard OpenAI tools.

Posso usare direttamente gli SDK OpenAI?

Sì. Imposta base_url sull'endpoint e api_key con la tua chiave. Funziona con Python, Node.js o curl.

Un malinteso comune è: "Visto che è compatibile con OpenAI, supporta tutte le sue funzionalità". La compatibilità riguarda il formato delle richieste e delle risposte, non l'ambito delle funzionalità. Qui c'è solo il chat testuale, quindi il codice esistente per la comprensione delle immagini, la trascrizione audio e la ricerca vettoriale va separato e sostituito con un'altra implementazione.

Lunghezza, frequenza e parametri

Quanto testo posso inviare?

Input + output max 100.000 token. Il corpo della richiesta è limitato a 8 MB, ma nei casi d'uso testuali si raggiunge prima il limite token.

Perché la risposta si interrompe a metà?

Probabilmente hai raggiunto max_tokens (default 2048). Aumentalo a 32.000, ma non superare il totale di 100.000.

Quante richieste al minuto puoi inviare?

300 per chiave. Per i batch, ti consigliamo di gestire la coda e il rate limiting lato client, prima di subire il blocco.

I parametri temperature, top_p e stop vengono applicati?

Sì. Questi parametri standard di campionamento vengono passati al modello così come sono, con un comportamento coerente con le tue aspettative sull'endpoint di chat completions.

Dove trovi i dettagli di ogni parametro?

Nella sezione dettaglio dei parametri dell'endpoint trovi una tabella dettagliata, mentre la pagina documentazione è un riferimento conciso.

100.000 token ≈ decine di migliaia di caratteri cinesi. È un ordine di grandezza. Per documenti lunghi, segmenta e riassumi.

Costi e saldo

Come funziona la tariffazione?

A pagamento per token: $0,25 per milione di token in input, $1,00 per milione di token in output, senza canone mensile e senza abbonamento.

Si paga prima o dopo?

Si paga prima. Ricarica il saldo prepagato nel tuo account: si consuma solo ciò che usi e il saldo non scade mai.

Cosa succede quando il saldo è esaurito?

Errore 402 no_credit. Il credito di prova scade con lo stesso errore. Ricarica per riprendere.

Come stimare il costo di una funzionalità?

Fai riferimento agli esempi nella sezione token e fatturazione: il punto chiave è leggere il campo usage nella risposta e moltiplicarlo per il prezzo unitario.

Un consiglio per la gestione del budget: ricarica in base al "consumo previsto per il periodo". Non serve ricaricare troppo in una volta. Essendo un saldo prepagato, il tuo saldo è il limite massimo: quando si esaurisce, le richieste si fermano e non ci saranno costi imprevisti.

Problemi pratici di rilascio e debug

Posso usare la stessa chiave API per sviluppo e produzione?

Poiché un account ha una sola chiave, di fatto le condividi. Tieni la chiave solo nelle variabili d'ambiente del server: non inserirla nel repository del codice o nel frontend. Tieni presente che rigenerarla invalida la chiave in tutti gli ambienti contemporaneamente.

Devo ritentare immediatamente in caso di errore 503?

No. Il 503 indica che il servizio è temporaneamente occupato. Riprova dopo qualche secondo e imposta un numero massimo di ritentativi. Inviare richieste a raffica spreca solo il tuo quota di richieste.

L'endpoint è lento: c'è un problema?

La generazione di testo lungo richiede tempo e l'output è più lungo più ci mette. Ti consigliamo di abilitare lo streaming per mostrare all'utente i primi caratteri, e di impostare un timeout lato client più generoso.

La conversazione diventa troppo lunga: come evito di superare il limite?

Taglia la cronologia nel tuo backend, mantieni solo gli ultimi round. Stima il totale prima della richiesta, non dopo il 400.

Come verificare quanti token ha consumato una specifica richiesta?

Leggi il campo usage nella risposta, che include input, output e totale. Nelle risposte in streaming, questa lettura è presente nell'ultimo blocco di dati, senza bisogno di parametri aggiuntivi.

Queste domande ricorrono perché riguardano il passo successivo al semplice "il codice gira". Tratta questa sezione come una checklist pre-rilascio: verifica che il tuo codice gestisca ogni punto.

Confini dei contenuti e soggetti autorizzati

Quali contenuti vengono bloccati?

Contenuti per adulti legali, narrativa e argomenti controversi non vengono bloccati. I contenuti sessuali che coinvolgono minori vengono sempre intercettati e restituiscono un 403, sia nella narrativa che nel roleplay.

Chi può usare il servizio?

Solo maggiorenni (18+). Se il tuo prodotto è pubblico, inserisci una verifica dell'età all'ingresso.

I miei prompt verranno usati per l'addestramento?

No, i prompt non vengono utilizzati per l'addestramento.

Dove guardare per primo in caso di errore?

Leggi prima il campo code e message dell'oggetto error nel corpo della risposta, poi confrontali con il codice di stato: 401 indica un problema con la chiave, 402 il saldo, 403 i contenuti, 429 il rate limit, 503 il servizio temporaneamente occupato (riprova dopo qualche secondo).

Domande frequenti

Cosa serve per chiamare l'endpoint?

Una chiave di un account registrato, una richiesta HTTPS verso https://api.apidamoxing.com/v1, e un header con il token Bearer. Il resto segue il formato standard di chat completions.

Quali funzionalità sono supportate e quali no?

Supporta conversazioni testuali, streaming e chiamata di funzioni. Non supporta immagini, audio, video, embedding vettoriali e fine-tuning.

Perché la risposta viene troncata?

Di solito si raggiunge il limite di max_tokens (default 2048, modificabile fino a 32.000). Inoltre, la somma di prompt e output non può superare 100.000 token.

Cosa succede quando il saldo è esaurito?

La richiesta restituisce 402 e no_credit. Ricaricando il saldo prepagato puoi continuare; il saldo non scade mai.

Chi non può usare questo servizio?

Utenti di età inferiore agli 18 anni. I contenuti sessuali che coinvolgono minori, siano essi realistici o meno, vengono bloccati e restituiscono un errore 403.

Compila il modulo per ottenere la chiave API

Crea account, copia chiave, modifica Base URL. Configurazione semplice.

Ottieni la chiave API