NL ▾
API-sleutel ophalen

Veelgestelde vragen over het LLM API: vind antwoorden per onderwerp

Als je voor het eerst met het LLM API aan de slag gaat, duizelen je waarschijnlijk de kop: waar haal je de sleutel vandaan, kun je afbeeldingen sturen, stopt het plotseling en hoe lang mag de tekst zijn? We hebben de vragen in vijf groepen ingedeeld. De antwoorden zijn beknopt; voor meer details verwijzen we naar de specifieke artikelen. Je kunt direct naar de groep springen die voor jou relevant is.

Laatst bijgewerkt op

Kernpunten

  • Registratie gaat via e-mail en wachtwoord; de sleutel verschijnt direct. Per account is één sleutel mogelijk, die je kunt regenereren.
  • Het ondersteunt alleen tekstchat met één model, inclusief streaming en function calling. Afbeeldingen, audio, vector embeddings en fine-tuning worden niet ondersteund.
  • De som van prompt en uitvoer per verzoek mag maximaal 100.000 tokens bedragen. Per sleutel zijn 300 verzoeken per minuut toegestaan.
  • Legale volwassen inhoud is toegestaan, maar seksuele inhoud met minderjarigen wordt altijd geblokkeerd. De dienst is uitsluitend voor volwassenen.

Account en sleutels

Hoe krijg je je eerste sleutel?

Ga naar de sleutel ophalen-pagina, registreer je met e-mail en wachtwoord. Je sleutel verschijnt direct na registratie; je hoeft geen betaalgegevens in te voeren.

Kan ik meerdere sleutels per account aanmaken?

Nee, één sleutel per account. Wil je het verbruik per project scheiden, voeg dan tags toe in je eigen backend. Gebruik niet meerdere sleutels voor dit doel.

Wat doe je bij een lek van de API-sleutel?

Regenereer de sleutel direct. De oude sleutel wordt op dat moment ongeldig. Zorg dat je de nieuwe waarde eerst overal hebt geïmplementeerd voordat je de oude verwijdert.

Kunnen nieuwe gebruikers eerst proefdraaien?

Ja. Nieuwe accounts krijgen $0,50 aan gratis proeftegoed, geldig voor 7 dagen. Er is geen betalingsmethode nodig.

Wil je het volledige proces van registratie tot je eerste verzoek zien? Volg dan de volledige projectsetup in het artikel Chatbot.

Beheer je meerdere projecten tegelijk? Verwacht dan niet dat meerdere sleutels isolatie bieden. Voeg in je eigen backend tags toe aan elke aanroep en log het usage. Zo kun je aan het eind van de maand per tag samenvatten, wat overzichtelijker is dan de grove statistieken in het dashboard.

Wat kun je wel en niet aanroepen

Wat zijn het endpoint en de modelnaam?

Het endpoint is https://api.apidamoxing.com/v1,模型名固定为 uncensored. We bieden slechts één model aan.

Welke endpoints worden aangeboden?

Twee: POST /v1/chat/completies voor gesprekken en GET /v1/models voor de modellijst. Andere paden leveren een 404-fout op.

Kun je afbeeldingen, audio of vectorzoekopdrachten versturen?

Nee. We verwerken alleen tekst. Er is geen ondersteuning voor afbeeldingen, audio, video, vector embeddings of fine-tuning.

Worden streaming en function calling ondersteund?

Ja. Activeer streaming door stream: true toe te voegen aan het verzoek; het antwoord wordt via SSE geretourneerd. Voor function calling gebruiken we het OpenAI-toolsformaat.

Kun je de bestaande OpenAI SDK direct gebruiken?

Ja. Wijs de base_url naar het bovenstaande endpoint en vervang de api_key door jouw sleutel. Werkt met Python, Node.js of curl.

E veelvoorkomend misverstand is dat compatibiliteit met het OpenAI-formaat betekent dat alle OpenAI-functies worden ondersteund. Compatibiliteit verwijst alleen naar het verzoeken- en responsformaat. Omdat we alleen tekstchat aanbieden, moet je bestaande code voor beeldbegrip, speech-to-text en vectorzoekopdrachten apart maken en vervangen door een andere implementatie.

Lengte, frequentie en parameters

Hoeveel inhoud past er in één verzoek?

Invoer en uitvoer samen mogen maximaal 100.000 tokens bedragen. De verzoekbody is beperkt tot 8 MB, maar in tekstscenario's raak je meestal eerst de tokenlimiet.

Waarom wordt het antwoord halverwege afgebroken?

Je hebt waarschijnlijk de max_tokens bereikt (standaard 2048). Verhoog deze waarde tot maximaal 32.000 per keer, maar houd er rekening mee dat de totale som niet meer dan 100.000 tokens mag zijn.

Hoeveel verzoeken per minuut kan ik versturen?

300 per sleutel. Voor batchtaken is het aan te raden om zelf een wachtrij en rate limiting in te stellen, zodat je niet verrast wordt door een rate limit.

Werken temperature, top_p en stop?

Ja, deze standaard sampling-parameters worden exact doorgegeven aan het model. Het gedrag komt overeen met wat je verwacht van een chat-completie-endpoint.

Waar vind je de details van elk veld?

In de gedetailleerde uitleg van de endpoint-parameters vind je een tabel per veld. De documentatiepagina biedt een beknopte referentie.

Hoe lang is lang? 100.000 tokens komt neer op tienduizenden Chinese karakters, afhankelijk van de inhoud. Dit is een ruwe schatting, geen exacte conversie. Voor zeer lange documenten is segmenteren en samenvatten de veiligste aanpak.

Kosten en saldo

Hoe wordt er gefactureerd?

Op token-basis: invoer is $0,25 per miljoen tokens, uitvoer is $1,00 per miljoen tokens. Geen maandelijkse kosten, geen abonnement nodig.

Moet ik vooraf of achteraf betalen?

Vooraf. Laad prepaid tegoed op je account op. Het bedrag wordt afgeschreven naarmate je het gebruikt, en het saldo verloopt niet.

Wat gebeurt er als het saldo op is?

Het verzoek faalt met statuscode 402 en foutmelding no_credit. Dit geldt ook voor verloopt gratis proeftegoed. Zodra je het saldo aanvult, werkt het weer.

Hoe schat ik de kosten van een functie?

Raadpleeg de rekenvoorbeelden in tokens en facturatie. De kern is het lezen van het veld usage in het antwoord en dit vermenigvuldigen met de tarieven.

Een extra tip voor budgettering: laad op basis van je verwachte verbruik in deze periode. Je hoeft niet in één keer veel op te laden. Omdat je prepaid werkt, is je saldo je harde limiet. Als het op is, stop je, zonder verrassingen op de factuur.

Praktische vragen over livegang en foutopsporing

Kan ik dezelfde sleutel gebruiken voor ontwikkeling en productie?

Ja, omdat een account maar één sleutel heeft, zijn ze feitelijk hetzelfde. Zorg er wel voor dat je de sleutel alleen in de omgevingsvariabelen van je server opslaat, niet in de code-repository of op de frontend. Houd er rekening mee dat het opnieuw genereren van de sleutel alle omgevingen tegelijk ongeldig maakt.

Moet ik direct opnieuw proberen bij een 503?

Nee. Dit betekent dat de service tijdelijk druk is; probeer het na een paar seconden opnieuw en stel een maximum aantal retries in. Opeenvolgende snelle pogingen verspillen alleen je verzoekkrediet.

De endpoint is langzaam, is er iets mis?

Het genereren van lange teksten kost nu eenmaal tijd; hoe langer de uitvoer, hoe langer het duurt. Zet streaming aan zodat gebruikers de eerste woorden al zien, en stel de client-timeout iets ruimer in.

De conversatie wordt langer, hoe voorkom ik dat de limiet wordt overschreden?

Knip de geschiedenis in je eigen backend en houd alleen de laatste paar ronden mee. Oudere inhoud kun je samenvatten tot een samenvatting. Schat de totale hoeveelheid tokens voordat je een verzoek verstuurt, wacht niet tot je een 400-fout krijgt.

Hoe weet ik hoeveel tokens een specifiek verzoek heeft verbruikt?

Lees het veld usage in het antwoord; dit bevat invoer, uitvoer en het totaal. Bij streaming-antwoorden staat deze informatie in het laatste data-blok, zonder extra parameters.

Deze vragen komen vaak terug omdat ze zich voordoen op het moment dat de code al werkt. Behandel deze sectie als een checklist voor livegang en controleer of je applicatie elk punt afhandelt.

Grenzen van de inhoud en gebruikers

Welke inhoud wordt geweigerd?

Legale volwassen inhoud, romans en controversiële onderwerpen worden niet geweigerd. Seksuele inhoud met minderjarigen wordt altijd geblokkeerd met een 403-fout, ook in romans en roleplay.

Wie kan dit gebruiken?

Alleen volwassenen van 18 jaar of ouder. Als je product openbaar toegankelijk is, voeg dan een leeftijdverificatie toe aan de ingang.

Wordt mijn prompt gebruikt voor training?

Nee, prompts worden niet gebruikt voor training.

Waar kijk je eerst bij een fout?

Lees eerst de code en message van het error-object in het antwoord. Controleer daarna de statuscode: 401 betekent een probleem met de sleutel, 402 betekent een probleem met het saldo, 403 betekent inhoud, 429 betekent rate limiting, en 503 betekent dat de service tijdelijk druk is. Wacht een paar seconden en probeer het opnieuw.

Veelgestelde vragen

Wat heb ik nodig om de endpoint aan te roepen?

Een sleutel van een geregistreerd account, een HTTPS-verzoek naar https://api.apidamoxing.com/v1, en een Bearer-token in de Header. De rest is hetzelfde formaat als chat-completie.

Welke functies worden ondersteund en welke niet?

Ondersteund: tekstgesprekken, streaming en function calling. Niet ondersteund: afbeeldingen, audio, video, vector embeddings en fine-tuning.

Waarom wordt het antwoord afgekapt?

Meestal omdat je de max_tokens hebt bereikt. De standaardwaarde is 2048, maar je kunt dit verhogen tot 32.000. Let op: de som van prompt en uitvoer mag niet meer dan 100.000 tokens bedragen.

Wat gebeurt er als het saldo op is?

Het verzoek retourneert 402 met no_credit. Laad prepaid tegoed op om door te gaan; het saldo verloopt niet.

Wie kan deze dienst niet gebruiken?

Mensen jonger dan 18 jaar. Seksuele inhoud met minderjarigen wordt geblokkeerd met een 403-fout, ongeacht of deze fictief is.

Vul het formulier in om je API-sleutel te ontvangen

Maak een account aan, kopieer je sleutel en pas de Base URL aan. Zo eenvoudig is configureren.

API-sleutel ophalen