FAQ API Model Besar: Temukan Jawaban Berdasarkan Topik
Pengembang yang baru mengenal API model besar sering memiliki belasan pertanyaan kecil: dari mana mendapatkan kunci, bisa kirim gambar, apakah akan berhenti tiba-tiba, dan berapa panjang teks yang bisa dihasilkan. Pertanyaan ini dikelompokkan menjadi lima tema dengan jawaban singkat; Anda dapat langsung melompat ke bagian yang Anda minati.
Diperbarui pada
Poin Penting
- Daftar dengan email dan kata sandi. Kunci ditampilkan secara instan. Satu akun satu kunci, dan kunci dapat dibuat ulang.
- Kapasitas hanya untuk percakapan teks dengan satu model. Mendukung streaming dan function calling. Tidak mendukung gambar, audio, vektor, atau fine-tuning.
- Jumlah prompt dan output per permintaan tidak boleh melebihi 100,000 token. Setiap kunci dibatasi 300 permintaan per menit.
- Konten dewasa yang legal dapat digunakan, tetapi konten seksual melibatkan anak di bawah umur akan diblokir. Layanan hanya untuk pengguna dewasa.
Akun dan Kunci
Bagaimana cara mendapatkan kunci pertama?
Kunjungi halamanDapatkan Kunci, daftar dengan email dan kata sandi. Kunci akan ditampilkan setelah pendaftaran selesai tanpa perlu memasukkan informasi pembayaran.
Bisakah satu akun memiliki banyak kunci?
Tidak, satu akun hanya memiliki satu kunci. Untuk memisahkan penggunaan antar proyek, beri label pada setiap panggilan di backend Anda, bukan dengan membuat banyak kunci.
Bagaimana jika kunci bocor?
Regenerasi segera. Kunci lama menjadi tidak berlaku pada saat itu, jadi siapkan untuk mendistribusikan nilai baru ke berbagai tempat, lalu lakukan.
Apakah pengguna baru bisa mencoba dulu?
Ya. Akun baru mendapatkan saldo uji coba senilai $0.50 yang berlaku selama 7 hari tanpa perlu mengikat metode pembayaran.
Untuk melihat proses lengkap dari pendaftaran hingga permintaan pertama, ikuti panduan proyek di artikelChatbot.
Jika Anda mengelola beberapa proyek, jangan mengandalkan banyak kunci untuk isolasi. Berilah label proyek pada setiap panggilan di backend Anda dan catat usage. Pengelompokan berdasarkan label di akhir bulan akan lebih jelas daripada statistik kasar di konsol.
Apa yang Bisa dan Tidak Bisa Dipanggil
Apa alamat API dan nama modelnya?
Alamatnya adalah https://api.apidamoxing.com/v1,模型名固定为 uncensored. Layanan ini hanya menyediakan satu model.
Endpoint apa saja yang tersedia?
Dua: POST /v1/chat/completions untuk percakapan, dan GET /v1/models untuk melihat daftar model. Path lain akan mengembalikan 404.
Apakah bisa mengirim gambar, audio, atau melakukan pencarian vektor?
Tidak. Layanan ini hanya memproses teks. Tidak ada dukungan untuk gambar, audio, video, embedding vektor, atau fine-tuning.
Apakah mendukung streaming dan function calling?
Ya. Aktifkan streaming dengan menambahkan stream: true pada permintaan (menggunakan SSE). Function calling mengikuti format tools OpenAI.
Bisakah menggunakan SDK OpenAI yang ada?
Ya. Cukup arahkan base_url ke alamat di atas dan ganti api_key dengan kunci Anda. Bisa menggunakan Python, Node, atau curl.
Kesalahan umum adalah mengira bahwa karena kompatibel dengan format OpenAI, maka semua fitur OpenAI didukung. Kompatibilitas hanya berarti format permintaan dan respons yang sama. Karena layanan ini hanya untuk percakapan teks, kode yang melibatkan pemahaman gambar, transkripsi audio, atau pencarian vektor perlu dipisahkan dan diganti implementasinya.
Panjang, Frekuensi, dan Parameter
Berapa banyak konten yang bisa dimuat dalam satu permintaan?
Jumlah input dan output maksimal 100,000 token. Body permintaan dibatasi 8 MB, namun pada kasus teks, batas token biasanya tercapai lebih dulu.
Mengapa jawaban terpotong di tengah jalan?
Kemungkinan besar karena mencapai batas max_tokens (default 2048). Naikkan nilai ini hingga maksimum 32,000 per permintaan, namun pastikan total tidak melebihi 100,000 token.
Berapa banyak permintaan yang dapat dikirim per menit?
300 per kunci. Untuk tugas batch, disarankan untuk melakukan antrian dan pembatasan laju di sisi Anda sendiri agar tidak perlu melakukan penanganan darurat setelah terkena batas laju.
Apakah temperature, top_p, dan stop akan diterapkan?
Ya, parameter sampling standar ini diteruskan ke model apa adanya, dengan perilaku sesuai harapan Anda pada endpoint kelengkapan obrolan.
Di mana Anda dapat melihat detail setiap parameter?
Tabel rinci tersedia di detail parameter endpoint, sedangkan halaman dokumentasi memberikan referensi ringkas.
Tentang definisi "panjang": 100.000 token kira-kira setara dengan puluhan ribu karakter bahasa Mandarin, tergantung pada konten; ini hanya perkiraan orde besaran, bukan konversi tepat. Saat memproses dokumen sangat panjang, memotongnya menjadi bagian-bagian lalu menggabungkannya adalah pendekatan yang lebih aman.
Biaya dan Saldo
Bagaimana cara penagihan?
Dihitung per token: input $0,25 per juta token, output $1,00 per juta token, tanpa biaya bulanan dan tanpa perlu berlangganan.
Apakah pembayaran dilakukan di muka atau di belakang?
Di muka. Anda mengisi saldo prabayar di akun, dan saldo akan dikurangi sesuai pemakaian. Saldo tidak akan kedaluwarsa.
Apa yang terjadi jika saldo Anda habis?
Permintaan akan gagal dengan kode status 402 dan kode kesalahan no_credit. Saat kredit uji coba gratis habis, perilakunya sama; saldo akan kembali tersedia setelah Anda melakukan pengisian ulang.
Bagaimana cara memperkirakan biaya untuk suatu fitur?
Lihat contoh perhitungan di token dan penagihan. Intinya adalah membaca usage dalam respons, lalu mengalikannya dengan harga satuan.
Sebuah kebiasaan anggaran tambahan: isi ulang saldo sesuai dengan "estimasi penggunaan dalam periode ini", tidak perlu mengisi terlalu banyak sekaligus. Karena ini adalah saldo prabayar, saldo Anda menjadi batas tegas; saat habis, layanan berhenti, sehingga tidak akan ada tagihan tak terduga.
Masalah praktis saat peluncuran dan pemecahan masalah
Bisakah kunci yang sama digunakan untuk pengembangan dan produksi?
Karena setiap akun hanya memiliki satu kunci, pada praktiknya kunci tersebut memang digunakan bersama. Pastikan untuk menyimpan kunci hanya dalam variabel lingkungan di sisi server, jangan dimasukkan ke dalam repositori kode atau halaman frontend, dan ingat bahwa membuat ulang kunci akan membuat semua lingkungan tidak valid secara bersamaan.
Apakah harus segera melakukan percobaan ulang saat terjadi error 503?
Tidak. Ini menunjukkan bahwa layanan sedang sibuk sementara. Coba lagi setelah beberapa detik dan tetapkan batas maksimum percobaan ulang. Mengirim permintaan secara agresif hanya akan menghabiskan kuota permintaan Anda.
Pemanggilan endpoint lambat, apakah ada masalah?
Penghasilkan teks panjang memang membutuhkan waktu; semakin panjang outputnya, semakin lama prosesnya. Disarankan untuk mengaktifkan streaming agar pengguna dapat melihat bagian awal teks, sambil mengatur batas waktu (timeout) klien menjadi lebih longgar.
Bagaimana cara menghindari batas konteks saat percakapan menjadi sangat panjang?
Potong riwayat di backend Anda sendiri, hanya menyertakan beberapa putaran terakhir; konten yang lebih awal dapat dipadatkan menjadi ringkasan. Perkirakan total token sebelum mengirim permintaan, jangan menunggu hingga endpoint mengembalikan 400 baru kemudian melakukan penanganan.
Bagaimana cara memastikan berapa banyak token yang sebenarnya digunakan oleh suatu permintaan?
Baca bidang usage dalam respons, yang berisi input, output, dan total. Untuk respons streaming, data ini disertakan dalam blok data terakhir, tanpa memerlukan parameter tambahan.
Pertanyaan-pertanyaan ini sering muncul karena semuanya terjadi pada langkah berikutnya setelah "kode berhasil dijalankan". Disarankan untuk menggunakan bagian ini sebagai daftar periksa pra-peluncuran, dan memverifikasi secara bertahap apakah program Anda memiliki penanganan yang sesuai.
Batas konten dan subjek yang diizinkan
Konten jenis apa yang akan ditolak?
Konten dewasa yang legal, fiksi, dan topik yang kontroversial tidak akan ditolak. Konten seksual yang melibatkan minor akan selalu diblokir dan mengembalikan 403, baik dalam fiksi maupun roleplay.
Siapa yang dapat menggunakannya?
Hanya untuk orang dewasa berusia 18 tahun ke atas. Jika produk Anda terbuka untuk publik, pastikan untuk melakukan verifikasi usia di titik masuk.
Apakah prompt saya akan digunakan untuk pelatihan?
Tidak, prompt tidak digunakan untuk pelatihan.
Di mana harus melihat terlebih dahulu saat terjadi error?
Baca terlebih dahulu bidang code dan message dari objek error dalam body respons, lalu bandingkan dengan kode status: 401 adalah masalah kunci, 402 adalah masalah saldo, 403 adalah masalah konten, 429 adalah batas laju, 503 adalah layanan sibuk sementara (coba lagi setelah beberapa detik).
Pertanyaan Umum
Apa yang diperlukan untuk memanggil endpoint?
Kunci dari akun terdaftar, ditambah permintaan HTTPS ke https://api.apidamoxing.com/v1, dengan header yang menyertakan token Bearer; sisanya mengikuti format kelengkapan obrolan.
Fitur apa saja yang didukung dan tidak didukung?
Mendukung percakapan teks, streaming, dan pemanggilan fungsi; tidak mendukung gambar, audio, video, embedding vektor, dan fine-tuning.
Mengapa jawaban terpotong?
Biasanya karena mencapai batas max_tokens (default 2048, dapat dinaikkan hingga 32.000). Jumlah total prompt dan output tidak boleh melebihi 100.000 token.
Apa yang terjadi jika saldo habis?
Permintaan akan mengembalikan 402 dan no_credit. Layanan dapat dilanjutkan setelah mengisi saldo prabayar; saldo tidak akan kedaluwarsa.
Siapa yang tidak dapat menggunakan layanan ini?
Orang di bawah 18 tahun. Konten seksual yang melibatkan minor akan selalu diblokir dan mengembalikan 403, baik dalam fiksi maupun non-fiksi.
Cukup isi formulir untuk mendapatkan kunci
Buat akun, salin kunci, dan ubah Base URL. Konfigurasinya sangat sederhana.