VI ▾
Lấy khóa API

FAQ API mô hình lớn: Tìm đáp án theo chủ đề

Khi mới làm quen với API mô hình lớn, bạn thường có hàng chục câu hỏi: lấy khóa ở đâu, có gửi ảnh được không, dịch vụ có dừng đột ngột không, một lần gọi được bao dài. Chúng tôi đã chia chúng thành 5 nhóm theo chủ đề. Mỗi nhóm có vài câu hỏi với câu trả lời súc tích, kèm liên kết đến bài chi tiết nếu bạn cần tìm hiểu sâu. Bạn có thể nhảy ngay đến nhóm bạn quan tâm.

Cập nhật lúc

Điểm chính

  • Đăng ký bằng email và mật khẩu, khóa hiển thị ngay lập tức. Mỗi tài khoản một khóa, có thể tạo lại.
  • Phạm vi tính năng là hội thoại văn bản thuần túy, một mô hình duy nhất, hỗ trợ streaming và gọi hàm, không có ảnh, giọng nói, embedding vector hay fine-tuning.
  • Tổng số token của prompt và output trong một yêu cầu không vượt quá 100.000 token, mỗi khóa API cho phép 300 yêu cầu mỗi phút.
  • Nội dung người lớn hợp pháp được phép, nhưng nội dung tình dục liên quan đến trẻ vị thành niên đều bị chặn. Dịch vụ chỉ dành cho người trưởng thành.

Tài khoản & khóa API

Làm sao để lấy khóa đầu tiên?

Truy cập tranglấy khóa, đăng ký bằng email và mật khẩu. Khóa sẽ hiện ra ngay sau khi đăng ký thành công, không cần nhập thông tin thanh toán.

Một tài khoản có tạo được nhiều khóa không?

Không, mỗi tài khoản chỉ một khóa. Nếu cần phân bổ chi phí cho các dự án khác nhau, hãy tự đánh dấu tag theo dự án trong hệ thống backend của bạn thay vì tạo nhiều khóa.

Khóa API bị lộ thì sao?

Hãy tạo lại ngay lập tức. Khóa cũ sẽ mất hiệu lực ngay tại thời điểm đó, vì vậy hãy chuẩn bị sẵn việc triển khai giá trị mới ở mọi nơi trước khi thực hiện.

Người dùng mới có được dùng thử không?

Có. Tài khoản mới được cấp $0.50 tín dụng dùng thử miễn phí, có hiệu lực trong 7 ngày, không cần liên kết phương thức thanh toán.

Nếu muốn xem toàn bộ quy trình từ đăng ký đến yêu cầu đầu tiên, bạn có thể làm theo hướng dẫn chi tiết trong bàichatbot.

Nếu bạn quản lý nhiều dự án cùng lúc, đừng dựa vào nhiều khóa API để cách ly. Hãy tự đánh dấu tag theo dự án trong backend của bạn cho mỗi yêu cầu và ghi lại usage. Cuối tháng, bạn có thể tổng hợp theo tag, chi tiết hơn nhiều so với các thống kê thô trên bảng điều khiển.

Gọi được gì, không gọi được gì

Địa chỉ endpoint và tên mô hình là gì?

Địa chỉ là https://api.apidamoxing.com/v1,模型名固定为 uncensored. Dịch vụ chỉ có một mô hình duy nhất.

Cung cấp những endpoint nào?

Hai endpoint: POST /v1/chat/completions để hội thoại, GET /v1/models để xem danh sách mô hình. Các đường dẫn khác sẽ trả về 404.

Có thể gửi ảnh, âm thanh hoặc tìm kiếm vector không?

Không. Chúng tôi chỉ xử lý văn bản, không hỗ trợ hình ảnh, giọng nói, video, embedding vector hay fine-tuning.

Có hỗ trợ streaming và gọi hàm không?

Có cả hai. Streaming hoạt động bằng cách thêm stream: true vào yêu cầu và trả về qua SSE. Gọi hàm tuân theo định dạng tools của OpenAI.

Có thể dùng luôn SDK OpenAI có sẵn không?

Được, bạn chỉ cần trỏ base_url đến địa chỉ trên và thay api_key bằng khóa API của bạn. Hỗ trợ Python, Node.js hoặc curl.

Một hiểu lầm phổ biến là “vì tương thích định dạng OpenAI nên nó hỗ trợ mọi tính năng của OpenAI”. Tương thích chỉ có nghĩa là định dạng yêu cầu và phản hồi giống nhau, không đồng nghĩa với phạm vi tính năng. Vì dịch vụ chỉ hỗ trợ hội thoại văn bản, các đoạn mã hiện tại xử lý hiểu ảnh, chuyển giọng nói thành văn bản hay tìm kiếm vector cần được tách riêng và thay thế bằng giải pháp khác.

Độ dài, tần suất & tham số

Một lần gọi có thể chứa được bao nhiêu nội dung?

Tổng đầu vào và đầu ra tối đa 100,000 token. Kích thước yêu cầu cũng giới hạn 8 MB, nhưng trong hầu hết trường hợp văn bản, bạn sẽ chạm giới hạn token trước.

Tại sao câu trả lời bị ngắt quãng giữa chừng?

Thường là do đạt max_tokens (mặc định 2048). Bạn có thể tăng giá trị này lên, tối đa 32,000 cho mỗi yêu cầu, nhưng hãy đảm bảo tổng token không vượt quá 100,000.

Bạn có thể gửi bao nhiêu yêu cầu mỗi phút?

Mỗi khóa là 300 lần. Với các tác vụ hàng loạt, bạn nên tự giới hạn tốc độ hàng đợi ở phía mình trước khi bị giới hạn tốc độ, thay vì xử lý sự cố sau đó.

Các tham số temperature, top_p và stop có hoạt động không?

Có, các trường lấy mẫu tiêu chuẩn này sẽ được chuyển nguyên vẹn đến mô hình, với hành vi phù hợp với kỳ vọng của bạn đối với endpoint hoàn thành trò chuyện.

Bạn muốn xem chi tiết từng trường ở đâu?

Chi tiết tham số endpoint có bảng liệt kê từng mục, còn trang tài liệu thì là phần tham chiếu ngắn gọn.

Về khái niệm “dài là bao nhiêu”: 100,000 token tương đương khoảng vài chục nghìn ký tự tiếng Trung, tùy thuộc vào nội dung. Đây chỉ là ước lượng thứ tự độ lớn, không phải phép quy đổi chính xác. Khi xử lý tài liệu siêu dài, cách an toàn nhất là chia nhỏ rồi tổng hợp lại.

Chi phí và số dư

Phí tính như thế nào?

Tính theo token: $0.25 cho mỗi triệu token đầu vào, $1.00 cho mỗi triệu token đầu ra. Không có phí hàng tháng, không cần đăng ký gói.

Bạn có phải trả tiền trước hay trả tiền sau không?

Trả trước. Bạn nạp tiền vào số dư tín dụng trả trước của tài khoản, dùng bao nhiêu trừ bấy nhiêu, số dư không bao giờ hết hạn.

Sẽ xảy ra gì khi tiền hết?

Yêu cầu sẽ thất bại với mã trạng thái 402 và mã lỗi no_credit. Khi tín dụng dùng thử miễn phí hết hạn, bạn cũng sẽ gặp tình trạng tương tự và sẽ khôi phục sau khi bổ sung số dư.

Bạn có thể ước tính chi phí cho một tính năng như thế nào?

Hãy tham chiếu các ví dụ tính toán trong token và chi phí; cốt lõi là đọc giá trị usage trong phản hồi rồi nhân với đơn giá.

Một thói quen quản lý ngân sách khác: mỗi lần nạp tiền, hãy dựa trên “lượng dự kiến sử dụng trong chu kỳ này”, không cần nạp quá nhiều một lúc. Vì là trả trước, số dư chính là giới hạn cứng của bạn; khi hết thì dừng lại, không phát sinh hóa đơn bất ngờ.

Các vấn đề thực tế khi triển khai và xử lý sự cố

Bạn có thể dùng chung một khóa API cho cả môi trường phát triển và sản xuất không?

Vì mỗi tài khoản chỉ có một khóa, nên trên thực tế bạn sẽ dùng chung. Hãy đảm bảo chỉ đặt khóa trong biến môi trường của máy chủ, không đưa vào kho mã nguồn hoặc trang frontend, và nhớ rằng việc tạo lại khóa sẽ làm vô hiệu hóa tất cả các môi trường cùng lúc.

Bạn có nên thử lại ngay lập tức khi gặp lỗi 503 không?

Không. Điều này cho thấy dịch vụ đang bận tạm thời. Hãy đợi vài giây rồi thử lại, đồng thời đặt giới hạn số lần thử lại tối đa. Việc gửi ồ ạt liên tục chỉ làm lãng phí giới hạn yêu cầu của bạn.

Gọi endpoint chậm, có phải hệ thống bị lỗi không?

Việc tạo văn bản dài vốn đã tốn thời gian; đầu ra càng dài thì thời gian càng lâu. Bạn nên bật chế độ truyền phát (streaming) để người dùng thấy được các ký tự đầu tiên, đồng thời đặt thời gian chờ (timeout) của client rộng hơn.

Cuộc hội thoại càng dài, làm thế nào để tránh vượt quá giới hạn?

Bạn hãy cắt bớt lịch sử ở phía backend của mình, chỉ giữ lại một số vòng giao tiếp gần nhất; các nội dung cũ hơn có thể được nén thành tóm tắt. Hãy ước tính tổng lượng token trước khi gửi yêu cầu, đừng đợi đến khi endpoint trả về lỗi 400 mới xử lý.

Làm sao để xác định chính xác một yêu cầu đã sử dụng bao nhiêu token?

Hãy đọc trường usage trong phản hồi, trường này chứa ba mục: đầu vào, đầu ra và tổng cộng. Đối với phản hồi truyền phát, dữ liệu này sẽ có trong khối dữ liệu cuối cùng, không cần thêm tham số nào.

Những câu hỏi này thường xuyên xuất hiện vì chúng liên quan đến bước tiếp theo sau khi “mã nguồn đã chạy”. Bạn nên xem mục này như một danh sách kiểm tra trước khi triển khai, hãy xác nhận từng mục xem chương trình của bạn đã xử lý tương ứng chưa.

Giới hạn nội dung và đối tượng sử dụng

Nội dung nào sẽ bị từ chối?

Nội dung người lớn hợp pháp, tiểu thuyết và các chủ đề gây tranh cãi sẽ không bị từ chối. Nội dung tình dục liên quan đến trẻ vị thành niên sẽ bị chặn và trả về 403, kể cả trong tiểu thuyết và nhập vai.

Ai có thể sử dụng dịch vụ này?

Chỉ dành cho người từ 18 tuổi trở lên. Nếu sản phẩm của bạn được mở rộng cho công chúng, hãy thêm bước xác minh độ tuổi tại điểm truy cập.

Prompt của tôi có được dùng để huấn luyện mô hình không?

Không, prompt không được dùng để huấn luyện.

Khi gặp lỗi, bạn nên xem phần nào trước?

Trước tiên hãy đọc trường code và message trong đối tượng error của phản hồi, sau đó đối chiếu với mã trạng thái: 401 là vấn đề về khóa, 402 là vấn đề về số dư, 403 là vấn đề về nội dung, 429 là giới hạn tốc độ, 503 là dịch vụ đang bận tạm thời (hãy đợi vài giây rồi thử lại).

Câu hỏi thường gặp

Gọi endpoint cần những gì?

Một khóa từ tài khoản đã đăng ký, cùng với yêu cầu HTTPS trỏ đến https://api.apidamoxing.com/v1, trong Header có chứa token Bearer. Các phần còn lại tuân thủ định dạng hoàn thành trò chuyện.

Hỗ trợ những tính năng nào và không hỗ trợ những tính năng nào?

Hỗ trợ hội thoại văn bản, truyền phát (streaming) và gọi hàm; không hỗ trợ hình ảnh, âm thanh, video, nhúng vector và tinh chỉnh mô hình.

Tại sao câu trả lời bị cắt ngang?

Thông thường là do đạt đến giới hạn max_tokens (mặc định là 2048, có thể điều chỉnh lên đến 32,000). Đồng thời, tổng số token của prompt và đầu ra không được vượt quá 100,000 token.

Sẽ xảy ra gì khi hết số dư?

Yêu cầu sẽ trả về mã 402 và no_credit. Bạn chỉ cần nạp thêm tín dụng trả trước là có thể tiếp tục sử dụng, số dư không bao giờ hết hạn.

Những đối tượng nào không thể sử dụng dịch vụ này?

Dưới 18 tuổi. Nội dung tình dục liên quan đến người dưới 18 tuổi sẽ bị chặn và trả về 403, bất kể nội dung đó có thực hay không.

Chỉ cần điền biểu mẫu để lấy khóa API

Tạo tài khoản, sao chép khóa, thay đổi Base URL. Việc cấu hình rất đơn giản.

Lấy khóa API