获取 API 密钥

大模型 API 常见问题:按主题找答案

开发者第一次接触大模型 API,脑子里往往同时冒出十几个小问题:钥匙从哪来、能不能传图、会不会突然停、一次能写多长。把它们按主题分成五组,每组几个问题,答案尽量一句话说透,需要展开的地方再指向对应的专题文章,你可以直接跳到自己关心的那一组。

更新于

要点

  • 入口是邮箱加密码注册,密钥即时显示,一个账户一把,可重新生成。
  • 能力范围是纯文本聊天,单一模型,支持流式与函数调用,不含图片、语音、向量和微调。
  • 一次请求的 prompt 与输出合计不超过 100,000 token,每把密钥每分钟 300 次请求。
  • 合法的成人内容可用,但涉及未成年人的性内容一律拦截,服务仅限成年人。

账户与密钥

怎么拿到第一把密钥?

去获取密钥页,用邮箱和密码注册,注册完成密钥就会显示出来,不需要填写支付信息。

一个账户能建多把密钥吗?

不能,每个账户一把。想给不同项目区分用量,请在你自己的后端按项目打标签记账,而不是靠多把密钥。

密钥泄露了怎么办?

立刻重新生成。旧密钥在那一刻就作废,所以先准备好把新值部署到各处,再动手。

新用户能先试用吗?

能。新账户有 $0.50 的试用额度,7 天内有效,期间不用绑定任何支付方式。

想看从注册到发出第一个请求的全过程,可以对照聊天机器人一文里的完整项目搭建一遍。

如果你同时要管理多个项目,别指望靠多把密钥隔离,而是在自己的后端给每次调用打上项目标签,把 usage 记录下来。这样月底按标签汇总,比任何控制台的粗粒度统计都更清楚。

能调用什么,不能调用什么

接口地址和模型名是什么?

地址是 https://api.apidamoxing.com/v1,模型名固定为 uncensored。服务只有这一个模型。

提供哪些端点?

两个:POST /v1/chat/completions 用来对话,GET /v1/models 用来查看模型列表。其他路径会得到 404。

能传图片、音频,或者做向量检索吗?

不能。这里只处理文本,没有图像、语音、视频、向量嵌入,也不提供微调。

支持流式输出和函数调用吗?

都支持。流式是在请求里加 stream: true,用 SSE 返回;函数调用沿用 OpenAI 的 tools 格式。

可以直接用现成的 OpenAI SDK 吗?

可以,把 base_url 指向上面的地址、api_key 换成你的密钥即可。Python、Node 或 curl 都行。

一个常见的误会是“既然兼容 OpenAI 格式,那它支持 OpenAI 的所有功能”。兼容指的是请求和响应的格式,不代表功能范围相同。这里只有文本聊天,所以涉及图片理解、语音转写、向量检索的现有代码,需要把那部分拆出去,换成别的实现。

长度、频率与参数

一次能塞多少内容?

输入和输出加起来最多 100,000 token。请求体本身还限 8 MB,不过文本场景几乎先碰到 token 上限。

回答为什么写到一半就断了?

多半是撞上了 max_tokens,默认值是 2048。调大它即可,单次最高 16,000,同时留意总量别超过 100,000。

每分钟能发多少请求?

每把密钥 300 次。批量任务建议在自己这边先排队限速,别等被限流了再补救。

temperature、top_p、stop 会生效吗?

会,这些标准采样字段会原样传递给模型,行为与你对聊天补全接口的预期一致。

想看每个字段的细节去哪里?

在接口参数详解里有逐项表格,文档页则是简明的参考。

关于“多长算长”:100,000 token 大约相当于几万字的中文,具体取决于内容,这只是粗略的量级,不是精确换算。需要处理超长文档时,先分段、再汇总,是比较稳妥的做法。

费用与余额

怎么收费?

按 token 计:输入每百万 $0.25,输出每百万 $1.00,没有月费,也不用订阅。

钱是先付还是后付?

先付。在账户里充值预付费余额,用多少扣多少,余额不会过期。

钱用完了会怎样?

请求会失败,状态码 402,错误码 no_credit。试用额度到期时也是同样的表现,补充余额后恢复。

怎样估算一个功能要花多少?

参考token 与计费里的算例,核心是读响应里的 usage,再乘以单价。

再补充一个预算习惯:每次充值都按“本周期预计用量”来,不必一次充太多。因为是预付费,余额就是你的硬性上限,用完就停,不会产生意外账单。

上线与排错的实际问题

开发和线上能共用同一把密钥吗?

因为一个账户只有一把,所以事实上共用。务必把密钥只放在服务端的环境变量里,别写进代码仓库或前端页面,并且知道重新生成会让所有环境同时失效。

遇到 503 要不要立刻重试?

不要。这表示服务暂时繁忙,隔几秒再试,并且设定最多重试几次。连续猛发只会浪费请求配额。

接口调用很慢,是不是出问题了?

长文本生成本来就需要时间,输出越长越久。建议打开流式输出,让用户先看到前面的字,同时把客户端超时设得宽松些。

对话越聊越长,怎么避免超限?

在你自己的后端裁剪历史,只带最近若干轮,更早的内容可以压缩成摘要。发请求之前就估算总量,不要等接口返回 400 才处理。

如何确认某次请求到底用了多少 token?

读响应的 usage 字段,里面有输入、输出和合计三项。流式响应则在最后一个数据块里带这份读数,不需要额外参数。

这些问题之所以反复出现,是因为它们都发生在“代码能跑”之后的下一步。建议你把这一节当作上线前的检查表,逐条确认自己的程序有没有对应的处理。

内容边界与使用对象

什么内容会被拒绝?

合法的成人向内容、小说与有争议的话题不会被拒绝。涉及未成年人的性内容一律拦截并返回 403,小说和角色扮演也一样。

谁可以使用?

仅限 18 岁及以上的成年人。如果你的产品对外开放,也请在入口做年龄确认。

我的提示词会被拿去训练吗?

不会,提示词不用于训练。

遇到报错先看哪里?

先读响应体里 error 对象的 code 和 message,再对照状态码:401 是密钥问题,402 是余额,403 是内容,429 是限流,503 是服务暂时繁忙,稍等几秒再试。

常见问题

调用接口需要什么?

一个注册账户的密钥,加上指向 https://api.apidamoxing.com/v1 的 HTTPS 请求,Header 里带 Bearer 令牌,其余与聊天补全格式一致。

支持哪些功能,不支持哪些?

支持文本对话、流式输出和函数调用;不支持图片、音频、视频、向量嵌入和微调。

回答被截断是怎么回事?

通常是触达 max_tokens,默认 2048,可调到 16,000。同时 prompt 与输出合计不能超过 100,000 token。

余额用完会怎样?

请求返回 402 与 no_credit。充值预付费余额后即可继续,余额不会过期。

哪些人不能使用这项服务?

未满 18 岁者。涉及未成年人的性内容无论是否虚构都会被拦截,返回 403。

只需填写表单即可获取密钥

创建账户,复制密钥,修改 Base URL。配置就是这么简单。

获取 API 密钥