模型与状态

这一页是实时的,每 60 秒自己刷新一次。不需要登录。

现在能用哪些

模型出品状态 上下文窗口单次输出上限
读取中…
正常 现在就能用。
恢复中 这会儿打不通,会自己好,你什么都不用做 —— 想立刻继续就先换一个模型。
暂停供应 短期内回不来,请换一个模型。这期间发过来的请求不会扣你的钱。
上下文窗口就是我们真正收得下的量,不是标称值 —— 我们报多少就收多少。 真超了也不会直接报错:我们会先丢掉最旧的几轮帮你接着跑,裁过的话响应头 x-context-trimmed 里写明。
单次输出上限是把窗口塞满时也还给得出来的数。输入没那么大时,实际能出的更多。

单价

单位:元 / 百万 token。灰色划掉的是官方公开价,下面是你的价。 我们的价钱一律是官方价的三折,三档分别乘 0.3,不做别的手脚。
模型 输入缓存命中输出 相当于
读取中…
缓存命中指同一段前缀第二次发过来时的价钱,比输入价便宜一大截。 多轮对话和 agent 天然会命中,我们把亲和做在了链路上(同一个会话尽量落回同一处), 命中率会比随机分发高得多。你在用量与账单里能看到自己每一笔的命中量。
分时段计费的模型(DeepSeek 那两个)跟着官方的时段走,上面显示的是此刻这一档。

怎么接

接口地址
协议OpenAI 格式、Anthropic 格式、Responses 格式都支持,用你客户端原本的那套
不知道填哪儿?看怎么接进你的客户端
还没有钥匙?领一把,送 0.5 元试用额度。已经有了就去用量与账单