快速上手
一个兼容 OpenAI 的 endpoint。把现有程序指向下面的 base URL,换掉 key,其他什么都不用动。
Base URL 与鉴权
https://aifromu.com/v1
把你的 key 作为 bearer token 放在 Authorization 头里发送。key 在签发时只显示一次;丢了就在控制台里轮换一把新的。
你的第一个请求
- 选择套餐 — 买一个套餐并打开控制台;API key 在那里签发,并且只显示一次。
- 指向 base URL — 把客户端的 base URL 设为这个部署,并把 key 作为 bearer token 发送。
- 调用一个模型 — 把模型名写成 luna、terra 或 sol,然后发出你本来就要发的请求。
curl https://aifromu.com/v1/models \ -H "Authorization: Bearer $AI_FROM_U_API_KEY"
from openai import OpenAI
client = OpenAI(
base_url="https://aifromu.com/v1",
api_key="YOUR_AI_FROM_U_API_KEY",
)
response = client.chat.completions.create(
model="terra",
messages=[
{"role": "user", "content": "Hello from AI From U"}
],
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://aifromu.com/v1",
apiKey: process.env.AI_FROM_U_API_KEY,
});
const response = await client.chat.completions.create({
model: "terra",
messages: [{ role: "user", content: "Hello from AI From U" }],
});
console.log(response.choices[0].message.content);
积分怎么计数
每个 token 都会乘以所用模型的权重 — Sol 1、Terra 0.4、Luna 0.04。缓存读取按该模型费率的一半计;缓存写入和新鲜输入同价。
短上下文
| 模型 | 输入 | 缓存读取 | 缓存写入 | 输出 + REASONING |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
长上下文
| 模型 | 输入 | 缓存读取 | 缓存写入 | 输出 + REASONING |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
输入 token 超过 272,000 的请求按长上下文费率折算。 套餐与价格
错误与限制
超出剩余积分的请求会以 429 被拒绝,并且不计费。已过期或已轮换的 key 返回 401。
长内容生成应设置 stream: true — 非流式请求运行超过约 100 秒会在边缘被切断,来不及返回。