AI From U AI FROM U.COM

快速上手

一个兼容 OpenAI 的 endpoint。把现有程序指向下面的 base URL,换掉 key,其他什么都不用动。

Base URL 与鉴权

https://aifromu.com/v1

把你的 key 作为 bearer token 放在 Authorization 头里发送。key 在签发时只显示一次;丢了就在控制台里轮换一把新的。

你的第一个请求

  1. 选择套餐 — 买一个套餐并打开控制台;API key 在那里签发,并且只显示一次。
  2. 指向 base URL — 把客户端的 base URL 设为这个部署,并把 key 作为 bearer token 发送。
  3. 调用一个模型 — 把模型名写成 luna、terra 或 sol,然后发出你本来就要发的请求。
curl https://aifromu.com/v1/models \
  -H "Authorization: Bearer $AI_FROM_U_API_KEY"
from openai import OpenAI

client = OpenAI(
    base_url="https://aifromu.com/v1",
    api_key="YOUR_AI_FROM_U_API_KEY",
)

response = client.chat.completions.create(
    model="terra",
    messages=[
        {"role": "user", "content": "Hello from AI From U"}
    ],
)

print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://aifromu.com/v1",
  apiKey: process.env.AI_FROM_U_API_KEY,
});

const response = await client.chat.completions.create({
  model: "terra",
  messages: [{ role: "user", content: "Hello from AI From U" }],
});

console.log(response.choices[0].message.content);

模型别名

模型适合
luna快速草稿、分类、摘要和大批量对话。
terra日常助理类工作 — RAG、agent、工具调用和编程。
sol深度推理、高难度编程、Codex 类任务和研究。

三个模型

积分怎么计数

每个 token 都会乘以所用模型的权重 — Sol 1、Terra 0.4、Luna 0.04。缓存读取按该模型费率的一半计;缓存写入和新鲜输入同价。

短上下文

模型输入缓存读取缓存写入输出 + REASONING
luna0.040.020.040.04
terra0.40.20.40.4
sol10.511

长上下文

模型输入缓存读取缓存写入输出 + REASONING
luna0.040.020.040.04
terra0.40.20.40.4
sol10.511

输入 token 超过 272,000 的请求按长上下文费率折算。 套餐与价格

错误与限制

超出剩余积分的请求会以 429 被拒绝,并且不计费。已过期或已轮换的 key 返回 401。

长内容生成应设置 stream: true — 非流式请求运行超过约 100 秒会在边缘被切断,来不及返回。