クイックスタート
OpenAI互換のエンドポイントです。既存のプログラムを下のbase URLに向けてキーを差し替えれば、ほかに動かすものはありません。
Base URLと認証
https://aifromu.com/v1
キーはAuthorizationヘッダーにbearerトークンとして送ります。キーは発行時に一度だけ表示されます。紛失した場合はダッシュボードで再発行してください。
最初のリクエスト
- プランを選ぶ — プランを購入してダッシュボードを開きます。APIキーはそこで発行され、一度だけ表示されます。
- base URLに向ける — クライアントのbase URLをこのデプロイに設定し、キーをbearerトークンとして送ります。
- モデルを呼び出す — モデル名にluna、terra、solのいずれかを指定して、いつも送っているリクエストを送ります。
curl https://aifromu.com/v1/models \ -H "Authorization: Bearer $AI_FROM_U_API_KEY"
from openai import OpenAI
client = OpenAI(
base_url="https://aifromu.com/v1",
api_key="YOUR_AI_FROM_U_API_KEY",
)
response = client.chat.completions.create(
model="terra",
messages=[
{"role": "user", "content": "Hello from AI From U"}
],
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://aifromu.com/v1",
apiKey: process.env.AI_FROM_U_API_KEY,
});
const response = await client.chat.completions.create({
model: "terra",
messages: [{ role: "user", content: "Hello from AI From U" }],
});
console.log(response.choices[0].message.content);
モデルの別名
| モデル | 向いている用途 |
|---|---|
| luna | 高速な下書き、分類、要約、大量のチャット。 |
| terra | 日常のアシスタント業務 — RAG、エージェント、ツール、コーディング。 |
| sol | 深い推論、難しいコーディング、Codex型のタスク、リサーチ。 |
クレジットの数え方
各トークンは、使用したモデルの係数で乗算されます — Solは1、Terraは0.4、Lunaは0.04。キャッシュ読み取りはそのモデル単価の半額、キャッシュ書き込みは新しい入力と同じ単価です。
ショートコンテキスト
| モデル | 入力 | キャッシュ読み取り | キャッシュ書き込み | 出力 + 推論 |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
ロングコンテキスト
| モデル | 入力 | キャッシュ読み取り | キャッシュ書き込み | 出力 + 推論 |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
入力トークンが272,000を超えるリクエストは、ロングコンテキストの単価で換算されます。 プランと料金
エラーと制限
残りクレジットを超えるリクエストは429で拒否され、課金は発生しません。期限切れまたは再発行済みのキーは401を返します。
長い生成では stream: true を指定してください — ストリーミングしないリクエストが約100秒を超えると、エッジが返答前に切断します。