Inicio rápido
Un endpoint compatible con OpenAI. Apunta un programa que ya tengas al base URL de abajo, cambia la key y no hace falta mover nada más.
Base URL y autenticación
https://aifromu.com/v1
Envía tu key como bearer token en la cabecera Authorization. Una key se muestra una sola vez cuando se emite; si la pierdes, rótala desde el panel.
Tu primera petición
- Elige un plan — Compra un plan y abre el panel; tu API key se emite ahí y se muestra una sola vez.
- Apunta al base URL — Define el base URL de tu cliente hacia este despliegue y envía la key como bearer token.
- Llama a un modelo — Nombra luna, terra o sol como modelo y envía la petición que ya envías.
curl https://aifromu.com/v1/models \ -H "Authorization: Bearer $AI_FROM_U_API_KEY"
from openai import OpenAI
client = OpenAI(
base_url="https://aifromu.com/v1",
api_key="YOUR_AI_FROM_U_API_KEY",
)
response = client.chat.completions.create(
model="terra",
messages=[
{"role": "user", "content": "Hello from AI From U"}
],
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://aifromu.com/v1",
apiKey: process.env.AI_FROM_U_API_KEY,
});
const response = await client.chat.completions.create({
model: "terra",
messages: [{ role: "user", content: "Hello from AI From U" }],
});
console.log(response.choices[0].message.content);
Alias de modelo
| MODELO | MEJOR PARA |
|---|---|
| luna | Borradores rápidos, clasificación, resúmenes y chat de alto volumen. |
| terra | Trabajo de asistente del día a día — RAG, agentes, herramientas y programación. |
| sol | Razonamiento profundo, programación difícil, tareas tipo Codex e investigación. |
Cómo se cuentan los créditos
Cada token se multiplica por el peso del modelo en el que se gastó — Sol 1, Terra 0.4, Luna 0.04. Una lectura de caché cuesta la mitad de la tarifa de ese modelo; una escritura de caché cuesta lo mismo que una entrada nueva.
Contexto corto
| MODELO | ENTRADA | LECTURA DE CACHÉ | ESCRITURA DE CACHÉ | SALIDA + RAZONAMIENTO |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
Contexto largo
| MODELO | ENTRADA | LECTURA DE CACHÉ | ESCRITURA DE CACHÉ | SALIDA + RAZONAMIENTO |
|---|---|---|---|---|
| luna | 0.04 | 0.02 | 0.04 | 0.04 |
| terra | 0.4 | 0.2 | 0.4 | 0.4 |
| sol | 1 | 0.5 | 1 | 1 |
Una petición con más de 272,000 tokens de entrada se convierte a la tarifa de contexto largo. Planes y precios
Errores y límites
Una petición que supera tus créditos restantes se rechaza con 429 y no se cobra nada. Una key caducada o rotada responde 401.
Las generaciones largas deberían usar stream: true — una petición sin streaming que dure más de unos 100 segundos la corta el borde de red antes de que devuelva nada.