Back to models
Saudi-hosted
Quick start
llama-4-maverick-17b
Saudi-hosted
llm
Tools
·
Released Dec 17, 2025
Context length
—
Avg latency
~649ms
Requests served
4,440
Success rate
99.0%
Request volume — last 30 days
−100% vs last weekQuick start
from openai import OpenAI
client = OpenAI(
base_url="https://alapi.deep.sa/v1",
api_key="sk-alapi-...",
)
resp = client.chat.completions.create(
model="llama-4-maverick-17b",
messages=[{"role": "user", "content": "مرحبا"}],
)
1 SAR = 10 requests · Any model, any size input/output