Back to models

google/gemini-3-flash

llm Tools · Released Dec 18, 2025

Context length

Avg latency

~6189ms

Requests served

599

Success rate

96.3%

Request volume — last 30 days

−100% vs last week
Aug 17 — 6 Aug 19 — 2 Aug 17 Aug 19

Quick start

Quick start
from openai import OpenAI

client = OpenAI(
    base_url="https://alapi.deep.sa/v1",
    api_key="sk-alapi-...",
)

resp = client.chat.completions.create(
    model="google/gemini-3-flash",
    messages=[{"role": "user", "content": "مرحبا"}],
)

1 SAR = 10 requests · Any model, any size input/output

Activate account?

Activate this account?