Ollama-simple. $0.05/M input, prefix-cache discounts, 262K context.
curl -fsSL https://oaica.com/install.sh | bash
OpenAI- and Anthropic-compatible. 262K context, vision, prefix-cache discounts (~55% hit rate on agent workloads).
curl -X POST https://api.oaica.com/v1/chat/completions \
-H "Authorization: Bearer $OAICA_API_KEY" \
-d '{"model":"oaica-35b-a3b-vision","messages":[{"role":"user","content":"Hello"}]}'
Free. Pull models and run on your own infrastructure with oaica pull and oaica serve.
oaica pull oaica-nemotron-30b-a3b
oaica serve oaica-nemotron-30b-a3b
Context window auto-configured. Launch Claude Code directly on our models.
oaica launch claude --model oaica-35b-a3b-vision
Per M tokens. Simple rates.
| Input | Cache-hit | Output | |
|---|---|---|---|
| OAICA | $0.05 | $0.008 | $0.28 |
Cached prefix always bills at $0.008/M. Agent sessions that reuse context pay mostly cache rates. Flat monthly plans available — talk to us at oaica@sprapp.com.
Generated from the gateway. Live at https://api.oaica.com/v1/models.
262,144 context · 32K max output · Text + image (2 images/request)
Vision-capable for coding assistance with screenshots.
# OpenAI-compatible
curl -X POST https://api.oaica.com/v1/chat/completions \
-H "Authorization: Bearer $OAICA_API_KEY" \
-d '{"model":"oaica-35b-a3b-vision","messages":[{"role":"user","content":"Hello"}]}'
# CLI
oaica run oaica-35b-a3b-vision
# Claude Code
oaica launch claude --model oaica-35b-a3b-vision
262,144 context · Text-only · Reasoning + tool-calling
Currently on-demand (pool paused). Auto-configures context window for Claude Code.
# Self-host
oaica pull oaica-nemotron-30b-a3b
oaica serve oaica-nemotron-30b-a3b
# Check catalog
curl https://api.oaica.com/v1/catalog
Three paths. Pick yours.
curl -fsSL https://oaica.com/install.sh | bash
oaica signin
oaica run oaica-35b-a3b-vision
oaica launch claude --model oaica-35b-a3b-vision
export OAICA_API_KEY=
curl -X POST https://api.oaica.com/v1/chat/completions \
-H "Authorization: Bearer $OAICA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"oaica-35b-a3b-vision","messages":[{"role":"user","content":"Hello"}],"stream":true}'
# Note: scripted clients must set a custom User-Agent
# (default Python-urllib is bot-blocked at the edge)
curl -X POST https://api.oaica.com/v1/chat/completions \
-H "User-Agent: my-app/1.0" \
-H "Authorization: Bearer $OAICA_API_KEY" \
-d '{"model":"oaica-35b-a3b-vision","messages":[{"role":"user","content":"Hello"}]}'
# List available models
curl https://api.oaica.com/v1/catalog
# Pull a model (25 GB for nemotron)
oaica pull oaica-nemotron-30b-a3b
# Serve it
oaica serve oaica-nemotron-30b-a3b
# Licensed models require OAICA_LICENSE_KEY
export OAICA_LICENSE_KEY=
oaica pull
oaica serve
Live health: api.oaica.com/health (currently checking...)
Uptime monitoring coming soon.