Directory
Fal.ai
Generative media inference host
PaidModel APIs, routers & observabilityfal.ai
What it is
An inference host specialised in generative media — diffusion image models, video models such as Veo, Kling and Wan, plus audio. It runs its own optimised inference stack, so the same open model is usually faster here than on a general-purpose GPU cloud.
Why it earns a slot
If your app generates images or video, fal is the media equivalent of Groq — low latency, streaming previews, and a clean JS and Python client. Per-image pricing makes unit economics easy to reason about.
Know before you commit
Video generation gets expensive fast — at $0.40 per second a five-second clip is $2, so an unthrottled public demo can burn hundreds of dollars in an afternoon.
Getting started
npm i @fal-ai/client (or pip install fal-client)
Neighbourhood
How Fal.ai sits against the rest of the atlas — swaps, companions and the tools builders actually save alongside it.
Also in Model APIs, routers & observability
Anthropic API / Claude Platform
platform.claude.comNot yet swept
Frontier model provider API
PaidModel APIs, routers & observability
Per token. Opus 5 $5/$25 per M in/out; Sonnet 5 $2/$10; Haiku 4.5 $1/$5; Fable 5 and Mythos 5 $10/$50. Batch API 50% off; cache reads 0.1x input.
Open dossier
Braintrust
braintrust.devNot yet swept
LLM eval and experiment platform
Free tier + paidModel APIs, routers & observability
Starter free ($10/mo model credits, 1GB data, 10k scores, 14-day retention), Pro $249/mo ($249 credits, 5GB, 50k scores), Enterprise custom. Overage $3-4/GB and $1.50-$2.50 per 1k scores.
Open dossier
Fireworks AI
fireworks.aiNot yet swept
Open-model inference host
Free tier + paidModel APIs, routers & observability
Per token serverless across Standard/Priority/Fast tiers; embeddings $0.008-$0.10/M. On-demand GPUs billed per second: H100/H200 ~$7-8/hr, B200 ~$10-13/hr. Fine-tuning $0.50-$40 per M training tokens. $1 free credit.
Open dossier
Google AI Studio / Gemini API
ai.google.devNot yet swept
Model provider API with free tier
Free tier + paidModel APIs, routers & observability
Free tier in AI Studio with rate limits. Paid: Gemini 3.7 Flash $0.75/$3.75 per M in/out; Gemini 3.5 Flash-Lite $0.30/$2.50; Gemini 2.5 Pro $1.25/$10.
Open dossier