
Other1 month ago
FlexInference: Drop your AI costs today
Route your LLM API requests across multiple providers to cut costs and meet latency targets.
Aperswal · HN
Made a Free LLM Router
The full gallery
Tech stack
4 projects

Route your LLM API requests across multiple providers to cut costs and meet latency targets.
Aperswal · HN
Made a Free LLM Router

Real-time memory and context layer for voice AI agents with sub-10ms latency.
@SouravDaaa · X
- End to end personalised memory retrieval in 10ms. Would love some feedback here

Compare AI model coverage, pricing, uptime, and latency across different AI relays.
zizheruan · HN
XTokenChecker – Verifies model identities of your AI gateway

Play your own music offline with playlists, equalizer, lyrics, and sleep timer.
@MonkusTomas · X
Check out what I just built with Lovable!