
Developer Tools1 week ago
FlexInference: Drop your AI costs today
Route your LLM API requests across multiple providers to cut costs and meet latency targets.
Aperswal · HN
Made a Free LLM Router
The full gallery
Tech stack
2 projects

Route your LLM API requests across multiple providers to cut costs and meet latency targets.
Aperswal · HN
Made a Free LLM Router

Real-time memory and context layer for voice AI agents with sub-10ms latency.
@SouravDaaa · X
- End to end personalised memory retrieval in 10ms. Would love some feedback here