Blog von Obi Madu

Blog von Obi Madu

Aktuelle Artikel und Essays aus meiner beruflichen und technischen Reise.

Empfohlene Artikel

Neueste Artikel

01-09 / 16
Wie Mobile Apps funktionieren
Mobile15 Min. Lesezeit

Wie Mobile Apps funktionieren

Die drei Wege, eine Mobile-App zu bauen, was bei jedem unter der Haube tatsächlich läuft, und das gemeinsame Architektur-Muster hinter React Native, Flutter und Tauri Mobile.

Eine Codebase, Web und Desktop
System Design12 Min. Lesezeit

Eine Codebase, Web und Desktop

Wie man eine Tauri-App so designt, dass derselbe React-Code im Browser und auf dem Desktop läuft, indem man die Runtime-Unterschiede hinter einem Service-Interface versteckt.

AI-Gateway-Budgets architerieren: Virtual Keys, Provider Keys und verteilte Quota-Erzwingung
AI Engineering12 Min. Lesezeit

AI-Gateway-Budgets architerieren: Virtual Keys, Provider Keys und verteilte Quota-Erzwingung

Eine Blaupause für das Design eines globalen KI-Quotensystems. So trennt man Anfrageausführung von der Budgetwahrheit unter hoher Nebenläufigkeit.

LiteLLM vs. Bifrost: Die Wahl des AI Gateways
AI Engineering9 Min. Lesezeit

LiteLLM vs. Bifrost: Die Wahl des AI Gateways

Ein praktischer Vergleich von LiteLLMs Python-basiertem verteiltem Zustand und Bifrosts Go-basierter roher Performance, um ein AI Gateway zu wählen.

API-Schlüssel-Pooling mit Bifrost
System Design9 Min. Lesezeit

API-Schlüssel-Pooling mit Bifrost

Ein praktischer Leitfaden zur Konfiguration von API-Key-Pooling in Bifrost und zur sicheren Skalierung über mehrere Knoten durch Externalisierung der Rate Limits.

LiteLLM als verteiltes AI Gateway
EmpfohlenAI Engineering8 Min. Lesezeit

LiteLLM als verteiltes AI Gateway

Wie man API-Schlüssel und mehrere Backends unter einer einzigen Model-ID bündelt, um die Rate-Limit-Kapazität zu erhöhen, und wie LiteLLM dieses Pooling über mehrere Knoten hinweg konsistent hält.

AI Gateways skalieren: Wie man API-Schlüssel bündelt und Rate Limits übersteht
AI Engineering10 Min. Lesezeit

AI Gateways skalieren: Wie man API-Schlüssel bündelt und Rate Limits übersteht

Erfahre, wie man strenge LLM-Provider-Rate-Limits durch das Pooling von API-Schlüsseln überwindet, und entdecke die 3-Schichten-Architektur, die für verteiltes Token-Tracking erforderlich ist.

Architektur für zuverlässige mobile Abrechnung: Was ich auf die harte Tour gelernt habe
EmpfohlenMobile20 Min. Lesezeit

Architektur für zuverlässige mobile Abrechnung: Was ich auf die harte Tour gelernt habe

Ein Praxisblick auf die Reparatur von mobiler Abonnement-Abrechnung, wenn Webhooks, Sandbox-Käufe und Benutzeridentität versagen.

OAuth vs OIDC: Der Unterschied endlich erklärt
System Design20 Min. Lesezeit

OAuth vs OIDC: Der Unterschied endlich erklärt

Eine praktische Erklärung von OAuth, OIDC, Access Tokens und ID Tokens ohne die übliche Authentifizierungs-Verwirrung.