Caffeine InferenceFrüher Zugang

Kosteneffiziente KI & intelligentes Routing.

Woran wir bauen: Caffeine Inference soll kosteneffizientes, intelligentes Routing liefern. Du musst keine Modelle auswählen, unser Routing übernimmt das für dich. Was es heute schon gibt: kosteneffiziente Inference.

Caffeine Inference öffnen

Läuft über das Caffeine-Abo.

Routing statt Menü.

Sobald smartes Routing da ist, liest Caffeine die Anfrage, wägt ab, was jedes Modell kosten würde und wie schnell es gerade antwortet, und sendet sie an eines davon. Ist ein Modell ausgelastet oder langsam, geht die Anfrage woanders hin, statt fehlzuschlagen.

Ihre AnfrageRouterKosten · Auslastung · SchwierigkeitModellModellModellAntwort

Richten Sie die Tools,die Sie nutzen, auf Caffeine aus.

Claude Code und alles andere, das eine eigene Basis-URL akzeptiert. Konfiguration kopieren, einfügen, weiterarbeiten.

Goose

GOOSE_PROVIDER=openai
OPENAI_HOST=...
OPENAI_API_KEY=...

Claude Code

ANTHROPIC_BASE_URL=...
ANTHROPIC_AUTH_TOKEN=...

Alles andere

base URL + key
same request shape

Vier Schritte bis zum ersten Aufruf.

Wählen Sie ein Tool, kopieren Sie die Konfiguration und senden Sie einen Aufruf. Caffeine liefert die Einstellungen im passenden Format.

1.Übersicht

Fragen, die wir lieber hier beantworten.

Input kostet 0,2 $ pro Million Tokens, gecachter Input 0,05 $ und Output 0,5 $. Die Preise können sich ändern, während sich das Routing weiterentwickelt.

Caffeine Inference

Läuft über das Caffeine-Budget, das bereits in deinem Konto liegt — und deine bestehende Config ist nur drei Zeilen vom Laufen entfernt.

Loslegen

Früher Zugang. Keine separate Abrechnung, kein separates Konto.