Die Kontrollebene für KI-gestützte Softwareentwicklung

Jede KI-Coding-Anfrage — geroutet, kontrolliert und abgerechnet.

srooter ist die unabhängige Schicht zwischen den KI-Tools Ihrer Entwickler und jedem Modellanbieter. Es leitet jede Anfrage an das richtige Modell, setzt Ihre Standards durch und protokolliert jede Entscheidung — ohne dass sich für irgendjemanden etwas ändert.

Drop-in · OpenAI- & Anthropic-kompatibel · eine Umgebungsvariable
srooter — Live-Anfragen · acme
AngefragtBedientRouteKostenLatenzStatus
claude-opus-4-8qwen3 (local)trivial → qwen$0.0000293mssuccess
claude-opus-4-8claude-opus-4-8council : security$0.00001.8ssuccess
grok-4.3deepseek-v4-profallback chain$0.00012.9sfallback
claude-opus-4-8qwen3 (local)learned-route$0.0000339mssuccess
Opus gefragt. Qwen delivered. Sie zahlten nichts.
Funktioniert mit den Tools, die Ihr Team bereits nutzt — agentische Tool-Loops end-to-end verifiziert
Claude CodeCodexaider Anthropic OpenAI DeepSeek xAI Gemini Ollama · local
Gemessen, nicht versprochen

Wir benchmarken srooter an echten Builds — und veröffentlichen die Zahlen.

Eine Spezifikation, ein Harness: eine vollständige App, autonom von Claude Code gebaut, auf drei Wegen. Qualität im Browser verifiziert, Kosten über das Gateway auditiert. Die vollständige Studie lesen →

8/8

Gleiche Qualität, ⅓–½ der Kosten

Das kontrollierte Routing von srooter lieferte dieselbe browserverifizierte, build-taugliche App wie direkte Frontier-Modelle — zu einem Bruchteil der Ausgaben.

25%

Tokens-bis-fertig schlägt Preis-pro-Token

Claude Fable-5 kostet ~2× so viel pro Token wie Opus, brauchte aber ~2,3× weniger Tokens: identische Gesamtkosten, 25 % schneller. Auf dieses Signal routet srooter.

Tag 1

Neue Modelle, am selben Tag geroutet

Als Anthropic Fable-5 veröffentlichte, hatte srooter es am selben Tag geroutet, im Council verankert und gebenchmarkt. Ihr Routing bleibt aktuell — ohne Ticket.

Das Problem

KI-Coding ist inzwischen Ihr am schnellsten wachsender — und am wenigsten sichtbarer — Kostenblock.

Agenten verbrennen Tokens in autonomen Loops. Ein einziges Wochenend-Refactoring kann in die Tausende gehen. Niemand sieht, welches Modell was getan hat, keine zwei Teams folgen denselben Praktiken, und ein selbstbewusst falscher Diff geht in Produktion, bevor jemand ihn prüft.

01

Ausufernde Ausgaben

Token-Rechnungen skalieren nichtlinear mit Agenten-Loops — ohne Deckel und ohne Warnung, bis die Rechnung eintrifft.

02

Null Sichtbarkeit

Keine Aufzeichnung, welches Modell welche Anfrage bearbeitet hat, zu welchen Kosten, mit welchem Ergebnis.

03

Uneinheitliche Praxis

Jeder Entwickler promptet anders. Standards leben in den Köpfen der Leute, nicht in der Pipeline.

04

Ungeprüftes Risiko

Agenten fassen Auth, Zahlungen und Migrationen mit derselben beiläufigen Selbstsicherheit an wie einen Tippfehler.

Eine Schicht, drei Aufgaben

Klug routen. Alles behalten. Alles kontrollieren.

Ab heute nützlich

Produktivitäts-Routing

Das richtige Modell für jede Aufgabe — automatisch gewählt, über jeden verbundenen Anbieter.

  • Triviale Arbeit an schnelle, günstige oder lokale Modelle
  • Schwere Arbeit bleibt auf Ihrem besten Modell
  • Cross-Vendor von Grund auf
  • Automatischer Fallback — nichts blockiert die Entwickler
Wird klüger

Harness-Intelligenz

srooter lernt Ihre Codebasis und Ihre Standards und wendet sie auf jede Anfrage an.

  • Ein lebendiger Code-Graph fließt ins Routing ein
  • Best Practices einmal definiert, für alle durchgesetzt
  • Routen, die aus Ergebnissen lernen
  • Agentenübergreifender Kontext, den ein einzelnes Modell nicht halten kann
Beständig

Governance

Eine unabhängige Kontrollebene für Ausgaben, Richtlinien und Compliance — eine, die jedes einzelne Modell überdauert.

  • Jede Entscheidung protokolliert und exportierbar
  • Modell-Allowlists & Reasoning-Grenzen
  • Harte Budgetgrenzen mit sanftem Fallback
  • Rollenbasierter Zugriff für die gesamte Organisation

Modelle werden immer besser im Routing und Reasoning. Die Schicht, die Ihre Organisation kennt und Ihre Regeln durchsetzt, wird davon nicht absorbiert — sie liegt um das Modell herum, nicht darin.

Funktionen

Eine vollständige Kontrolloberfläche dafür, wie Ihre Organisation mit KI ausliefert.

Routing & Council

Das günstigste Modell, das die Aufgabe tatsächlich schafft — und ein Council, wenn nicht.

Ein Intent-Klassifikator liest jede Anfrage, bevor sie ein Modell erreicht. Triviale Arbeit fällt auf lokale oder schnelle Modelle; folgenreiche Änderungen berufen ein Council aus diversen Modellen ein — out-of-band, bevor etwas ausgeliefert wird.

Intent-bewusst — routet danach, was die Aufgabe ist, nicht nach Schlüsselwörtern.
Council-Review bei sicherheits- und architekturkritischer Arbeit.
Ihre Regeln oder unsere — starten Sie mit den srooter-Standards, überschreiben Sie jederzeit.
Routingsrooter default
STANDARD-ROUTING · TIER → MODELL
trivialgemini-3.5-flash
substantiveglm-5.2
long contextglm-5.2
extended thinkingdeepseek-pro
architecture · securitycouncil
INTENT-KLASSIFIKATOR
gemini-classify
COUNCIL-MITGLIEDER
claude-opus · codex · glm · kimi · deepseek-pro
Cortex-Graph

Er kennt Ihre Codebasis — und nutzt sie zum Routen und zur Einschätzung des Blast-Radius.

srooter baut einen lebendigen Graphen der Symbole und Abhängigkeiten Ihrer Organisation. Dieses Wissen zeigt ihm, wann eine Änderung trivial ist und wann sie etwas berührt, das Ihnen schaden kann — und routet, prüft und eskaliert entsprechend.

Blast-Radius-bewusst — eine README-Änderung und eine Zahlungsmigration sind nicht dasselbe Risiko.
Wächst mit der Nutzung — je länger es läuft, desto schärfer das Routing.
Cortex-Graphlive
505 Symbole1,394 Kanten63 Dateien
Code-Review

Ein Multi-Modell-Review-Council, das in Ihrem Repo läuft — kein weiterer Bot mit Pro-Sitz-Preis.

srooter review beruft ein Council aus Modellen zu einem PR ein, verankert in Ihrem Cortex-Graph und Ihren ADRs. Ihr Code verlässt nie Ihr Repo — nur die Modellaufrufe passieren das Gateway, wo sie gemessen, budgetiert und auditiert werden. Ein Tool, das Sie aus der CLI, CI oder Ihrem Harness aufrufen; nie ein Dauer-Bot.

Prüfen vor dem Melden — Reviewer grepen, lesen ADRs und fragen den Graphen ab, bevor sie einen Befund melden.
Widerleger töten False Positives — jeder Blocker muss eine gegnerische Widerlegung überstehen.
Ihre Keys, eine Rechnung — keine Pro-Sitz-Review-Steuer. Vergleich mit CodeRabbit →
srooter reviewrequest_changes
[plan] blast radius: medium · council of 4
[review] glm · deepseek · kimi · claude-opus
[refute] 2 blocking → 1 survived
HIGH api/orders.py:88
query on tenant table missing org_id (ADR-012)
Skills

Ihre Engineering-Standards, einmal definiert — für jeden Entwickler durchgesetzt.

Kodieren Sie Praktiken wie Spec-First oder TDD als Skills. srooter injiziert sie organisationsweit in passende Anfragen. Soft Skills lenken das Modell; Hard Skills sind Sicherheit und Compliance vorbehalten.

Zentral, nicht pro Repo — Best Practice hört auf, in den Köpfen der Leute zu leben.
Nach Intent begrenzt — nur dort angewendet, wo es zählt.
tdd-enforcersoftpriority 100
Vor der Implementierung einen fehlschlagenden Test schreiben (TDD). Funktionen ≤ 20 Zeilen halten.
GILT FÜR INTENTS
trivialsubstantivearchitecturesecurity
Audit-Log

Jede Anfrage, jede Entscheidung — protokolliert. Prompt-Inhalte werden nie gespeichert.

Eine vollständige, exportierbare Spur dessen, was angefragt, was bedient wurde, warum und was es kostete. Prompts werden SHA-256-gehasht, sodass Sie volle Nachvollziehbarkeit erhalten, ohne sensible Inhalte je im Klartext zu halten.

Standardmäßig gehasht — Compliance ohne Offenlegung.
Zeigt die Route — trivial, council, learned oder fallback.
Audit-Log121 Anfragen
BedientRouteEin/AusKostenStatus
qwentrivial → qwen9 / 12$0.00ok
opus-4-8council : security24 / 16$0.00ok
qwenlearned-route18 / 12$0.00ok
deepseekfallback12 / 258$0.0001fb
Prompts SHA-256-gehasht — Inhalte werden nie gespeichert.
Anbieter

Bringen Sie Ihre eigenen Keys mit.

Fügen Sie einen Anbieter-API-Key ein, und srooter erkennt automatisch jedes Modell dahinter. API-Keys oder ein lokaler Ollama-Endpunkt. Kein einzelnes Registrieren von Modellen.

Auto-Erkennung — Modelle erscheinen in dem Moment, in dem Sie sich verbinden.
API & lokal — jeder Anbieter-Key, oder vollständig offline mit Ollama.
Anthropic API10 models
DeepSeek2 models
xAIgrok-4.3
Ollama lokalqwen3-coder:30b
Gemini2 models
Richtlinien & Budget

Harte Grenzen, unsichtbar am Gateway durchgesetzt.

Modelle per Allowlist zulassen, Reasoning-Aufwand deckeln, Service-Tiers beschränken und eine monatliche Ausgabenobergrenze setzen. Über Budget fallen Anfragen sanft die Kette jedes Modells hinab — die Arbeit stoppt nie.

Sanft, nicht blockierend — Grenzen drosseln, sie brechen nicht.
Richtlinie pro Organisation automatisch auf jede Anfrage angewendet.
In dieser Periode ausgegeben$612 / $2,500
Über der Grenze fallen Anfragen still auf das nächste Modell jeder Kette zurück — nie ein harter Stopp.

Dashboard

Ausgaben, Latenz und jüngstes Routing auf einen Blick.

API-Keys

Gateway-Keys pro Entwickler erstellen & widerrufen.

Audit-Log

Gehashte, exportierbare Aufzeichnung jeder Anfrage.

Cortex-Graph

Das Code-Wissen Ihrer Organisation, visualisiert.

Skills

Zentrale Praktiken, überall durchgesetzt.

Routing

Intent-Klassifikator, Council, Schwellenwerte.

Richtlinien

Allowlists, Reasoning-Grenzen, Tiers.

Budget

Monatliche Grenzen mit sanftem Fallback.

Anbieter

BYOK, OAuth, lokal — automatisch erkannt.

Benutzer

Rollenbasierter Zugriff für das ganze Team.

Assistent

Fragen Sie Ihr Gateway alles — Ausgaben, Routing, Richtlinien — in einfacher Sprache.

Cmd+K öffnet einen Assistenten, der aus den eigenen Daten Ihrer Organisation antwortet: wer was ausgab, warum eine Anfrage wohin geroutet wurde, welche Richtlinien griffen. Mandantengebunden, vollständig auditiert, mit geteiltem Organisationsgedächtnis — und demselben kontrollierten Routing darunter.

Fundiert — antwortet aus Ihren Audit-, Budget- und Routing-Daten.
Kontrolliert — jeder Assistenten-Aufruf wird wie jeder andere geroutet, gemessen und protokolliert.
So funktioniert es

Transparent von Grund auf. Es übernimmt nie das Steuer.

1

Richten Sie Ihre Tools auf srooter

Eine Umgebungsvariable. Claude Code, Codex und aider arbeiten genau wie zuvor — srooter bleibt für Ihre Entwickler unsichtbar.

2

Es kontrolliert jeden Turn

Jede Anfrage wird gegen die Richtlinie geprüft, intelligent geroutet und protokolliert. Berechtigungen und Ausführung bleiben im Tool des Entwicklers.

3

Sie sehen und steuern alles

Ein Dashboard für Ausgaben, Routing-Entscheidungen und die Praktiken, die Ihre Organisation durchsetzt — über jeden Entwickler und jedes Modell.

# Richten Sie Ihren Agenten auf srooter — das ist das ganze Setup
export ANTHROPIC_BASE_URL=https://gateway.srooter.dev
export ANTHROPIC_API_KEY=srt_live_19d895d2…
# Jetzt einfach arbeiten. srooter routet, kontrolliert und protokolliert jeden Turn.
Sicherheit & Vertrauen

Gebaut für das Team, das dafür geradestehen muss.

Inhalte werden nie gespeichert

Prompts werden SHA-256-gehasht. Sie erhalten eine vollständige Audit-Spur, ohne sensible Inhalte je im Klartext zu halten.

Self-Hosting in Ihrer VPC

Betreiben Sie das gesamte Gateway in Ihrer eigenen Infrastruktur. Ihre Keys, Ihre Daten, Ihr Perimeter.

Ihre Keys

Bringen Sie Ihre eigenen Anbieter-API-Keys oder lokale Modelle mit. srooter verkauft Inferenz niemals weiter.

Exportierbare Aufzeichnung

Jede Routing- und Richtlinienentscheidung wird protokolliert und ist für Review, Abrechnung oder Compliance exportierbar.

Rollenbasierter Zugriff

Admins setzen Standards und sehen alles; Entwickler behalten ihren Flow. Klare Rollen in der gesamten Organisation.

Harte Budgetobergrenzen

Setzen Sie eine monatliche Obergrenze. Mehrausgaben werden sanft die Fallback-Kette jedes Modells hinab gedrosselt.

Wie wir abschneiden

Kostenlose Tools hören beim Routing auf. Governance-Tools sind nicht für Code gebaut.

Der Großteil des Marktes ist eines von zweien: ein kostenloser Proxy, der ein günstigeres Modell wählt, oder ein horizontales Gateway, das Governance an jede beliebige LLM-App schraubt. srooter ist das einzige, das die tiefe, code-bewusste Arbeit — und die Governance — speziell für autonome Coding-Agenten leistet.

srooter> LiteLLM OpenRouter Portkey Claude Code Router
Die Grundlagen · Pflichtprogramm
OpenAI- & Anthropic-compatible
Self-Hosting-fähig
Ihre eigenen Keys · kein Inferenz-Weiterverkauf
Kosten-Routing & automatischer Fallback
Code-Intelligenz
Intent-bewusstes Routing für Code-Aufgaben
Code-Graph- & Blast-Radius-Bewusstsein
Council-Review bei kritischen Änderungen
Zentrale Engineering-Skills, organisationsweit
Routen, die aus Ergebnissen lernen
Governance & Passung
Gehashtes Audit · Richtlinien · Budget · RBAC
Für autonome Coding-Agenten gebaut
voll teilweise keine

Die ehrliche Einschätzung: LiteLLM und Claude Code Router sind kostenlos und in genau einer Sache gut — Routing. Portkey ist bei Governance wirklich stark. Keines davon versteht Ihren Code, wägt den Blast-Radius ab, beruft ein Council ein oder setzt die Praxis Ihres Teams durch. srooter ist die einzige Schicht, die die code-bewusste Arbeit und die Governance leistet — für die Agenten, die Ihre Entwickler tatsächlich einsetzen.

In gutem Glauben verglichen, Juni 2026. Fähigkeiten ändern sich schnell — falls hier etwas veraltet ist, sagen Sie uns Bescheid, und wir korrigieren es.

Für wen es ist

Eine Engine. Drei Menschen, die sie brauchen.

Für Entwickler

Behalten Sie Ihre Tools und Ihren Flow. Richten Sie Ihren Agenten mit einer Umgebungsvariable auf srooter und erhalten Sie automatisch das richtige Modell und die Standards Ihres Teams. Es übernimmt nie das Steuer.

Für Leiter von KI

Definieren Sie die Engineering-Praxis Ihrer Organisation einmal. Sehen Sie, welche Modelle was tun, halten Sie die Qualität teamübergreifend konstant und lassen Sie das Routing aus jeder ausgelieferten Änderung lernen.

Für CTOs

Eine unabhängige, auditierbare Kontrollebene für KI-Ausgaben, -Richtlinien und -Compliance — eine, die jedes einzelne Modell oder jeden Anbieter überdauert.

Loslegen

Setzen Sie eine Schicht zwischen Ihr Team und das Chaos.

Setzen Sie srooter noch heute vor Ihre KI-Coding-Tools. Self-Hosting, eigene Keys — und nichts ändert sich an der Arbeitsweise Ihrer Entwickler.

Self-hosted & Cloud · OpenAI- & Anthropic-kompatibel
srooter> — the control plane for AI-assisted engineering