v0.5.2 · Apache License 2.0 · Python 3.12+
基元律动 · OpenSquilla

Token-effiziente AI-Agent-Intelligenz

Microkernel AI Agent — gleiches Budget, Ihr Agent erledigt mehr und besser.
Smart Routing, persistenter Speicher, sichere Sandbox — plus integrierte Suche und lokale Embeddings.

60-80%1
Token-Kosten-Einsparung
N+
Meta-skills
› Fable 5
Smart-Routing voraus
10+
Integrierte Kanäle

In Aktion erleben

Kurze Demos, die zeigen, wie OpenSquilla echte Workflows löst

Windows-Portable-Installation: Walkthrough
Kurzfilm-MetaSkill
Paper-Writing-MetaSkill

Schnellstart

Vier Wege zum Einstieg — wählen Sie, was zu Ihnen passt

Der klarste Weg unter macOS und Windows — eine signierte Desktop-App, die Control-UI und Gateway-Runtime bündelt. Kein Python, kein Terminal.

1

Herunterladen und installieren

Wählen Sie oben Ihre Plattform. Unter macOS das .dmg öffnen und OpenSquilla in „Programme" ziehen. Unter Windows den .exe-Installer ausführen.

2

OpenSquilla öffnen

Starten Sie die App. Das gebündelte Gateway startet automatisch — es ist nichts weiter zu installieren.

3

Ersteinrichtung abschließen

Beim ersten Start führt Sie das Onboarding durch die Provider-Wahl und das Einfügen der abgefragten Keys. Die Control-UI öffnet sich anschließend direkt in der App.

Windows-Builds sind signiert und macOS-Builds notarisiert, ein Umgehen von SmartScreen oder Gatekeeper ist nicht nötig. Unter Linux verwenden Sie die schnelle Terminal-Installation.
Für fortgeschrittene Nutzung besuchen Sie das GitHub-Repo

Einmal deployen, überall erreichbar 3

Konfigurieren Sie einen Agent, bedienen Sie Nutzer auf mehreren Kanälen

Terminal Web Slack Discord Telegram MS Teams Matrix Lark DingTalk WeCom QQ

Jeder Cent dort, wo es zählt

OpenSquilla lässt Ihren Agent weniger ausgeben, mehr merken und sicherer laufen.

💰

Kostenoptimierung

Mehrere Strategien koordiniert, um jeden Token zu maximieren

Smart Routing ²
Wie Ride-Sharing — einfache Fragen nehmen den Bus (günstige Modelle), komplexe bekommen die Premium-Fahrt (Top-Modelle). Das System entscheidet.
Hybride Feature-Analyse
Kombiniert handgefertigte Features (Länge, Sprache, Codeblöcke, Stichwörter) mit embedding-basierten semantischen Features, um Komplexität zu bewerten und das richtige Modell zu wählen.
Reasoning-Tiefenstufen
Deaktiviert Reasoning-Abrechnung für einfache Anfragen, aktiviert tiefes Denken nur bei komplexen — kein Bezahlen von Reasoning-Tokens für „Hallo".
Adaptive Prompts
Passt den Prompt automatisch an die Aufgaben-Komplexität an — leicht für Einfaches, volle Power für Komplexes.
Skills nach Bedarf
Kein Vollstopfen aller Fähigkeiten in den Kontext. Lädt nur, was für die aktuelle Aufgabe nötig ist — verhindert Token-Verschwendung.
🎯

Höhere Qualität

Multi-Modell-Ensemble-Routing hebt die Antwortqualität bei den schwersten Turns — über jedes Einzelmodell hinaus

Model Ensemble Routing
Fächert einen schwierigen Turn über mehrere Kandidatenmodelle und synthetisiert deren Antworten — für eine Präzision, die kein Einzelmodell allein erreicht.
Übertrifft Fable 5
In internen Hard-Turn-Evals schlug Ensemble-Routing jede Einzelmodell-Baseline — einschließlich Fable 5.
Progressive Ergebnisse
Nützliche Teilantworten erscheinen, während sich das Ensemble einpendelt — kein Warten auf den langsamsten Kandidaten.
Presets & eigene Lineups
Klare Presets (static OpenRouter B5 / TokenRhythm B5) oder ein eigenes Lineup — mit Timeout-Tuning, damit langsame Kandidaten keinen Turn blockieren.
Smarter Fallback
Wenn ein Einzelmodell besser passt, nimmt das Routing automatisch den direkten Pfad — Präzision, wo sie hilft, kein Verschwenden, wo nicht.
🧩

Weitere Kernfähigkeiten

Über Kosten und Genauigkeit hinaus — MetaSkills, menschenähnliches Gedächtnis und eine Sicherheits-Sandbox, alles vorhanden

MetaSkills-Protokoll
Ein Meta-Protokoll für Skills im großen Maßstab: Der Agent findet, filtert und kombiniert Skills selbständig und destilliert aus wiederholbaren Ausführungsspuren Muster, um neue MetaSkills zu entwerfen — Fähigkeiten wachsen im Hintergrund.
Menschenähnliches Gedächtnis
Vier Schichten — Arbeits-/episodisch/semantisch/roh — mit hybrider Vektor- + Stichwortsuche und lokalen ONNX-Embeddings (Daten bleiben auf Ihrer Maschine). Heiße Erinnerungen steigen auf, alte zerfallen, und ein 24-Stunden-„Traum" konsolidiert alles — schlauer mit jeder Nutzung.
Sicherheits-Sandbox
Drei-Stufen-Richtlinie plus echte Bubblewrap-/Seatbelt-Isolation, Ablehnungsregister, Schutz vor veralteten Outputs und Prompt-Injection-Abwehr — lassen Sie den Agent handeln, ohne Angst vor dem, was er tun könnte.

Microkernel: winziger Kern, riesiges Ökosystem

Inspiriert von OS-Microkerneln — die Core-Engine erledigt das Minimum: Orchestrierung und Zustandsverwaltung. Alles andere läuft als Plugin im „User Space". LLM-Anbieter wechseln? Ein Protocol implementieren. Neues Tool? 5 Codezeilen. Plugin-Crashes betreffen den Kern nicht; Kern-Updates brechen keine Plugins.

OpenSquilla
OpenSquilla Core Engine
Kompakter Pipeline-Orchestrator · State Machine · Vollständig async · Auto-Rollback bei Fehlern
⚙️
engine/
State Machine
🤖
provider/
Multi-LLM-Provider
🌐
gateway/
ASGI-RPC-Gateway
🧠
memory/
Mehrschichtiger Speicher
📡
channels/
Kanal-Adapter
🔧
tools/ + mcp/
MCP-First-Tools
🛡️
sandbox/
Sicherheits-Sandbox
scheduler/
Task-Scheduler
🧩
skills/
Skill-Plugins
🎭
identity/
Identität & Prompts
Eingebaut
🔍 Suche: Brave / DuckDuckGo 🧬 Lokale Embeddings: ONNX lokale Inferenz (offline · Daten bleiben auf dem Gerät) 🔌 Optionale Embeddings: OpenAI / Ollama

Gleiches Budget, höhere Intelligenzdichte

Punkt-für-Punkt-Vergleich mit vergleichbaren Open-Source-Agent-Frameworks4

🏗️Architektur
OpenSquilla
✅ Microkernel mit 5-schichtiger Trennung, ultrakompakter Core-Orchestrator (~100 Zeilen), alle Fähigkeiten als Plugin, Auto-Skip + Rollback bei Fehlern
OpenClaw
⚠️ Reifes Plugin-Ökosystem (Dutzende Erweiterungen), klare Grenzen aber mehr Schichten
Hermes Agent
❌ Massive monolithische Sync-Hauptschleife (Tausende Zeilen), gesamte Logik eng gekoppelt
💰Kostenoptimierung
OpenSquilla
✅ ML-Routing + Reasoning-Tiefenstufen + Prompt-Cache-Isolation + On-Demand-Skills — Mehr-Strategien-Einsparung von 60-80%
OpenClaw
⚠️ Primär-/Fallback-Modell in Config gepinnt, keine inhaltsabhängige Auswahl
Hermes Agent
⚠️ Grobe Stichwort- + Längen-Heuristiken, einzige Routing-Strategie
🎯Höhere Qualität
OpenSquilla
✅ Multi-Modell-Ensemble-Routing — verteilt schwierige Probleme an mehrere Kandidaten und aggregiert ihre Antworten, übertrifft jedes Einzelmodell (auch Fable 5); Ergebnisse werden fortlaufend ausgegeben, und kostenbewusstes Fallback überspringt das Ensemble, wenn ein Modell genügt
OpenClaw
❌ Einzelmodell-Direktaufrufe, keine Ensemble-Aggregation — Genauigkeit ist durch das eine gewählte Modell begrenzt
Hermes Agent
⚠️ Mixture-of-Agents-Preset aggregiert mehrere Modelle — starke Qualität, aber kein kostenbewusstes Fallback, das schwere Ensemble läuft auch, wenn ein Modell genügen würde
🪄MetaSkills-Protokoll
OpenSquilla
✅ Komponierbare Workflows + meta-skill-creator zur Selbstautorenschaft + 10+ gebündelte & N+ Community-Skills automatisch abgerufen + Traummodus destilliert Nutzung in neue Kandidaten im Leerlauf
OpenClaw
⚠️ Prompt-getriebene Skill-Ketten, keine Meta-Protokoll-Schicht, keine Selbstevolution; neue Workflows leben als Docs, nicht als First-Class-Runtime-Objekte
Hermes Agent
❌ Keine wiederverwendbare Workflow-Abstraktion — Mehrstufenarbeit wird in jeder Session von Null erneut geprompted
💾Speichersystem
OpenSquilla
✅ Vektor + Stichwort + Dedup + zeitlicher Zerfall + Hot-Memory-Beförderung + Auto-Schema-Migration
OpenClaw
⚠️ Hat Zerfall / Beförderung / Vielfalts-Reranking, aber keine 4-Schichten-Kognitionsstruktur & Memory-Dream-Konsolidierung
Hermes Agent
⚠️ Nur Stichwortsuche, keine Vektorsemantik, semantischer Speicher braucht externe Integration
🛡️Sicherheits-Sandbox
OpenSquilla
✅ Keine Docker-Abhängigkeit — Syscall-Level CPU/Speicher/Zeit-Isolation + 3-stufige Netzwerkkontrolle. Serverless-tauglich
OpenClaw
⚠️ Docker optional mit OpenShell als Lightweight-Alternative, schwerer als Syscall-Level-Isolation
Hermes Agent
✅ Genehmigung gefährlicher Befehle + 6 Ausführungsumgebungen (lokal/Docker/SSH usw.)
💰Kostenverfolgung
OpenSquilla
✅ Tatsächliche Kosten pro Aufruf out-of-the-box, Quota-Hooks für Auto-Throttling bei Überschreitung
OpenClaw
✅ Eingebaute Preistabelle, Kosten in Session-Metadaten geschrieben
Hermes Agent
✅ Input/Output/Cache-Read/Cache-Write/Reasoning-Tokens separat erfasst
📊Beobachtbarkeit
OpenSquilla
✅ Entscheidungs-Logs als Hashes (kein Klartext, compliance-freundlich), jede Pipeline-Stufe instrumentiert
OpenClaw
✅ Natives OpenTelemetry (als Plugin), Plug-and-Play mit Prometheus/Grafana
Hermes Agent
⚠️ SQLite-Session-Tabelle + Aufruf-Counter, Basis-Niveau
🧩Erweiterungs-DX
OpenSquilla
✅ Eine Duck-Typed-Klasse mit wenigen Zeilen ist ein gültiges Plugin — keine Basisklasse, kein SDK-Paket, kein Manifest
OpenClaw
⚠️ Interface in plugin-sdk implementieren + Manifest-Datei schreiben
Hermes Agent
⚠️ Tools registrieren sich beim Import automatisch (implizite Seiteneffekte)

Wer profitiert am meisten von OpenSquilla?

Diese Szenarien erzielen den höchsten ROI

🏢
On-Premise-Deployment
Vollständig offline, Daten verlassen nie Ihr Netzwerk, ML-Routing läuft lokal
📋
Compliance & Audit
Drei-Stufen-Richtlinien + gehashte Entscheidungs-Logs + menschliche Genehmigungs-Gates
💸
Knappes Budget, hohe Anforderungen
Mehr Aufgaben für gleiche Kosten — Smart Routing wählt das kosteneffizienteste Modell
🧠
Ein Agent, der Sie versteht
Vier-Schichten-Menschengedächtnis sammelt Kontext — nie wieder bei null anfangen
Pilot-Programm · Jetzt geöffnet

Weniger Burn. Weniger Drama. Echte Lieferung.

Die TokenRhythm API ist jetzt zur Registrierung geöffnet – mit drei zeitlich begrenzten Vorteilen:
Freunde einladen: Beide erhalten 68 CNY API-Guthaben
Nutzungsdaten teilen: Chance auf eine Erlebniskarte im Wert von 200 CNY
Tägliche Überraschungsverlosung für kurze Zeit
Registrieren & Prämie sichern →

Erst in den Code schauen? Projekt auf GitHub ansehen
68 CNY TokenRhythm-Guthaben
Tägliche Überraschungsverlosung
App Store-Geschenkkarte