Token-effiziente AI-Agent-Intelligenz
Microkernel AI Agent — gleiches Budget, Ihr Agent erledigt mehr und besser.
Smart Routing, persistenter Speicher, sichere Sandbox — plus integrierte Suche und lokale Embeddings.
- WeiterlesenOpenSquilla 0.5.2 Wartungsrelease 2026-07-29
Ein Wartungsrelease der 0.5-Stable-Linie: einen aktiven Turn mit Same-Turn-Follow-ups über Web und CLI steuern, schnellerer Start und sicherere Recovery, Session-History die während des Ladens nutzbar bleibt, wiederhergestellte Custom-Provider- und Usage-Einstellungen sowie Fixes für Desktop-Projektauswahl und native HTML-Artifact-Previews. Bestehende Konfiguration, Chats, Agents, Memory und Jobs bleiben beim Upgrade von 0.5.1 erhalten.
- WeiterlesenOpenSquilla 0.5.1 Wartungsrelease 2026-07-28
Ein Wartungsrelease der 0.5-Stable-Linie: dauerhafter Plan-Modus, erstklassige Projekt-Workspaces, reichhaltigere Artifact-Previews, neue Provider-Optionen (Qwen Token Plan, Anthropic-kompatibel) sowie plattformübergreifende Profil-Recovery- und Startup-Fixes und zuverlässigere geplante Aufgaben. Bestehende Konfiguration, Chats, Agents, Memory und Jobs bleiben beim Upgrade von 0.5.0 erhalten.
- WeiterlesenOpenSquilla 0.5.0 veröffentlicht 🎉 2026-07-23
Das erste stabile Release der 0.5-Linie, das vier Previews samt seitheriger Fixes zusammenfasst. Highlights: Multi-Modell-Ensemble und Multi-Provider-Routing, sicherere Upgrades mit Profildaten-Schutz, ein signierter & notarisierter macOS-Desktop mit In-App-Updates, eine vereinheitlichte Control-Console mit Usage- & Kosten-Reporting sowie ein großer Zuverlässigkeits-Sweep und Downloads für Festlandchina.
In Aktion erleben
Kurze Demos, die zeigen, wie OpenSquilla echte Workflows löst
Schnellstart
Vier Wege zum Einstieg — wählen Sie, was zu Ihnen passt
Der klarste Weg unter macOS und Windows — eine signierte Desktop-App, die Control-UI und Gateway-Runtime bündelt. Kein Python, kein Terminal.
v0.5.2 · signiert & notarisiert.
Herunterladen und installieren
Wählen Sie oben Ihre Plattform. Unter macOS das .dmg öffnen und OpenSquilla in „Programme" ziehen. Unter Windows den .exe-Installer ausführen.
OpenSquilla öffnen
Starten Sie die App. Das gebündelte Gateway startet automatisch — es ist nichts weiter zu installieren.
Ersteinrichtung abschließen
Beim ersten Start führt Sie das Onboarding durch die Provider-Wahl und das Einfügen der abgefragten Keys. Die Control-UI öffnet sich anschließend direkt in der App.
Einmal deployen, überall erreichbar 3
Konfigurieren Sie einen Agent, bedienen Sie Nutzer auf mehreren Kanälen
Jeder Cent dort, wo es zählt
OpenSquilla lässt Ihren Agent weniger ausgeben, mehr merken und sicherer laufen.
Kostenoptimierung
Mehrere Strategien koordiniert, um jeden Token zu maximieren
Höhere Qualität
Multi-Modell-Ensemble-Routing hebt die Antwortqualität bei den schwersten Turns — über jedes Einzelmodell hinaus
Weitere Kernfähigkeiten
Über Kosten und Genauigkeit hinaus — MetaSkills, menschenähnliches Gedächtnis und eine Sicherheits-Sandbox, alles vorhanden
Microkernel: winziger Kern, riesiges Ökosystem
Inspiriert von OS-Microkerneln — die Core-Engine erledigt das Minimum: Orchestrierung und Zustandsverwaltung. Alles andere läuft als Plugin im „User Space". LLM-Anbieter wechseln? Ein Protocol implementieren. Neues Tool? 5 Codezeilen. Plugin-Crashes betreffen den Kern nicht; Kern-Updates brechen keine Plugins.
Gleiches Budget, höhere Intelligenzdichte
Punkt-für-Punkt-Vergleich mit vergleichbaren Open-Source-Agent-Frameworks4
| Dimension | OpenSquilla | OpenClaw | Hermes Agent |
|---|---|---|---|
| 🏗️Architektur | ✅ Microkernel mit 5-schichtiger Trennung, ultrakompakter Core-Orchestrator (~100 Zeilen), alle Fähigkeiten als Plugin, Auto-Skip + Rollback bei Fehlern | ⚠️ Reifes Plugin-Ökosystem (Dutzende Erweiterungen), klare Grenzen aber mehr Schichten | ❌ Massive monolithische Sync-Hauptschleife (Tausende Zeilen), gesamte Logik eng gekoppelt |
| 💰Kostenoptimierung | ✅ ML-Routing + Reasoning-Tiefenstufen + Prompt-Cache-Isolation + On-Demand-Skills — Mehr-Strategien-Einsparung von 60-80% | ⚠️ Primär-/Fallback-Modell in Config gepinnt, keine inhaltsabhängige Auswahl | ⚠️ Grobe Stichwort- + Längen-Heuristiken, einzige Routing-Strategie |
| 🎯Höhere Qualität | ✅ Multi-Modell-Ensemble-Routing — verteilt schwierige Probleme an mehrere Kandidaten und aggregiert ihre Antworten, übertrifft jedes Einzelmodell (auch Fable 5); Ergebnisse werden fortlaufend ausgegeben, und kostenbewusstes Fallback überspringt das Ensemble, wenn ein Modell genügt | ❌ Einzelmodell-Direktaufrufe, keine Ensemble-Aggregation — Genauigkeit ist durch das eine gewählte Modell begrenzt | ⚠️ Mixture-of-Agents-Preset aggregiert mehrere Modelle — starke Qualität, aber kein kostenbewusstes Fallback, das schwere Ensemble läuft auch, wenn ein Modell genügen würde |
| 🪄MetaSkills-Protokoll | ✅ Komponierbare Workflows + meta-skill-creator zur Selbstautorenschaft + 10+ gebündelte & N+ Community-Skills automatisch abgerufen + Traummodus destilliert Nutzung in neue Kandidaten im Leerlauf | ⚠️ Prompt-getriebene Skill-Ketten, keine Meta-Protokoll-Schicht, keine Selbstevolution; neue Workflows leben als Docs, nicht als First-Class-Runtime-Objekte | ❌ Keine wiederverwendbare Workflow-Abstraktion — Mehrstufenarbeit wird in jeder Session von Null erneut geprompted |
| 💾Speichersystem | ✅ Vektor + Stichwort + Dedup + zeitlicher Zerfall + Hot-Memory-Beförderung + Auto-Schema-Migration | ⚠️ Hat Zerfall / Beförderung / Vielfalts-Reranking, aber keine 4-Schichten-Kognitionsstruktur & Memory-Dream-Konsolidierung | ⚠️ Nur Stichwortsuche, keine Vektorsemantik, semantischer Speicher braucht externe Integration |
| 🛡️Sicherheits-Sandbox | ✅ Keine Docker-Abhängigkeit — Syscall-Level CPU/Speicher/Zeit-Isolation + 3-stufige Netzwerkkontrolle. Serverless-tauglich | ⚠️ Docker optional mit OpenShell als Lightweight-Alternative, schwerer als Syscall-Level-Isolation | ✅ Genehmigung gefährlicher Befehle + 6 Ausführungsumgebungen (lokal/Docker/SSH usw.) |
| 💰Kostenverfolgung | ✅ Tatsächliche Kosten pro Aufruf out-of-the-box, Quota-Hooks für Auto-Throttling bei Überschreitung | ✅ Eingebaute Preistabelle, Kosten in Session-Metadaten geschrieben | ✅ Input/Output/Cache-Read/Cache-Write/Reasoning-Tokens separat erfasst |
| 📊Beobachtbarkeit | ✅ Entscheidungs-Logs als Hashes (kein Klartext, compliance-freundlich), jede Pipeline-Stufe instrumentiert | ✅ Natives OpenTelemetry (als Plugin), Plug-and-Play mit Prometheus/Grafana | ⚠️ SQLite-Session-Tabelle + Aufruf-Counter, Basis-Niveau |
| 🧩Erweiterungs-DX | ✅ Eine Duck-Typed-Klasse mit wenigen Zeilen ist ein gültiges Plugin — keine Basisklasse, kein SDK-Paket, kein Manifest | ⚠️ Interface in plugin-sdk implementieren + Manifest-Datei schreiben | ⚠️ Tools registrieren sich beim Import automatisch (implizite Seiteneffekte) |
Wer profitiert am meisten von OpenSquilla?
Diese Szenarien erzielen den höchsten ROI
Weniger Burn. Weniger Drama. Echte Lieferung.
Die TokenRhythm API ist jetzt zur Registrierung geöffnet – mit drei zeitlich begrenzten Vorteilen:
• Freunde einladen: Beide erhalten 68 CNY API-Guthaben
• Nutzungsdaten teilen: Chance auf eine Erlebniskarte im Wert von 200 CNY
• Tägliche Überraschungsverlosung für kurze Zeit
Registrieren & Prämie sichern →