v0.5.2 · Apache License 2.0 · Python 3.12+
基元律动 · OpenSquilla

Intelligence d'Agent IA optimisée en Tokens

AI Agent à microkernel — même budget, laissez votre Agent en faire plus, et mieux.
Routage intelligent, mémoire persistante, sandbox sécurisée, plus recherche et embeddings locaux intégrés.

60-80%1
Économie de coûts Tokens
N+
Meta-skills
› Fable 5
Routing intelligent en tête
10+
Canaux intégrés

En action

Démos courtes montrant comment OpenSquilla résout des workflows réels

Installation portable sous Windows
MetaSkill court métrage
MetaSkill rédaction de papers

Démarrage rapide

Quatre chemins pour démarrer — choisissez celui qui vous convient

La voie la plus claire sur macOS et Windows — une app de bureau signée qui embarque la Control UI et le runtime du gateway. Sans Python, sans terminal.

v0.5.2 · signée et notariée.

Plus rapide en Chine continentale: macOS · Windows

1

Téléchargez et installez

Choisissez votre plateforme ci-dessus. Sur macOS, ouvrez le .dmg et glissez OpenSquilla dans Applications. Sur Windows, lancez l'installeur .exe.

2

Ouvrez OpenSquilla

Lancez l'app. Le gateway embarqué démarre automatiquement — il n'y a rien d'autre à installer.

3

Terminez la configuration initiale

Au premier lancement, l'onboarding vous guide pour choisir un provider et coller les clés demandées. La Control UI s'ouvre ensuite directement dans l'app.

Les builds Windows sont signées et les builds macOS notariées : aucun contournement de SmartScreen ou Gatekeeper n'est nécessaire. Sur Linux, utilisez l'Installation rapide par terminal.
Pour un usage avancé, visitez le dépôt GitHub

Déployez une fois, atteignez partout 3

Configurez un Agent, servez vos utilisateurs sur plusieurs canaux

Terminal Web Slack Discord Telegram MS Teams Matrix Lark DingTalk WeCom QQ

Chaque centime, dépensé là où ça compte

OpenSquilla permet à votre Agent de dépenser moins, de mémoriser plus et de fonctionner en toute sécurité.

💰

Optimisation des coûts

Plusieurs stratégies coordonnées pour maximiser chaque Token

Routage intelligent ²
Comme un VTC — les questions simples prennent le bus (modèles bon marché), les complexes obtiennent la berline premium (modèles haut de gamme). Le système décide.
Analyse hybride de caractéristiques
Combine des caractéristiques manuelles (longueur, langue, blocs de code, mots-clés) avec des caractéristiques sémantiques basées sur les embeddings pour évaluer la complexité et choisir le bon modèle.
Niveaux de profondeur de raisonnement
Désactive la facturation du raisonnement pour les requêtes simples, n'active la pensée profonde que pour les complexes — pas de Tokens de raisonnement pour un simple "bonjour".
Prompts adaptatifs
Ajuste automatiquement le prompt selon la complexité de la tâche — léger pour le simple, pleine puissance pour le complexe.
Compétences à la demande
Pas de surcharge du contexte avec toutes les capacités. Charge uniquement ce qui est nécessaire pour la tâche actuelle.
🎯

Meilleure qualité

Le routing par ensemble multi-modèle élève la qualité des réponses sur les tours les plus difficiles — au-delà de tout modèle unique

Model Ensemble Routing
Répartit un tour difficile sur plusieurs modèles candidats et synthétise leurs réponses, portant la précision au-delà de ce qu'un seul modèle atteint.
Surpasse Fable 5
Dans des évals internes de tours difficiles, le routing par ensemble a battu toutes les baselines à modèle unique — y compris Fable 5.
Résultats progressifs
Des réponses partielles utiles apparaissent pendant que l'ensemble se stabilise, sans attendre le candidat le plus lent.
Presets & lineups perso
Choisissez un preset clair (static OpenRouter B5 / TokenRhythm B5) ou construisez votre lineup — avec réglage de timeout pour que les candidats lents ne bloquent jamais un tour.
Fallback intelligent
Quand un seul modèle convient mieux, le routing prend automatiquement la voie directe — de la précision là où ça aide, pas de gaspillage ailleurs.
🧩

Autres capacités clés

Au-delà du coût et de la précision — MetaSkills, mémoire humaine et sandbox de sécurité, tout est là

Protocole MetaSkills
Un méta-protocole pour les skills à grande échelle : l'Agent recherche, filtre et compose les Skills de façon autonome, puis distille des motifs à partir de traces d'exécution rejouables pour rédiger de nouvelles MetaSkills — la capacité grandit en arrière-plan.
Mémoire humaine
Quatre niveaux — travail / épisodique / sémantique / brute — avec recherche hybride vectorielle + mots-clés et embeddings ONNX locaux (les données restent sur votre machine). Les mémoires actives remontent, les anciennes s'estompent, et un "rêve" toutes les 24 h consolide le tout — plus intelligente avec l'usage.
Sandbox de sécurité
Politique à 3 niveaux plus vraie isolation Bubblewrap / Seatbelt, registre de refus, protection contre les sorties obsolètes et défense contre les prompt injections — laissez l'Agent agir sans craindre ce qu'il pourrait faire.

Microkernel : noyau minuscule, vaste écosystème

Inspiré des microkernels OS — le moteur central fait le minimum : orchestration et gestion d'état. Tout le reste tourne en plugins en "espace utilisateur". Changer de fournisseur LLM ? Implémentez un Protocol. Ajouter un outil ? 5 lignes de code. Les plugins qui plantent n'affectent pas le noyau ; les mises à jour du noyau ne cassent pas les plugins.

OpenSquilla
OpenSquilla Core Engine
Orchestrateur de pipeline compact · Machine à états · Entièrement async · Auto-rollback en cas d'erreur
⚙️
engine/
Machine à états
🤖
provider/
Multi-fournisseurs LLM
🌐
gateway/
Gateway ASGI RPC
🧠
memory/
Mémoire multi-niveaux
📡
channels/
Adaptateurs de canaux
🔧
tools/ + mcp/
Outils MCP-First
🛡️
sandbox/
Sandbox de sécurité
scheduler/
Ordonnanceur
🧩
skills/
Plugins de compétences
🎭
identity/
Identité & Prompts
Intégré
🔍 Recherche : Brave / DuckDuckGo 🧬 Embeddings locaux : inférence ONNX (hors-ligne · données restent sur l'appareil) 🔌 Embeddings optionnels : OpenAI / Ollama

Même budget, densité d'intelligence supérieure

Comparatif point par point avec les frameworks Agent open source équivalents4

🏗️Architecture
OpenSquilla
✅ Microkernel à 5 couches séparées, orchestrateur ultra-compact (~100 lignes), toutes capacités en plugins, auto-skip + rollback en cas d'erreur
OpenClaw
⚠️ Écosystème de plugins mature (dizaines d'extensions), frontières claires mais plus de couches
Hermes Agent
❌ Boucle principale synchrone monolithique massive (milliers de lignes), toute la logique fortement couplée
💰Optimisation des coûts
OpenSquilla
✅ Routage ML + niveaux de raisonnement + isolation cache prompts + skills à la demande — économies multi-stratégies de 60-80%
OpenClaw
⚠️ Modèle principal + chaîne de fallback figés en config, pas de sélection basée sur le contenu
Hermes Agent
⚠️ Heuristiques mots-clés + longueur grossières, stratégie de routage unique
🎯Meilleure qualité
OpenSquilla
✅ Routage par ensemble multi-modèles — répartit les problèmes difficiles entre plusieurs candidats et agrège leurs réponses, dépassant tout modèle unique (dont Fable 5) ; résultats progressifs et fallback tenant compte du coût qui saute l'ensemble quand un seul modèle suffit
OpenClaw
❌ Appels directs à un seul modèle, pas d'agrégation par ensemble — la précision est plafonnée par le modèle choisi
Hermes Agent
⚠️ Le preset Mixture-of-Agents agrège plusieurs modèles — bonne qualité, mais pas de fallback tenant compte du coût : l'ensemble lourd tourne même quand un seul modèle suffirait
🪄Protocole MetaSkills
OpenSquilla
✅ Workflows composables + meta-skill-creator pour l'auto-écriture + 10+ MetaSkills intégrées & N+ Skills communautaires récupérées automatiquement + Mode Rêve distille l'usage en nouveaux candidats pendant l'inactivité
OpenClaw
⚠️ Chaînes de skills pilotées par prompt, pas de couche méta-protocole, pas d'auto-évolution ; les nouveaux workflows vivent en docs, pas en objets runtime de première classe
Hermes Agent
❌ Pas d'abstraction de workflow réutilisable — le travail multi-étapes est re-prompté depuis zéro à chaque session
💾Système de mémoire
OpenSquilla
✅ Vecteur + mots-clés + déduplication + décroissance temporelle + promotion des mémoires actives + migration de schéma auto
OpenClaw
⚠️ A décroissance / promotion / reranking de diversité, mais manque structure cognitive 4 niveaux & consolidation Memory Dream
Hermes Agent
⚠️ Recherche par mots-clés uniquement, pas de sémantique vectorielle, mémoire sémantique nécessite intégration externe
🛡️Sandbox de sécurité
OpenSquilla
✅ Pas de dépendance Docker — isolation au niveau syscall CPU/mémoire/temps + contrôle réseau 3 niveaux. Compatible serverless
OpenClaw
⚠️ Docker optionnel avec OpenShell comme alternative légère, plus lourd que l'isolation syscall
Hermes Agent
✅ Approbation des commandes dangereuses + 6 environnements d'exécution (local/Docker/SSH etc)
💰Suivi des coûts
OpenSquilla
✅ Coût réel par appel prêt à l'emploi, hooks de quota pour auto-throttling en cas de dépassement
OpenClaw
✅ Table de prix intégrée, coût écrit dans les métadonnées de session
Hermes Agent
✅ Tokens entrée/sortie/cache-read/cache-write/raisonnement suivis séparément
📊Observabilité
OpenSquilla
✅ Logs de décision en hash (pas de texte brut, conforme), chaque étape du pipeline instrumentée
OpenClaw
✅ OpenTelemetry natif (en plugin), plug-and-play avec Prometheus/Grafana
Hermes Agent
⚠️ Table de session SQLite + compteur d'appels, niveau basique
🧩DX d'extension
OpenSquilla
✅ Une classe duck-typed de quelques lignes est un plugin valide — pas de classe de base, pas de package SDK, pas de manifest
OpenClaw
⚠️ Implémenter l'interface dans plugin-sdk + écrire un fichier manifest
Hermes Agent
⚠️ Outils auto-enregistrés à l'import (effets de bord implicites)

Qui bénéficie le plus d'OpenSquilla ?

Ces scénarios obtiennent le meilleur ROI

🏢
Déploiement on-premise
Entièrement hors-ligne, données ne quittent jamais votre réseau, routage ML s'exécute localement
📋
Conformité & audit
Politiques 3 niveaux + logs de décision hashés + portes d'approbation humaine
💸
Budget serré, exigences élevées
Plus de tâches pour le même coût — le routage intelligent choisit le modèle le plus rentable
🧠
Un Agent qui vous comprend
Mémoire humaine à 4 niveaux qui accumule du contexte — ne repartez jamais de zéro
Programme pilote · Ouvert maintenant

Moins de burn. Moins de drama. Vraie livraison.

Les inscriptions à l'API TokenRhythm sont ouvertes, avec trois offres limitées :
Invitez un ami : chacun reçoit 68 CNY de crédits API
Partagez vos données : tentez de gagner une carte découverte de 200 CNY
Tirage quotidien à durée limitée
S'inscrire et recevoir les récompenses →

Envie de jeter un œil au code d'abord ? Voir le projet sur GitHub
68 CNY de crédits TokenRhythm
Tirage surprise quotidien
Carte cadeau App Store