v0.5.2 · Apache License 2.0 · Python 3.12+
基元律动 · OpenSquilla

Inteligencia de Agente IA optimizada en Tokens

AI Agent de microkernel — mismo presupuesto, tu Agent hace más y mejor.
Enrutamiento inteligente, memoria persistente, sandbox seguro, además de búsqueda y embeddings locales integrados.

60-80%1
Ahorro de Costos Tokens
N+
Meta-skills
› Fable 5
Routing inteligente al frente
10+
Canales integrados

Míralo en acción

Demos cortas que muestran cómo OpenSquilla resuelve flujos reales

Instalación portable en Windows
MetaSkill de cortos
MetaSkill de redacción de papers

Inicio rápido

Cuatro caminos para empezar — elige el que mejor te encaje

La ruta más clara en macOS y Windows — una app de escritorio firmada que integra la Control UI y el runtime del gateway. Sin Python, sin terminal.

v0.5.2 · firmada y notarizada.

Más rápido en China continental: macOS · Windows

1

Descarga e instala

Elige tu plataforma arriba. En macOS, abre el .dmg y arrastra OpenSquilla a Aplicaciones. En Windows, ejecuta el instalador .exe.

2

Abre OpenSquilla

Inicia la app. El gateway integrado arranca automáticamente — no hay nada más que instalar.

3

Completa la configuración inicial

En el primer arranque, el onboarding te guía para elegir un proveedor y pegar las keys solicitadas. La Control UI se abre luego dentro de la propia app.

Las builds de Windows están firmadas y las de macOS notarizadas, así que no hace falta saltarse SmartScreen ni Gatekeeper. En Linux, usa la Instalación rápida por terminal.
Para uso avanzado, visita el repo de GitHub

Despliega una vez, llega a todas partes 3

Configura un Agent y atiende a usuarios en múltiples canales

Terminal Web Slack Discord Telegram MS Teams Matrix Lark DingTalk WeCom QQ

Cada centavo, gastado donde importa

OpenSquilla hace que tu Agent gaste menos, recuerde más y funcione más seguro.

💰

Optimización de costos

Múltiples estrategias coordinadas para maximizar cada Token

Enrutamiento inteligente ²
Como ride-sharing — preguntas simples toman el bus (modelos baratos), las complejas obtienen el coche premium (modelos top). El sistema decide.
Análisis híbrido de características
Combina características hechas a mano (longitud, idioma, bloques de código, palabras clave) con características semánticas basadas en embeddings para evaluar complejidad y elegir el modelo correcto.
Niveles de profundidad de razonamiento
Desactiva facturación de razonamiento para consultas simples, solo activa pensamiento profundo para las complejas — sin pagar Tokens de razonamiento por un "hola".
Prompts adaptativos
Auto-ajusta el prompt según la complejidad de la tarea — ligero para lo simple, plena potencia para lo complejo.
Skills bajo demanda
Sin volcar todas las capacidades en el contexto. Solo carga lo necesario para la tarea actual — evita desperdicio de Tokens.
🎯

Mayor calidad

El enrutamiento por ensemble multi-modelo eleva la calidad de respuesta en los turnos más difíciles — más allá de cualquier modelo único

Model Ensemble Routing
Reparte un turno difícil entre varios modelos candidatos y sintetiza sus respuestas, elevando la precisión más allá de lo que alcanza un solo modelo.
Supera a Fable 5
En evaluaciones internas de turnos difíciles, el enrutamiento por ensemble superó a todas las baselines de un solo modelo — incluida Fable 5.
Resultados progresivos
Aparecen respuestas parciales útiles mientras el ensemble se asienta, sin quedar esperando al candidato más lento.
Presets y lineups propios
Elige un preset claro (static OpenRouter B5 / TokenRhythm B5) o crea tu propio lineup — con ajuste de timeout para que los candidatos lentos nunca bloqueen un turno.
Fallback inteligente
Cuando un solo modelo encaja mejor, el enrutamiento toma la ruta directa automáticamente — precisión donde ayuda, sin desperdicio donde no.
🧩

Más capacidades clave

Más allá del coste y la precisión — MetaSkills, memoria humana y sandbox de seguridad, todo listo

Protocolo MetaSkills
Un meta-protocolo para skills a escala: el Agent busca, filtra y compone Skills de forma autónoma, y destila patrones a partir de rastros de ejecución reproducibles para redactar nuevas MetaSkills — la capacidad crece en segundo plano.
Memoria humana
Cuatro niveles — trabajo / episódica / semántica / cruda — con búsqueda híbrida vectorial + palabras clave y embeddings ONNX locales (los datos permanecen en tu máquina). Las memorias activas suben, las antiguas decaen, y un "sueño" cada 24 h lo consolida todo — más inteligente con el uso.
Sandbox de seguridad
Política de tres niveles más aislamiento real Bubblewrap / Seatbelt, registro de denegaciones, protección de salidas obsoletas y defensa contra prompt injection — deja que el Agent actúe sin temer lo que pueda hacer.

Microkernel: núcleo diminuto, ecosistema vasto

Inspirado en microkernels de SO — el motor central hace lo mínimo: orquestación y gestión de estado. Todo lo demás corre como plugin en "espacio de usuario". ¿Cambiar proveedor LLM? Implementa un Protocol. ¿Añadir herramienta? 5 líneas de código. Los crashes de plugins no afectan al núcleo; las actualizaciones del núcleo no rompen los plugins.

OpenSquilla
OpenSquilla Core Engine
Orquestador de pipeline compacto · Máquina de estados · Totalmente async · Auto-rollback en errores
⚙️
engine/
Máquina de estados
🤖
provider/
Multi-LLM Provider
🌐
gateway/
Gateway ASGI RPC
🧠
memory/
Memoria multi-nivel
📡
channels/
Adaptadores de canal
🔧
tools/ + mcp/
Herramientas MCP-First
🛡️
sandbox/
Sandbox de seguridad
scheduler/
Programador de tareas
🧩
skills/
Plugins de skills
🎭
identity/
Identidad y Prompts
Integrado
🔍 Búsqueda: Brave / DuckDuckGo 🧬 Embeddings locales: inferencia ONNX (offline · datos permanecen en el dispositivo) 🔌 Embeddings opcionales: OpenAI / Ollama

Mismo presupuesto, mayor densidad de inteligencia

Comparación punto por punto con frameworks Agent open source equivalentes4

🏗️Arquitectura
OpenSquilla
✅ Microkernel con separación de 5 capas, orquestador ultracompacto (~100 líneas), todas las capacidades como plugins, auto-skip + rollback en errores
OpenClaw
⚠️ Ecosistema de plugins maduro (decenas de extensiones), límites claros pero más capas
Hermes Agent
❌ Bucle principal síncrono monolítico masivo (miles de líneas), toda la lógica fuertemente acoplada
💰Optimización de costos
OpenSquilla
✅ Enrutamiento ML + niveles de razonamiento + aislamiento de cache de prompts + skills bajo demanda — ahorros multi-estrategia del 60-80%
OpenClaw
⚠️ Modelo principal + cadena fallback fijados en config, sin selección por contenido
Hermes Agent
⚠️ Heurísticas crudas de palabras clave + longitud, única estrategia de enrutamiento
🎯Mayor calidad
OpenSquilla
✅ Enrutamiento por ensemble multi-modelo — distribuye los problemas difíciles entre varios candidatos y agrega sus respuestas, superando a cualquier modelo individual (incluido Fable 5); resultados progresivos y fallback consciente del costo que omite el ensemble cuando basta un modelo
OpenClaw
❌ Llamadas directas a un solo modelo, sin agregación por ensemble — la precisión está limitada por el modelo que elijas
Hermes Agent
⚠️ El preset Mixture-of-Agents agrega varios modelos — buena calidad, pero sin fallback consciente del costo: el ensemble pesado corre incluso cuando bastaría un modelo
🪄Protocolo MetaSkills
OpenSquilla
✅ Flujos componibles + meta-skill-creator para auto-autoría + 10+ MetaSkills incluidas & N+ Skills de la comunidad recuperadas automáticamente + Modo Sueño destila uso en nuevos candidatos durante la inactividad
OpenClaw
⚠️ Cadenas de skills dirigidas por prompt, sin capa de meta-protocolo, sin auto-evolución; los nuevos flujos viven como docs, no como objetos runtime de primera clase
Hermes Agent
❌ Sin abstracción de flujos reutilizables — el trabajo multi-paso se re-prompta desde cero cada sesión
💾Sistema de memoria
OpenSquilla
✅ Vector + palabras clave + dedup + decaimiento temporal + promoción de memoria activa + migración automática de schema
OpenClaw
⚠️ Tiene decaimiento / promoción / reranking de diversidad, pero le falta estructura cognitiva de 4 niveles y consolidación Memory Dream
Hermes Agent
⚠️ Solo búsqueda por palabras clave, sin semántica vectorial, memoria semántica requiere integración externa
🛡️Sandbox de seguridad
OpenSquilla
✅ Sin dependencia de Docker — aislamiento a nivel syscall CPU/memoria/tiempo + control de red 3 niveles. Compatible con serverless
OpenClaw
⚠️ Docker opcional con OpenShell como alternativa ligera, más pesado que aislamiento syscall
Hermes Agent
✅ Aprobación de comandos peligrosos + 6 entornos de ejecución (local/Docker/SSH etc)
💰Seguimiento de costos
OpenSquilla
✅ Costo real por llamada listo para usar, hooks de cuota para auto-throttling en sobreconsumo
OpenClaw
✅ Tabla de precios integrada, costo escrito en metadatos de sesión
Hermes Agent
✅ Tokens entrada/salida/cache-read/cache-write/razonamiento rastreados por separado
📊Observabilidad
OpenSquilla
✅ Logs de decisión almacenan hashes (sin texto crudo, amigable a compliance), cada etapa del pipeline instrumentada
OpenClaw
✅ OpenTelemetry nativo (como plugin), plug-and-play con Prometheus/Grafana
Hermes Agent
⚠️ Tabla de sesión SQLite + contador de llamadas, nivel básico
🧩DX de extensión
OpenSquilla
✅ Una clase duck-typed de pocas líneas es plugin válido — sin clase base, sin paquete SDK, sin manifest
OpenClaw
⚠️ Implementar interfaz en plugin-sdk + escribir archivo manifest
Hermes Agent
⚠️ Herramientas se auto-registran al import (efectos secundarios implícitos)

¿Quién se beneficia más de OpenSquilla?

Estos escenarios obtienen el mayor ROI

🏢
Despliegue on-premise
Totalmente offline, los datos nunca salen de tu red, el enrutamiento ML corre localmente
📋
Compliance y auditoría
Políticas de tres niveles + logs de decisión hasheados + puertas de aprobación humana
💸
Presupuesto ajustado, exigencias altas
Más tareas por el mismo costo — el enrutamiento inteligente elige el modelo más rentable
🧠
Un Agent que te entiende
Memoria humana de 4 niveles que acumula contexto — nunca empieces desde cero
Programa piloto · Abierto ahora

Menos burn. Menos drama. Entrega real.

El registro para la API de TokenRhythm ya está abierto, con tres ventajas por tiempo limitado:
Invita a tus amigos: ambos reciben 68 CNY en crédito API
Comparte tus datos: opción de ganar una tarjeta de prueba de 200 CNY
Sorteo diario de grandes premios por tiempo limitado
Regístrate y gana →

¿Quieres ver el código primero? Ver el proyecto en GitHub
68 CNY en crédito TokenRhythm
Sorteo sorpresa diario
Tarjeta regalo de App Store