Inteligencia de Agente IA optimizada en Tokens
AI Agent de microkernel — mismo presupuesto, tu Agent hace más y mejor.
Enrutamiento inteligente, memoria persistente, sandbox seguro, además de búsqueda y embeddings locales integrados.
- Leer másOpenSquilla 0.5.2 versión de mantenimiento 2026-07-29
Una versión de mantenimiento de la línea estable 0.5: dirige un turno activo con follow-ups del mismo turno en Web y CLI, arranque más rápido y recuperación más segura, historial de sesión que sigue usable mientras carga, ajustes de provider personalizado y de uso restaurados, y correcciones en la selección de proyecto de escritorio y las previews nativas de artifacts HTML. La configuración, chats, Agents, memoria y trabajos existentes se conservan al actualizar desde 0.5.1.
- Leer másOpenSquilla 0.5.1 versión de mantenimiento 2026-07-28
Una versión de mantenimiento de la línea estable 0.5: modo Plan duradero, workspaces de proyecto de primera clase, previews de artifacts más ricas, nuevas opciones de provider (Qwen Token Plan, compatible con Anthropic), correcciones de recuperación de perfil y arranque multiplataforma, y tareas programadas más fiables. La configuración, chats, Agents, memoria y trabajos existentes se conservan al actualizar desde 0.5.0.
- Leer másOpenSquilla 0.5.0 disponible 🎉 2026-07-23
La primera versión estable de la línea 0.5, que consolida cuatro previews y las correcciones posteriores. Destacados: Model Ensemble multimodelo y routing multi-provider, actualizaciones más seguras con protección de datos de perfil, un escritorio macOS firmado y notarizado con actualizaciones in-app, una consola de control unificada con reporte de uso y coste, además de un gran barrido de fiabilidad y descargas para China continental.
Míralo en acción
Demos cortas que muestran cómo OpenSquilla resuelve flujos reales
Inicio rápido
Cuatro caminos para empezar — elige el que mejor te encaje
La ruta más clara en macOS y Windows — una app de escritorio firmada que integra la Control UI y el runtime del gateway. Sin Python, sin terminal.
v0.5.2 · firmada y notarizada.
Descarga e instala
Elige tu plataforma arriba. En macOS, abre el .dmg y arrastra OpenSquilla a Aplicaciones. En Windows, ejecuta el instalador .exe.
Abre OpenSquilla
Inicia la app. El gateway integrado arranca automáticamente — no hay nada más que instalar.
Completa la configuración inicial
En el primer arranque, el onboarding te guía para elegir un proveedor y pegar las keys solicitadas. La Control UI se abre luego dentro de la propia app.
Despliega una vez, llega a todas partes 3
Configura un Agent y atiende a usuarios en múltiples canales
Cada centavo, gastado donde importa
OpenSquilla hace que tu Agent gaste menos, recuerde más y funcione más seguro.
Optimización de costos
Múltiples estrategias coordinadas para maximizar cada Token
Mayor calidad
El enrutamiento por ensemble multi-modelo eleva la calidad de respuesta en los turnos más difíciles — más allá de cualquier modelo único
Más capacidades clave
Más allá del coste y la precisión — MetaSkills, memoria humana y sandbox de seguridad, todo listo
Microkernel: núcleo diminuto, ecosistema vasto
Inspirado en microkernels de SO — el motor central hace lo mínimo: orquestación y gestión de estado. Todo lo demás corre como plugin en "espacio de usuario". ¿Cambiar proveedor LLM? Implementa un Protocol. ¿Añadir herramienta? 5 líneas de código. Los crashes de plugins no afectan al núcleo; las actualizaciones del núcleo no rompen los plugins.
Mismo presupuesto, mayor densidad de inteligencia
Comparación punto por punto con frameworks Agent open source equivalentes4
| Dimensión | OpenSquilla | OpenClaw | Hermes Agent |
|---|---|---|---|
| 🏗️Arquitectura | ✅ Microkernel con separación de 5 capas, orquestador ultracompacto (~100 líneas), todas las capacidades como plugins, auto-skip + rollback en errores | ⚠️ Ecosistema de plugins maduro (decenas de extensiones), límites claros pero más capas | ❌ Bucle principal síncrono monolítico masivo (miles de líneas), toda la lógica fuertemente acoplada |
| 💰Optimización de costos | ✅ Enrutamiento ML + niveles de razonamiento + aislamiento de cache de prompts + skills bajo demanda — ahorros multi-estrategia del 60-80% | ⚠️ Modelo principal + cadena fallback fijados en config, sin selección por contenido | ⚠️ Heurísticas crudas de palabras clave + longitud, única estrategia de enrutamiento |
| 🎯Mayor calidad | ✅ Enrutamiento por ensemble multi-modelo — distribuye los problemas difíciles entre varios candidatos y agrega sus respuestas, superando a cualquier modelo individual (incluido Fable 5); resultados progresivos y fallback consciente del costo que omite el ensemble cuando basta un modelo | ❌ Llamadas directas a un solo modelo, sin agregación por ensemble — la precisión está limitada por el modelo que elijas | ⚠️ El preset Mixture-of-Agents agrega varios modelos — buena calidad, pero sin fallback consciente del costo: el ensemble pesado corre incluso cuando bastaría un modelo |
| 🪄Protocolo MetaSkills | ✅ Flujos componibles + meta-skill-creator para auto-autoría + 10+ MetaSkills incluidas & N+ Skills de la comunidad recuperadas automáticamente + Modo Sueño destila uso en nuevos candidatos durante la inactividad | ⚠️ Cadenas de skills dirigidas por prompt, sin capa de meta-protocolo, sin auto-evolución; los nuevos flujos viven como docs, no como objetos runtime de primera clase | ❌ Sin abstracción de flujos reutilizables — el trabajo multi-paso se re-prompta desde cero cada sesión |
| 💾Sistema de memoria | ✅ Vector + palabras clave + dedup + decaimiento temporal + promoción de memoria activa + migración automática de schema | ⚠️ Tiene decaimiento / promoción / reranking de diversidad, pero le falta estructura cognitiva de 4 niveles y consolidación Memory Dream | ⚠️ Solo búsqueda por palabras clave, sin semántica vectorial, memoria semántica requiere integración externa |
| 🛡️Sandbox de seguridad | ✅ Sin dependencia de Docker — aislamiento a nivel syscall CPU/memoria/tiempo + control de red 3 niveles. Compatible con serverless | ⚠️ Docker opcional con OpenShell como alternativa ligera, más pesado que aislamiento syscall | ✅ Aprobación de comandos peligrosos + 6 entornos de ejecución (local/Docker/SSH etc) |
| 💰Seguimiento de costos | ✅ Costo real por llamada listo para usar, hooks de cuota para auto-throttling en sobreconsumo | ✅ Tabla de precios integrada, costo escrito en metadatos de sesión | ✅ Tokens entrada/salida/cache-read/cache-write/razonamiento rastreados por separado |
| 📊Observabilidad | ✅ Logs de decisión almacenan hashes (sin texto crudo, amigable a compliance), cada etapa del pipeline instrumentada | ✅ OpenTelemetry nativo (como plugin), plug-and-play con Prometheus/Grafana | ⚠️ Tabla de sesión SQLite + contador de llamadas, nivel básico |
| 🧩DX de extensión | ✅ Una clase duck-typed de pocas líneas es plugin válido — sin clase base, sin paquete SDK, sin manifest | ⚠️ Implementar interfaz en plugin-sdk + escribir archivo manifest | ⚠️ Herramientas se auto-registran al import (efectos secundarios implícitos) |
¿Quién se beneficia más de OpenSquilla?
Estos escenarios obtienen el mayor ROI
Menos burn. Menos drama. Entrega real.
El registro para la API de TokenRhythm ya está abierto, con tres ventajas por tiempo limitado:
• Invita a tus amigos: ambos reciben 68 CNY en crédito API
• Comparte tus datos: opción de ganar una tarjeta de prueba de 200 CNY
• Sorteo diario de grandes premios por tiempo limitado
Regístrate y gana →