OpenSquilla – 开源的微内核 AI Agent 框架,可降低Token成本
最近 AI 工具圈又上新了——OpenSquilla。下面用第三方视角拆一拆:它到底解决什么问题、怎么上手、和同类比差在哪。
OpenSquilla是什么
OpenSquilla是开源、可自托管的Token高效型微内核AI Agent运行时,主打”同样的预算,更高的智能密度”。采用极简微内核架构(核心仅约100行代码),通过本地ML模型路由、自适应推理深度、四层认知记忆系统和按需技能加载,可将Token成本降低60-80%。支持OpenAI、Anthropic、DeepSeek、Gemini等20+主流LLM提供商,内置分层安全沙箱、多通道统一网关(Web/Slack/飞书/钉钉等)及丰富工具集,并提供从OpenClaw和Hermes Agent的迁移工具。
核心功能能做什么
OpenSquilla是什么
OpenSquilla是开源、可自托管的Token高效型微内核AI Agent运行时,主打”同样的预算,更高的智能密度”。采用极简微内核架构(核心仅约100行代码),通过本地ML模型路由、自适应推理深度、四层认知记忆系统和按需技能加载,可将Token成本降低60-80%。支持OpenAI、Anthropic、DeepSeek、Gemini等20+主流LLM提供商,内置分层安全沙箱、多通道统一网关(Web/Slack/飞书/钉钉等)及丰富工具集,并提供从OpenClaw和Hermes Agent的迁移工具。

OpenSquilla的主要功能
- SquillaRouter 智能路由:本地LightGBM + ONNX分类器,综合消息长度、语言、代码块、关键词和语义嵌入评分,将任务自动路由到T0-T3四个层级的最便宜可用模型,分类过程完全在设备本地完成。
- 自适应推理深度:仅对复杂查询启用深度推理,简单问题不消耗推理Token;系统Prompt根据任务复杂度自动缩放,避免过度消耗。
- 多LLM提供商统一接入:支持OpenRouter、OpenAI、Anthropic、Ollama、DeepSeek、Gemini、Qwen/DashScope、Moonshot、Mistral、Groq等20+提供商,支持主模型+备用模型自动切换。
- 四层认知记忆架构:工作记忆、情景记忆、语义记忆、原始记忆,支持向量语义检索(sqlite-vec)+ BM25关键词搜索 + 记忆自动衰减与”冒泡”晋升 + 梦境模式(空闲时自动凝练新技能候选)。
- MetaSkills 可组合工作流:支持可组合工作流编排、meta-skill-creator自助创作、10+内置与N+社区Skills自动检索,支持Replay回放与Dream模式自我进化。
- 分层安全沙箱:Standard/Strict/Locked三档策略,Linux下使用Bubblewrap系统调用级隔离(CPU/内存/时长/网络),无需Docker即可部署到Serverless环境。
- 统一网关与多通道接入:基于Starlette ASGI的本地网关(默认
127.0.0.1:18791),Web UI、CLI、Slack、Discord、Telegram、飞书、钉钉、企业微信、QQ、Matrix等共享同一TurnRunner循环。 - 丰富内置工具集:文件读写编辑、Shell与后台进程、Git、网页搜索(Brave/DuckDuckGo)、SSRF防护、PPT/Word/Excel/PDF生成、图像生成、TTS等。
- 成本追踪与配额管理:每轮/每会话Token与费用汇总,内置配额钩子可自动节流防超支,实现精细化成本控制。
- 微内核插件架构:核心编排器仅约100行代码,负责状态机与管道编排;所有能力(Provider、Memory、Channels、Tools、Sandbox等)均以插件形式运行在”用户空间”,插件崩溃不影响核心。
如何使用OpenSquilla
- 环境准备与安装:确保系统已安装 Python 3.12+,通过
uv工具一键安装 OpenSquilla(当前版本 0.3.1),支持 Windows、macOS、Linux 全平台。 - 初始化配置:运行
opensquilla onboard完成首次引导配置,包括设置默认 LLM 提供商、API Key、记忆存储路径及安全沙箱策略(Standard/Strict/Locked)。 - 启动本地网关:执行
opensquilla gateway run启动基于 Starlette ASGI 的统一网关,默认监听127.0.0.1:18791,浏览器访问http://127.0.0.1:18791/control/进入 Web 控制台。 - 配置多 LLM 提供商:在控制台或配置文件中添加 OpenAI、Anthropic、DeepSeek、Gemini、Qwen、Moonshot 等 20+ 提供商的 API Key,设置主模型与备用模型,启用 SquillaRouter 自动路由。
- 通过 Web UI 交互:在控制台直接输入任务,系统自动完成模型路由、推理深度判断、记忆检索和工具调用,实时查看每轮 Token 消耗与费用。
- 接入多通道平台:配置 Slack、Discord、Telegram、飞书、钉钉、企业微信、QQ、Matrix 等通道的 Webhook 或 Bot Token,实现多平台共享同一 Agent 能力。
- 使用与创作 MetaSkills:调用内置 Skills 处理常见任务,或通过
meta-skill-creator自助创作可组合工作流;启用 Dream 模式让系统在空闲时自动凝练新技能候选。 - 管理记忆与上下文:系统自动维护工作记忆、情景记忆、语义记忆、原始记忆四层架构;支持手动查看、编辑记忆条目,配置自动衰减与冒泡晋升策略。
- 配置安全沙箱:Linux 环境下启用 Bubblewrap 系统调用级隔离,限制 CPU、内存、执行时长和网络访问,无需 Docker 即可安全执行 Shell 和文件操作。
- 监控与配额管理:在控制台查看每轮/每会话的 Token 与费用汇总,设置配额阈值自动节流,防止预算超支。
- 数据迁移(可选):如从 OpenClaw 或 Hermes Agent 迁移,使用官方迁移工具导入记忆、人格文件、Skills 和通道配置,预览并处理冲突项。
实际适合谁用
适合想快速体验新能力、做原型或本地部署的开发者与爱好者;涉及生产级稳定性、合规审计的场景,先评估再上车。
和同类比,怎么选
OpenSquilla 侧重「开源的微内核 AI Agent 框架,可降低Token成本」。选哪个看你是个人尝鲜还是企业落地——建议先试免费或开源版,再决定要不要深度接入。
常见问题
OpenSquilla是什么,主要解决什么问题
OpenSquilla是开源、可自托管的Token高效型微内核AI Agent运行时,主打”同样的预算,更高的智能密度”。采用极简微内核架构(核心仅约100行代码),通过本地ML模型路由、自适应推理深度、四层认知记忆系统和按需技能加载,可将Token成本降低60-80%。支持OpenAI、Anthropic、DeepSeek、Gemini等20+主流LLM提供商,内置分层安全沙箱、多通道统一网关(Web/Slack/飞书/钉钉等)及丰富工具集,并提供从OpenClaw和Hermes Agent的迁移工具。
OpenSquilla开源吗
OpenSquilla已开源(正文已说明其开源版本与本地部署方式),具体许可协议以官方仓库公示为准。
OpenSquilla怎么上手 / 怎么用
访问官网或对应平台(文内链接)注册或下载即可体验;开源版本按官方仓库说明本地部署,消费级显卡大多能跑。
OpenSquilla和同类工具比,选哪个
OpenSquilla侧重「开源的微内核 AI Agent 框架,可降低Token成本」;选哪个看你是个人尝鲜还是企业落地,建议先试免费或开源版再决定。
OpenSquilla适合谁用,不适合谁
适合想快速体验新能力、做原型或本地部署的开发者与爱好者;涉及生产级稳定性、合规审计的场景,先评估再上车,别直接当关键链路。

评论(0)