v0.4.1 · Deterministic · Auditable · Evolvable

AI Agent 的 操作系统

Prompt 说「别删文件」是愿望,不是物理定律。
Sentinel 用确定性代码守住每一刀 — 6 Gate · D1-D5 智能审批 · 三层记忆 · Dashboard 可观测。

校验 <1ms 405 tests pass D1-D5 审批 Node ≥18
总访问: -- · 今日: --
Live Data

一眼看懂 Sentinel 在干什么

来自测试套件的真实 Risk 分数 + Verify Gate 幻觉拦截 — 不是营销话术,是跑出来的结果。

Risk Gate 四维分级

同一套公式,不同工具自动得出不同处置 — 不用人工写 if/else

RiskScore = Impact × (1−Rev) × Sensitivity × (1+ErrRate)
write_file(src/*.ts) 0.19 放行
git_push 0.94 通知
delete_dir 3.11 确认
shell_rm_rf 9.18 拒绝
0 安全10 危险

Verify Gate 专捕幻觉

Agent 说"写好了" ≠ 文件真的存在。执行后 SHA-256 对账,幻觉无处遁形。

🤖 AGENT 声称
已成功写入 src/utils/helper.ts,包含 3 个导出函数,lint 通过。
🔍 VERIFY 实测
文件不存在 · Snapshot hash 不匹配 · tsc 未执行
verify: FAIL · postExec.verifyPassed → false
Smart Approval v1.4

D1-D5 智能审批 · 从行为学习

OpenClaw Plugin 集成五维置信度 + BehaviorModel 行为追踪 + CreditSystem 信用等级 — 越用越懂你的 Agent。

置信度拦截示例

npm publish 综合 38 分 — 不靠 Prompt 猜意图,纯确定性加权决策。

38
综合置信度 / 100
D1 命令风险5
D2 历史行为60
D3 上下文匹配30
D4 路径敏感度100
D5 时间模式100
BLOCKED · 权重 D1(35) D2(25) D3(20) D4(10) D5(10)

五维各自负责什么

每一维独立计算、加权汇总 — 可解释、可审计、零 LLM。

D1 · 命令风险35%RiskGate
D2 · 历史行为25%Behavior
D3 · 上下文20%Keywords
D4-D5 · 路径/时间20%Pattern
Credit L1-L3 动态调整阈值 · Circuit Breaker 连续异常自动熔断
📐

D1 命令风险

RiskGate 四维公式映射 0-100 — rm -rf / 直接低分,read 文件接近满分。

🧭

D2 历史行为

三阶匹配:完全匹配 → 同工具 → 同类别。你常做的操作,置信度自动升高。

🔗

D3-D5 上下文

AI 消息关键词、路径敏感度、时间/频率异常 — 综合加权,低分弹窗确认。

Dashboard v0.4

可观测 · 可复盘 · 可改进

读真实 audit.jsonl — 概览/趋势/热力图/事故四 Tab,3 秒自动扫描 openclaw.json 覆盖、批量删除等异常。

系统健康面板

动画数字过渡 · 7 日 CSS 柱状图 · exec/read/write 工具热力图。

96.3%
操作通过率
12
L3 高信用 Agent
42
内置规则
3
熔断保护
Schema
95
Risk
78
Memory
62
Eval
88

故障复盘引擎

自动生成 Markdown 复盘报告 · 事故列表持久化到 .agentos/incidents/ · Dashboard 可标记解决。

🚨 检测到
openclaw.json 被覆盖 · 高风险操作频发 · 批量 delete_dir
📋 自动生成
复盘报告 + 时间线 + 关联 audit 条目 → incidents/*.md
$ npx sentinel-agentos server --port 3300 → /dashboard
痛点 → 方案

Agent 五大核心问题

Prompt 约束是愿望,不是物理定律。Sentinel 用确定性代码逐个击破。

01 01 / 05
幻觉导致错误操作说"不要删"拦不住
Guard 确定性校验
02 02 / 05
越权危险操作要么全禁要么全放
Risk Gate 四维分级
03 03 / 05
记不住、记不对向量库≠真记忆
三层记忆 + 置信度评级
04 04 / 05
出事查不到操作全不可追溯
不可篡改审计
05 05 / 05
不知道 Agent 好不好最多有个 success rate 计数器
三阶段评估 + 隐性反馈 + 质量画像
Philosophy

不是 Agent,是 Agent 的操作系统

内核管安全与记忆,框架只管推理 — 像 Linux 之于应用,Sentinel 之于 Agent。

⚙️

确定性优先

能不用 LLM 就不用。Schema 校验、风险公式、hash 对账 — 纯工程,零幻觉。

✗ 用 LLM 做安全判断
📜

可审计优先

每次操作前后 diff,追加写入 .agentos/audit.jsonl — 可追溯、可回滚、可解释。

✗ 操作完无日志
🔌

渐进增强

框架无关,一行 wrapAgent 接入。OpenClaw Plugin v1.4 / CLI / HTTP Dashboard 任选。

✗ 强绑定单一框架
Guard Layer

6 Gate 确定性流水线

零 LLM 依赖。Schema → Risk → Snapshot → Verify → Audit → Rollback,每步可审计。

01

Schema Gate

12 项规则:必填、类型、枚举、路径、黑白名单、互斥、大小、敏感标记

PRE
02

Risk Gate

Impact × (1−Rev) × Sensitivity × (1+Err) — 纯数学,0.19 放行,9.9 拒绝

PRE
03

Snapshot Gate

SHA-256 哈希 + git HEAD,只记 hash 不备份,<1ms

PRE
04

Verify Gate

文件存在 + hash 对比 + lint/tsc,专捕 Agent 幻觉

POST
05

Audit Log

追加写入 .agentos/audit.jsonl,schema + risk + verify + diff

POST
06

Rollback

git checkout 回滚 API,Snapshot 状态恢复

SAFE
Memory Layer

3 层人脑记忆模型

不是 RAG 检索,是真记忆架构 — 评级、压缩、遗忘,像人脑一样运作。

01

Working Memory

工作记忆 · 实时

当前会话上下文、工具缓存、token 预算。单 session 存活,<50KB

02

Episodic Memory

情景记忆 · 跨会话

事件时间线、重要性评分、渐进压缩 full → summary → forgotten

03

Semantic Memory

语义记忆 · 永久

用户偏好、项目上下文、学习规则(含置信度)、术语表

Evaluator Layer

三阶段评估 + 隐性反馈

不止看结果,看过程。从行为推断满意度,不靠 👍👎。

PHASE 1

Pre-exec 执行前

参数质量、风险预判、上下文利用。操作执行前评估合理性。

PHASE 2

Runtime 执行中

重试监控、自适应评分、工具选择准确性。实时跟踪行为质量。

PHASE 3

Post-exec 执行后

验证分析、接受度推断、结果利用度。形成 Agent 质量画像。

Implicit Feedback

不靠 👍👎,从行为读懂满意度

12 种信号自动检测 + 中文纠错语义分析 — 用户删代码、打断、改输出,系统都懂。

6
Guard Gates
5
审批维度 D1-D5
42
可配置规则
405
测试通过
4
Dashboard Tab
:3300
HTTP API
Integration

CLI · SDK · HTTP · Plugin

本地调试、框架嵌入、Dashboard 服务、OpenClaw 原生插件 — 同一套 Guard 内核,四种入口。

MODE 01

CLI 命令行

零代码验证工具调用。本地快速试 Risk 分数、Schema 拦截、审计查询。

npx sentinel-agentos validate write_file path=src/main.ts
调试首选
MODE 02

SDK wrapAgent

一行接入 LangChain / CrewAI / 自研框架。execute() 自动走完整 6 Gate 流水线。

const aos = wrapAgent({ workspaceRoot: process.cwd() })
生产推荐
MODE 03

HTTP API + Dashboard

独立服务部署,REST 化 pipeline/审计/反馈。内置 Dashboard — 概览、7 日趋势、工具热力图、事故复盘。

GET localhost:3300/dashboard · /api/stats · /api/incidents
跨语言
MODE 04

OpenClaw Plugin v1.4

框架层自动拦截工具调用 — D1-D5 智能审批、42 条可配置规则热加载、Circuit Breaker 熔断、episodic 记忆注入。

openclaw plugins install sentinel-agentos-plugin
openclaw gateway restart
OpenClaw 首选
Get Started

三行代码接入

框架无关 · 增量接入 · 5 分钟增强你的 Agent

SDK — TypeScript
$npm install sentinel-agentos
# 一行接入任意 Agent 框架
$import { wrapAgent } from 'sentinel-agentos'
$const aos = wrapAgent({ workspaceRoot: process.cwd() })
$await aos.execute('write_file', { path, content }, fn)
CLI — 本地验证
$npx sentinel-agentos risk git_push
# → score: 0.94, action: notify
$npx sentinel-agentos validate write_file path=.env
# → Schema FAIL: pathDeny 拦截敏感路径
$npx sentinel-agentos audit --limit 5
# Dashboard 可观测
$npx sentinel-agentos server --port 3300
sentinel-light.js 零依赖轻量版 · .agentos/rules.json 自定义规则热加载 · Dashboard 一键启动 npx sentinel-agentos server
GitHub ↗
OpenClaw LangChain CrewAI 自研框架
Sentinel AgentOS

MIT 开源 · v0.4.1 · 用确定性让 Agent 可信