来自测试套件的真实 Risk 分数 + Verify Gate 幻觉拦截 — 不是营销话术,是跑出来的结果。
同一套公式,不同工具自动得出不同处置 — 不用人工写 if/else
Agent 说"写好了" ≠ 文件真的存在。执行后 SHA-256 对账,幻觉无处遁形。
src/utils/helper.ts,包含 3 个导出函数,lint 通过。
OpenClaw Plugin 集成五维置信度 + BehaviorModel 行为追踪 + CreditSystem 信用等级 — 越用越懂你的 Agent。
npm publish 综合 38 分 — 不靠 Prompt 猜意图,纯确定性加权决策。
每一维独立计算、加权汇总 — 可解释、可审计、零 LLM。
RiskGate 四维公式映射 0-100 — rm -rf / 直接低分,read 文件接近满分。
三阶匹配:完全匹配 → 同工具 → 同类别。你常做的操作,置信度自动升高。
AI 消息关键词、路径敏感度、时间/频率异常 — 综合加权,低分弹窗确认。
读真实 audit.jsonl — 概览/趋势/热力图/事故四 Tab,3 秒自动扫描 openclaw.json 覆盖、批量删除等异常。
动画数字过渡 · 7 日 CSS 柱状图 · exec/read/write 工具热力图。
自动生成 Markdown 复盘报告 · 事故列表持久化到 .agentos/incidents/ · Dashboard 可标记解决。
Prompt 约束是愿望,不是物理定律。Sentinel 用确定性代码逐个击破。
内核管安全与记忆,框架只管推理 — 像 Linux 之于应用,Sentinel 之于 Agent。
能不用 LLM 就不用。Schema 校验、风险公式、hash 对账 — 纯工程,零幻觉。
每次操作前后 diff,追加写入 .agentos/audit.jsonl — 可追溯、可回滚、可解释。
框架无关,一行 wrapAgent 接入。OpenClaw Plugin v1.4 / CLI / HTTP Dashboard 任选。
零 LLM 依赖。Schema → Risk → Snapshot → Verify → Audit → Rollback,每步可审计。
12 项规则:必填、类型、枚举、路径、黑白名单、互斥、大小、敏感标记
Impact × (1−Rev) × Sensitivity × (1+Err) — 纯数学,0.19 放行,9.9 拒绝
SHA-256 哈希 + git HEAD,只记 hash 不备份,<1ms
文件存在 + hash 对比 + lint/tsc,专捕 Agent 幻觉
追加写入 .agentos/audit.jsonl,schema + risk + verify + diff
git checkout 回滚 API,Snapshot 状态恢复
不是 RAG 检索,是真记忆架构 — 评级、压缩、遗忘,像人脑一样运作。
当前会话上下文、工具缓存、token 预算。单 session 存活,<50KB
事件时间线、重要性评分、渐进压缩 full → summary → forgotten
用户偏好、项目上下文、学习规则(含置信度)、术语表
不止看结果,看过程。从行为推断满意度,不靠 👍👎。
参数质量、风险预判、上下文利用。操作执行前评估合理性。
重试监控、自适应评分、工具选择准确性。实时跟踪行为质量。
验证分析、接受度推断、结果利用度。形成 Agent 质量画像。
12 种信号自动检测 + 中文纠错语义分析 — 用户删代码、打断、改输出,系统都懂。
本地调试、框架嵌入、Dashboard 服务、OpenClaw 原生插件 — 同一套 Guard 内核,四种入口。
零代码验证工具调用。本地快速试 Risk 分数、Schema 拦截、审计查询。
一行接入 LangChain / CrewAI / 自研框架。execute() 自动走完整 6 Gate 流水线。
独立服务部署,REST 化 pipeline/审计/反馈。内置 Dashboard — 概览、7 日趋势、工具热力图、事故复盘。
框架层自动拦截工具调用 — D1-D5 智能审批、42 条可配置规则热加载、Circuit Breaker 熔断、episodic 记忆注入。
框架无关 · 增量接入 · 5 分钟增强你的 Agent
npx sentinel-agentos server