Harness · 智能体行为准则框架

面向智能体的行为理念与准则框架——先有行为底线,再谈能力边界。合规规则、检查技能、审计报告,各居其位——每个节点都在治理生态中贡献自己的经验。ComplianceHub 在其中专注规则的结构化与可执行化。

治理落地:生态中有多个节点,各司其职

行为框架的价值在落地。围绕这套闭环,我们构建了多层次的工具与载体:规则引擎负责判定、合规检查技能负责扫描、审计报告负责输出——每个节点都有自己的储备和角色。SkillHub 是技能分发渠道,MCP Server 是运行时接口,SDK 是内化能力——各条路径互为补充,开发者按需选择。

内生化与外部调用不冲突,是同一套框架的两种消费模式:Agent 既可以将准则内化为出厂能力,也可以在运行态按需调用外部合规服务。

理念层
每一个 Agent 都该内化的行为准则
行为底线可执行伦理可溯源责任Dogfooding 正循环
治理层
单 Agent 行为边界的工程实现
规则引擎行为护栏审计追踪人机协作对齐评估
基础设施层
多 Agent 互操作与规模化
身份认证MCP / 协议Agent 通信插件生态生态审计
通过多重渠道触达 Agent: SkillHub MCP Server 插件市场 SDK / API 开源框架
🧠规则引擎
🛡行为护栏
📋审计追踪
🎯对齐评估
🤝人机协作
反馈闭环

治理层:单 Agent 行为边界

🧠

规则引擎

已落地

法规 → Trigger / Constraint / Severity 结构化约束。Skill:pipl-compliance / pipl-audit

🛡

行为护栏

已有

运行时硬边界:输入过滤、输出校验、能力限制。Skill:pipl-guard / pipl-selfcheck

📋

审计追踪

规划中

不可篡改的决策记录链。Skill:pipl-trail

🤝

人机协作

已有

分级授权:自动 / 确认 / 人工介入。Skill:支付确认流

🎯

对齐评估

规划中

对抗测试、边界穿越检测。Skill:pipl-redteam

基础设施层:多 Agent 互操作与规模化

单个 Agent 的行为准则靠治理层;100 个 Agent 如何安全协作,需要基础设施层——身份认证、协议标准、通信安全、插件生态、全局审计。

🔐

Agent 身份认证

探索中

Agent 不是人。谁在调用?有什么权限?需要一个适配智能体生态的身份体系:Agent ID、能力凭证、授权令牌。

已有:SkillHub 商户体系 + 支付签名验证,初步验证了 Agent-to-Service 身份模型。
🔗

MCP / 协议标准

探索中

Agent 与外部工具之间的标准通信协议。没有标准,每个 Agent × 每个工具 = N×M 集成噩梦。

已有:ComplianceHub API(支付、查询、回调)已实践 Agent-to-Service 协议设计。
🤝

Agent 间通信

探索中

多 Agent 协作——传递上下文、委派子任务、共享结果——需要协议、格式、安全边界。

已有:Codex Agent spawn/send/wait 机制,工程层面已跑通多 Agent 协作。
🛠

插件生态

探索中

Skill 只是插件形态之一。MCP Server、IDE 扩展、云函数——统一的发布、审核、分发、计费。

已有:SkillHub 审核 + 微信支付 + 版本管理,已验证"发布→分发→付费"闭环。
📊

生态合规与审计

探索中

100 个 Agent 的全局合规态势——跨 Agent 数据流向、权限传递、聚合审计日志。

探索:pipl-trail(单 Agent 审计)+ 跨 Agent 关联分析。

三层如何贯穿?

理念层定义"为什么":智能体必须有行为底线、合规必须是可执行的而非模糊的道德、每一次决策必须可溯源。这是 ComplianceHub 存在的根本理由。

治理层实现"怎么做":理念层的主张落地为工程系统——规则引擎定义边界、行为护栏执行拦截、审计追踪记录决策、人机协作提供兜底、对齐评估持续验证。

基础设施层支撑"规模化":当一个 Agent 变成一百个,治理层的方法论需要基础设施来承载——身份认证、协议标准、通信安全、插件分发、全局审计。

三层共同的交付媒介:理念通过治理层工程化 → 治理层通过基础设施层规模化 → 最终通过 SkillHub、MCP Server、SDK 等多渠道触达每一个 Agent。同一套准则,两种消费模式:想内生的 Agent 把框架编译进自己的行为逻辑;想外调的 Agent 通过 API 实时查询合规判定。内生化与外部调用不对立——框架足够扎实,自然两种模式都能支撑。

当前落地:规则引擎(治理层基座)

15已标注规则
6高严重度
8中严重度
1低严重度
需授权 ×6需评估 ×11需记录 ×10需通知 ×4禁止 ×5
全部 高严重度 中严重度 低严重度
法律全国人大常委会
触发条件处理个人信息;向境外提供个人信息;进行自动化决策
约束类型需授权需评估需记录需通知
法律全国人大常委会
触发条件处理数据;重要数据出境;数据安全事件
约束类型需评估需记录禁止
法律全国人大常委会
触发条件网络运营者收集使用个人信息;网络安全事件
约束类型需记录需评估需通知
部门规章工业和信息化部
触发条件电信业务经营者收集使用用户个人信息
约束类型需授权需通知
行政法规国务院
触发条件电信业务经营许可与监管
约束类型需记录需评估
部门规章国家互联网信息办公室等四部门
触发条件App采集使用个人信息
约束类型需授权禁止
部门规章国家互联网信息办公室等四部门
触发条件App申请用户权限;收集个人信息
约束类型禁止
部门规章工业和信息化部
触发条件工信领域数据处理活动
约束类型需评估需记录
行业标准中国人民银行
触发条件金融业机构处理个人金融信息
约束类型需授权需评估需记录禁止
行业标准中国人民银行
触发条件金融数据分类分级管理
约束类型需评估需记录
部门规章中国银保监会
触发条件银行业金融机构数据治理
约束类型需记录需评估
行政法规国务院
触发条件征信业务;采集、使用信用信息
约束类型需授权禁止
行业标准中国证监会
触发条件证券期货经营机构数据资产管理
约束类型需评估需记录
行业标准全国信息安全标准化技术委员会
触发条件个人信息收集、存储、使用、共享、转让、公开披露
约束类型需授权需评估需记录需通知
部门规章国家互联网信息办公室
触发条件向境外提供重要数据或个人信息
约束类型需评估

上述规则引擎与行为护栏,已沉淀为可直接调用的检查与审计工具,通过 SkillHub、API 等多渠道开放,供智能体在运行态接入。持续为治理闭环提供可操作的工程支撑。