Runtime / Governance / Tool Use
面向真实审计交付的 Agent 控制台
每个任务都会形成协议化任务包,记录规划、工具调用、产物、安全门禁和反思;系统会读取评测、运行时、记忆与失败信号,生成下一轮可验证优化。
0
运行任务
0
工具调用
0%
工具成功率
0ms
平均耗时
0
阻断任务
Runtime Governance
运行治理与自进化队列
把运行失败、评测退化、工具调用和人工复核信号沉淀成可执行优化队列;提案可一键转为 AgentRuntime 任务,进入审计交付闭环。
运行成熟度
0
综合运行时信号、评测回归、记忆状态与风险治理
0
治理通道
0
Benchmark Backlog
0
优化提案
优化提案
一键转任务Benchmark Backlog
可进入评测查看运行控制平面默认折叠,避免主界面过载
控制平面
Observe → ShipHarness 候选档案
0 个候选每个候选只允许修改一个声明过的表面;锁定评测器、双数据集无回归与人工审批共同决定是否可以推广。
经验候选
0 条经验失败与弱项只能沉淀为候选经验;通过组件评测和人工批准后,才会匹配到后续同类任务。
Trace-driven AgentOps
Agent 质量诊断与发布证据
把 Agent 架构、RAG、Tool/MCP、评测、Memory 和生产化要求落到真实运行数据,用可回放轨迹解释系统决策与发布风险。
发布证据成熟度
0
等待诊断
0
能力维度
0
Badcase 信号
0
生产化检查
查看 Badcase / Tool / RAG 诊断细节用于回答错召、漏召、工具失败和发布门禁追问
Badcase
Tool Use
Production
Agent Runtime
创建审计 Agent 任务后,系统会自动规划范围、控制映射、取证、研究、抽样、例外分级和整改步骤,并持久化运行轨迹。
暂无选中任务。
Skill Registry
MCP Tools
面向工具协议的描述层,包含 inputSchema、权限注解、超时、缓存和熔断信息。
执行结果与日志
所有自动化动作都应可追踪、可解释、可复盘。