Add preliminary final submission package
面向 openEuler 的自适应资源管控 Agent。文档更新时间:2026-07-27;当前进入最终交付收口阶段,代码、证据、Web Console、用户手册和答辩材料按 SP4 主验证 + SP3 强制兼容矩阵收口。
2026-07-27
EulerPilot 不是单一调度器 demo,而是一套围绕“观测 -> 决策 -> 执行 -> 反馈 -> 证据”的系统级 Agent 框架。项目使用 eBPF/PSI 感知 workload 和系统压力,在用户态完成分类、策略决策和 Skill 编排,并通过 cgroup v2、sched_ext/scx、TC/XDP、BPF LSM 等系统控制器完成可审计、可回滚的资源管控。
cgroup v2
sched_ext/scx
192.168.1.123:/root/EulerPilot
192.168.1.121:/root/EulerPilot
192.168.1.122
CONFIG_SCHED_CLASS_EXT
29/29 P0 + 100 smoke + 5 doctor-safe
10/10
reports/final_evidence_compact.md/json
42
0
collect_final_evidence.py --validate-release
tested_code_commit
artifact_id
web_console/
https://github.com/shibuchou/EulerPilot
https://gitlink.org.cn/HxQj0tp0pG/mxoedzsyzygka
docs/demo_video_recording_script.md
docs/demo_video_5min_script.md
docs/答辩提交材料/项目演示视频.mp4
主运行闭环:Workload -> Kernel Observation -> Runtime/Analyzer -> PsiGate/Policy Engine -> Skill Manager -> Kernel Execution -> Workload。实线表示运行时数据流、决策流和执行反馈,虚线表示能力检测、安全约束和验证关系。
cgroup v2 是当前稳定资源治理主路径;sched_ext/scx 是比赛核心增强调度路径;Network、Security 和 Resource Control 均通过统一 Skill Framework 管理。
这张简图只展示运行时 Agent 主逻辑:业务负载经过内核观测进入 Agent Core,由 PsiGate 与 Policy Engine 完成自适应决策,再通过统一 Skill Manager 编排 Resource Control、Scheduling、Network 和 Security 四类执行能力,最终作用到内核执行面并反馈到业务负载。
横切安全、事务与恢复层用于说明 Capability Detection、Ownership Guard、Transaction、Verify、Rollback 和 Audit 是执行前、执行中、失败后的共同保障,不是独立业务流程。
可编辑图源和流程图:
docs/assets/architecture/eulerpilot_main_architecture.drawio
docs/assets/architecture/eulerpilot_main_architecture.spec.yaml
docs/assets/architecture/eulerpilot_main_architecture.arch.json
docs/assets/architecture/eulerpilot_simplified_architecture.drawio
docs/assets/architecture/eulerpilot_simplified_architecture.spec.yaml
docs/assets/architecture/eulerpilot_simplified_architecture.arch.json
docs/assets/eulerpilot_architecture_detailed.drawio
docs/assets/eulerpilot_architecture_detailed.mmd
docs/assets/eulerpilot_closed_loop_flow.mmd
docs/system_design.md
--list-skills
--doctor-skills
agent/
configs/
docs/architecture.md
docs/final_results_summary.md
docs/sp4_validation_plan.md
target_ref
cpu.weight/cpu.max
docs/resource_control_skill.md
docs/network_policy_skill.md
docs/network_pod_veth_target.md
docs/security_policy_skill.md
transaction_id
docs/policy_engine_skill.md
web_console/README.md
docs/web_console_design.md
构建 Agent:
make agent
常用只读命令:
./build/eulerpilot-agent --validate-config configs/agent.yaml ./build/eulerpilot-agent --list-skills ./build/eulerpilot-agent --status --json ./build/eulerpilot-agent --doctor-safe --config configs/agent.yaml
--list-skills 用于查看已注册 Skill;--status --json 输出 Agent 与 Skill 的只读状态快照;--doctor-safe 严格只读,不创建 cgroup,不加载 BPF/TC/XDP/LSM,不做 live probe。
--status --json
--doctor-safe
启动一次 dry-run 观测:
./build/eulerpilot-agent --config configs/agent.yaml --duration-s 10 --interval-ms 1000
启用 active 模式需要明确知道会写入哪些控制器,建议只在 SP4/SP3 验证机或 lab cgroup 中执行:
sudo ./build/eulerpilot-agent --config configs/agent.yaml --backend cgroup_v2 --gate-mode always-active --active --duration-s 30
运行模式说明:
dry-run
agent.mode: dry-run
--active
active
cgroup_v2
--backend cgroup_v2
sched_ext
--backend sched_ext
always-active
--gate-mode always-active
psi
--gate-mode psi
NORMAL -> ARMED -> ACTIVE -> COOLDOWN -> NORMAL
normal
--gate-mode normal
dry-run 输出表格中的 mark 列含义:
mark
. observe + apply ~ manage - none L latency B background T batch
--status --json 会显式输出 cpuset_control=disabled。当前 release 的稳定资源执行路径是 cpu.weight/cpu.max + memory + io;动态 cpuset topology 作为后续增强能力保留,不计入封版性能主结论。
cpuset_control=disabled
cpu.weight/cpu.max + memory + io
当前 evidence compact 预览:
python3 scripts/collect_final_evidence.py
最终证据 release gate:
python3 scripts/collect_final_evidence.py --validate-release
最终质量门禁:
scripts/final_quality_gate.sh
Web Console 演示界面:
cd web_console npm ci npm run lint npm run test npm run build ./scripts/run_console.sh
说明:涉及 cgroup、BPF、TC/XDP、LSM、sched_ext 或 Kubernetes 的集成测试需要在 openEuler 验证机上以 root 权限运行;本地普通环境建议先跑构建、配置校验、单元测试和 evidence strict。
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/redis-scx-compare-runs10
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/nginx-scx-compare-runs10
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/throughput-first-runs10
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/mixed-adaptive-runs10
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/agent-overhead-runs10
results/k8s/sp4-validation-20260708-023552
results/policy_engine/security-network-resource-20260705-211407
reports/final_evidence_compact.md
reports/final_evidence_compact.json
reports/final_quality_gate_20260726-v6-sp4-final.log
reports/final_quality_gate_20260726-v6-sp3-final.log
reports/gates/sp3_capability_matrix_20260726-v6-final.json
建议按下面顺序阅读:
docs/one_page_summary.md
docs/progress_status.md
docs/final_evidence_index.md
docs/final_report_submission.md
docs/demo_final_runbook.md
docs/submission_checklist.md
重要设计文档:
docs/sp4_k8s_validation_plan.md
EulerPilot 的价值不是声称所有 workload 永远优于默认调度器,而是证明:
版权所有:中国计算机学会技术支持:开源发展技术委员会 京ICP备13000930号-9 京公网安备 11010802047560号
EulerPilot
EulerPilot 不是单一调度器 demo,而是一套围绕“观测 -> 决策 -> 执行 -> 反馈 -> 证据”的系统级 Agent 框架。项目使用 eBPF/PSI 感知 workload 和系统压力,在用户态完成分类、策略决策和 Skill 编排,并通过
cgroup v2、sched_ext/scx、TC/XDP、BPF LSM 等系统控制器完成可审计、可回滚的资源管控。当前最强状态
192.168.1.123:/root/EulerPilot,openEuler 24.03 LTS SP4192.168.1.121:/root/EulerPilot,openEuler 24.03 LTS SP3,验证比赛要求的发行环境兼容、cgroup v2 主闭环、安全扩展 smoke、rollback 与 sched_ext graceful fallback192.168.1.122仅保留为历史 OLK/sched_ext 对照,不作为最终 release 来源sched_ext/scx基于 SP4 官方源码自编译启用CONFIG_SCHED_CLASS_EXT的内核完成复核,不声称发行默认内核直接支持29/29 P0 + 100 smoke + 5 doctor-safe;SP3 compatibility final gate 已通过10/10reports/final_evidence_compact.md/json覆盖42条核心证据,缺失0、警告0;collect_final_evidence.py --validate-release已作为最终证据入口tested_code_commit与 formalartifact_id完成 Redis、Nginx、throughput-first、mixed-adaptive 和 Agent overhead 的 RUNS=10 套件;性能结论以 formal artifact 结果为准web_console/演示控制台已落地,集中展示 Agent 状态、Evidence、白名单 Demo、SSE 日志和单任务锁https://github.com/shibuchou/EulerPilot;GitLink:https://gitlink.org.cn/HxQj0tp0pG/mxoedzsyzygkadocs/demo_video_recording_script.md、docs/demo_video_5min_script.md和docs/答辩提交材料/项目演示视频.mp4架构总览
主运行闭环:Workload -> Kernel Observation -> Runtime/Analyzer -> PsiGate/Policy Engine -> Skill Manager -> Kernel Execution -> Workload。实线表示运行时数据流、决策流和执行反馈,虚线表示能力检测、安全约束和验证关系。
cgroup v2是当前稳定资源治理主路径;sched_ext/scx是比赛核心增强调度路径;Network、Security 和 Resource Control 均通过统一 Skill Framework 管理。运行时流程简图
这张简图只展示运行时 Agent 主逻辑:业务负载经过内核观测进入 Agent Core,由 PsiGate 与 Policy Engine 完成自适应决策,再通过统一 Skill Manager 编排 Resource Control、Scheduling、Network 和 Security 四类执行能力,最终作用到内核执行面并反馈到业务负载。
横切安全、事务与恢复层用于说明 Capability Detection、Ownership Guard、Transaction、Verify、Rollback 和 Audit 是执行前、执行中、失败后的共同保障,不是独立业务流程。
可编辑图源和流程图:
docs/assets/architecture/eulerpilot_main_architecture.drawiodocs/assets/architecture/eulerpilot_main_architecture.spec.yamldocs/assets/architecture/eulerpilot_main_architecture.arch.jsondocs/assets/architecture/eulerpilot_simplified_architecture.drawiodocs/assets/architecture/eulerpilot_simplified_architecture.spec.yamldocs/assets/architecture/eulerpilot_simplified_architecture.arch.jsondocs/assets/eulerpilot_architecture_detailed.drawiodocs/assets/eulerpilot_architecture_detailed.mmddocs/assets/eulerpilot_closed_loop_flow.mmddocs/system_design.md功能模块
--list-skills、--doctor-skills、status JSONagent/、configs/、docs/architecture.mddocs/final_results_summary.md、docs/sp4_validation_plan.mdtarget_ref,container/Pod cgroup 解析,事务写入和 rollback;封版默认使用cpu.weight/cpu.max,cpuset 为安全关闭的实验开关docs/resource_control_skill.mddocs/network_policy_skill.md、docs/network_pod_veth_target.mddocs/security_policy_skill.mdtransaction_id,失败回滚docs/policy_engine_skill.mdweb_console/README.md、docs/web_console_design.md主 Agent 使用
构建 Agent:
常用只读命令:
--list-skills用于查看已注册 Skill;--status --json输出 Agent 与 Skill 的只读状态快照;--doctor-safe严格只读,不创建 cgroup,不加载 BPF/TC/XDP/LSM,不做 live probe。启动一次 dry-run 观测:
启用 active 模式需要明确知道会写入哪些控制器,建议只在 SP4/SP3 验证机或 lab cgroup 中执行:
运行模式说明:
dry-runagent.mode: dry-run或不加--activeactive--activecgroup_v2backend--backend cgroup_v2sched_extbackend--backend sched_extCONFIG_SCHED_CLASS_EXT的内核和 formal scx artifact。always-activegate--gate-mode always-activepsigate--gate-mode psiNORMAL -> ARMED -> ACTIVE -> COOLDOWN -> NORMAL。normalgate--gate-mode normaldry-run 输出表格中的
mark列含义:--status --json会显式输出cpuset_control=disabled。当前 release 的稳定资源执行路径是cpu.weight/cpu.max + memory + io;动态 cpuset topology 作为后续增强能力保留,不计入封版性能主结论。快速验证
当前 evidence compact 预览:
最终证据 release gate:
最终质量门禁:
Web Console 演示界面:
说明:涉及 cgroup、BPF、TC/XDP、LSM、sched_ext 或 Kubernetes 的集成测试需要在 openEuler 验证机上以 root 权限运行;本地普通环境建议先跑构建、配置校验、单元测试和 evidence strict。
核心结果
/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/redis-scx-compare-runs10/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/nginx-scx-compare-runs10/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/throughput-first-runs10/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/mixed-adaptive-runs10/root/eulerpilot-runs/7a99d87048f4f2040377354bfe0ce21401664642/formal-experiments/20260726-162050/agent-overhead-runs10results/k8s/sp4-validation-20260708-023552results/policy_engine/security-network-resource-20260705-211407reports/final_evidence_compact.md、reports/final_evidence_compact.jsonreports/final_quality_gate_20260726-v6-sp4-final.logreports/final_quality_gate_20260726-v6-sp3-final.log、reports/gates/sp3_capability_matrix_20260726-v6-final.json文档导航
建议按下面顺序阅读:
docs/one_page_summary.md:一页式项目简介。docs/progress_status.md:滚动进度状态,以 SP4/123、SP3/121 强制兼容矩阵和 42 条 evidence 为当前口径。docs/final_evidence_index.md:最终证据索引。docs/final_report_submission.md:最终报告主稿。docs/architecture.md:系统架构和模块边界。docs/system_design.md:图源、流程图和环境口径。docs/demo_final_runbook.md:答辩现场演示流程。docs/submission_checklist.md:最终提交检查表。重要设计文档:
docs/resource_control_skill.mddocs/network_policy_skill.mddocs/security_policy_skill.mddocs/policy_engine_skill.mddocs/web_console_design.mddocs/sp4_validation_plan.mddocs/sp4_k8s_validation_plan.md结论边界
EulerPilot 的价值不是声称所有 workload 永远优于默认调度器,而是证明: