最终对比:MAPPO / HATT v2 / HATT v3 / PCFA

Small-scale(4 UAV + 8 UGV + 10 任务,full_random)
方法 success reward length completion sent% 来源
HATT v3.1b-fixed 1.000 +29.37 440.8 1.000 1.000 v31-fixed
HATT v2.0 1.000 +18.17 481.8 1.000 1.000 v31-fixed
MAPPO 1.000 -13.08 523.5 1.000 1.000 v31-fixed
PCFA -356.50 0.375 0.219 pcfa-eval
说明:HATT v3.1b-fixed、HATT v2.0、MAPPO 均来自同一 sweep(runs/20260628-1043_macf_hatt-v31-fixed-small-scale)的 best checkpoint,保证可比性。PCFA 来自 runs/20260628-1608_macf_pcfa-small-scale-eval 的 TB events 均值,未记录 success/length。
---
Mid-scale(10 UAV + 20 UGV + 25 任务,full_random)
方法 success reward length completion sent% 来源
HATT v2.0 1.000 +44.72 474.5 1.000 1.000 mid-260626
MAPPO 0.875 -204.81 766.6 0.986 0.985 mid-260626
说明:mid-scale 目前只跑了 HATT v2.0 和 MAPPO。HATT v3.x 尚未在 mid-scale 验证。
---
跨规模对比:HATT v2.0 vs MAPPO
规模 方法 success reward length
rowspan="2">Small(4/8/10) HATT v2.0 1.000 +18.17 481.8
MAPPO 1.000 -13.08 523.5
rowspan="2">Mid(10/20/25) HATT v2.0 1.000 +44.72 474.5
MAPPO 0.875 -204.81 766.6

核心结论