WORM-LIKE × R-STDP
7×7 Snake 神经系统实验
固定一次训练结果 · 8 个未见测试种子 · 每次 10,000 动作
跨测试种子表现
食物 − 碰撞;越高越好。圆点表示每个测试种子。
完整指标
均值 ± 样本标准差;前三项单位为每 10,000 动作。
| 模型 | 进食 | 碰撞 ↓ | 净收益 | 平均蛇长 | 最大蛇长 |
|---|
训练后运行回放
三个 checkpoint 从同一测试环境开始;各模型随后独立运行。
WORM-LIKE × R-STDP
固定一次训练结果 · 8 个未见测试种子 · 每次 10,000 动作
食物 − 碰撞;越高越好。圆点表示每个测试种子。
均值 ± 样本标准差;前三项单位为每 10,000 动作。
| 模型 | 进食 | 碰撞 ↓ | 净收益 | 平均蛇长 | 最大蛇长 |
|---|
三个 checkpoint 从同一测试环境开始;各模型随后独立运行。