1. 移除训练阶段因 recompute 导致的重复数据;分析并解决每迭代末尾 batch 数据异常进入队列的问题。(预计 1 week) 2. 推理阶段区分 **快速模式** 与 **慢速模式**: - [ ] 慢速模式保持逐 token 生成,便于精细调试。(预计 2~3 weeks) - [ ] 快速模式在生成一批 token 或完成推理后批量传输可视化数据,尽量接近无可视化时的推理速度。(预计 2~3 weeks) 3. 支持更多可定制扰动模式,并引入更多扰动位置,便于灵活测试模型稳健性。(预计 4 weeks)