Nathan Lambert
Yichuan Wang团队在TorchTitan RL和vLLM上为Gated DeltaNet实现了训练与推理的逐位精确匹配,并提出了异步RL中该匹配是否有效的问题
AI 摘要
Yichuan Wang团队在TorchTitan RL和vLLM上为Gated DeltaNet实现了训练与推理的逐位精确匹配,并提出了异步RL中该匹配是否有效的问题。
推荐理由常规快讯,保留列表
原文
Yichuan Wang: Zero Train–Inference Mismatch — now for linear attention, and under async RL 🎯
We got bitwise-exact trainer/generator parity for Gated DeltaNet (Qwen3.5-9B / 35B-A3B) on TorchTitan RL + vLLM, then asked the question nobody had actually tested in open source: does it help async
64/100
讨论
暂无评论。