# 腾讯混元开源了端到端推测解码框架 AngelSpec，在 Hy3-A21B 上实现 1.98-2.40 倍端到端加速

- 来源：Tencent Hunyuan
- 发布时间：2026-07-29 20:43
- AIWatch 分数：74
- AIWatch 标记：当日精选
- AIWatch 链接：https://aiwatch.icu/events/evt_01kypzb46s7xtgx52y4y9dbaez
- 原文链接：https://x.com/TencentHunyuan/status/2082447023626944936

## 精选理由

高信息密度，值得细读

## AI 摘要

腾讯混元开源了端到端推测解码框架AngelSpec，支持训练和部署。在Hy3-A21B模型上，并发数4-64时，DFly实现1.98-2.40倍端到端加速，吞吐量比DFlash高10.5-11.8%。开发者可获取训练代码和drafter权重，便于复现和进一步研究。
核心观点：
1. AngelSpec在Hy3-A21B上实现1.98-2.40倍端到端加速（并发4-64）。
2. AngelSpec吞吐量比DFlash高10.5-11.8%。

## 正文

腾讯混元开源了端到端推测解码框架AngelSpec，支持训练和部署。在Hy3-A21B模型上，并发数4-64时，DFly实现1.98-2.40倍端到端加速，吞吐量比DFlash高10.5-11.8%。开发者可获取训练代码和drafter权重，便于复现和进一步研究。
核心观点：
1. AngelSpec在Hy3-A21B上实现1.98-2.40倍端到端加速（并发4-64）。
2. AngelSpec吞吐量比DFlash高10.5-11.8%。
