AI快开门
发现AI的无限可能
首页
工具
模型
模型历史
模型排名
模型价格
话题
简报
搜索
首页
工具
模型
话题
简报
搜索
← 返回话题列表
#
Token奖励
相关话题
2026-09-16
模型优化与训练技术
大模型训练技术持续创新,Meta提出字节级蒸馏突破Token建模瓶颈,清华团队深耕On-Policy Distillation揭示数据与算法平衡,Token级奖励提升长链路Agent训练成功率,Graph Engineering支撑多智能体系统演进,为模型轻量化提供新路径。
模型蒸馏
OPD
训练技术
Token奖励
后训练