2026-09-16

模型优化与训练技术

大模型训练技术持续创新,Meta提出字节级蒸馏突破Token建模瓶颈,清华团队深耕On-Policy Distillation揭示数据与算法平衡,Token级奖励提升长链路Agent训练成功率,Graph Engineering支撑多智能体系统演进,为模型轻量化提供新路径。