大模型开始自己「打草稿」:NCP把猜后文塞进模型内部
2026-09-14 20:39:17
币界网消息,OneMillion_AI报道,上海AI Lab和上海交大发布了89亿参数模型ncp-archpreview。该模型不仅训练「猜下一个token」,还会预测后面一小段对应的内部概念信号,以辅助token生成。通过这种方式,模型内部能够提前猜测后文,提升了生成效率。在四项测试中,大模型每验证一次,平均能通过的token从5.933个提升至6.180个,提升幅度为4.17%在humaneval测试中提升7.59%。接入这套信号后,草稿模型仅增加约4万参数,且ncp使用普通transformer的训练计算量约为85%,就能将训练误差降至接近相同水平。
利好 0
利空 0
来源:互联网
本内容只为提供市场信息,不构成投资建议。