AIDC
← 返回全部动态
arXiv 机器学习AI 评分 72/10009月25日 12:00

面向机制可解释性的流递归模型(SRM)

该研究针对机制可解释性技术难以随大语言模型规模与深度扩展的问题,提出了一种新型架构——流递归模型(SRM)。SRM 是对分层推理模型(HRM)的改进,通过将计算过程组织为多个相互交互的潜在流,在保持模型可扩展性的同时暴露其内部计算结构。该工作旨在通过设计天然具备可解释性结构的小型模型,为验证和理解模型内部行为提供新的探索路径。

推荐理由提出了一种面向机制可解释性的新型模型架构,通过多潜在流交互设计探索可扩展与透明性并存的路径。

原标题:Stream Recursion Model (SRM)

阅读 arXiv 机器学习 原文 ↗