AITOPAI热报
今日精选全部动态早读东盟 AIAgent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOPAI热报

Qwen3.5-27B

共 2 条相关 AI 资讯
8月5日
11:58
11:58官方账号arXiv cs.LG@Chuanhao Yan, Xuhan Huang, Yawen Duan, Zhenfei Yin, Hang Zhao, Bryan Dai, Jie Fu
论文提出稀疏权重分解(SWD),将预训练模型的每个权重矩阵分解为两个稀疏因子,中间坐标作为可寻址电路单元。SWD不需要训练替代网络,在单矩阵替换实验中以不到基线1%的数据量达到与Transcoder等持平的保真度。在GPT-2、Qwen2.5和Qwen3.5-27B上,SWD用更少的读写边和选中单元达到相同电路充分性与必要性目标。SWD还支持微调后全模型替换,并提供零数据变体用于逐步机制可解释性分析。
论文SWDTranscoderGPT-2

推荐理由:SWD用不到1%数据就能达到Transcoder的保真,GPT-2、Qwen2.5都能跑。
原文
7月10日
09:57
09:57官方账号arXiv cs.AI@Yifan Wu, Lizhu Zhang, Yuhang Zhou, Mingyi Wang, Bo Peng, Serena Li, Xiangjun Fan, Zhuokai Zhao
研究提出行为状态衰减概念,指长时任务中决策相关信息被淹没在轨迹中。一个独立的记忆智能体与行动智能体并行运行,更新结构化的记忆库并选择性注入提醒。在Terminal-Bench 2.0和τ²-Bench上,该方法将pass@1分别提升8.3和6.8个百分点。消融实验表明选择性干预优于被动暴露或持续注入。作为开放权重记忆策略的初步工作,在SETA上使用SFT和GRPO训练Qwen3.5-27B,提升验证奖励并部分迁移到Terminal-Bench。
论文Proactive Memory AgentTerminal-Benchτ²-Bench

推荐理由:长时任务里AI老忘事?这篇提出主动记忆智能体,随跑随记关键信息,在Terminal-Bench上提升8.3pp,比被动记忆好用多了。
原文
精选动态早读东盟登录