20:50Richard Socher@RichardSocherRichardSocher 发布了新型智能体模型,专注于准确性和响应时间。该模型在多项基准测试中表现出色,处理速度比前代产品提升 40%。该模型特别适合需要快速响应和精确结果的智能体应用场景。AI模型RichardSocher智能体准确率推荐理由:RichardSocher 新发布的智能体模型,在准确性和速度上都有显著提升,适合需要快速响应的智能体应用。原文稍后读已读值得跟进有用关注 RichardSocher
10:22官方账号arXiv cs.AI@Sheng Liang, Yongyue Zhang, Nathanael Brian, Hang Lv, Hao Wang, Chen Zhang, Yong Liu精选AsymSpec提出了一种非对称的推测解码框架,通过轻量级起草者和大型验证者的协同工作,在保持验证稳定性和高起草接受率的同时,实现了推理加速。在四个智能体能力和两个端到端智能体基准测试中,AsymSpec的平均准确率达到了全上下文准确率的90%,同时实现了1.3-1.7倍的吞吐量提升和0.2-0.3倍的计算成本降低。论文AsymSpec推测解码智能体推荐理由:AsymSpec通过非对称上下文访问,实现了推理加速,准确率高达90%,计算成本降低,值得一看。原文稍后读已读值得跟进有用关注 AsymSpec
17:41官方账号Together AI@togethercompute72°rox_ai构建了自主搜索代理,在生产环境运行超过6个月。该代理达到了91.3%的准确率,每次查询成本仅为1.03美分。Together AI为其提供了推理算力支持。这展示了强推理经济学带来的效率提升。AI产品rox_aiTogether AI搜索代理推荐理由:rox_ai用Together AI做的搜索代理,准确率91.3%,每次才1分钱,效率真高!原文稍后读已读值得跟进有用关注 rox_ai
05:17OpenRouter@OpenRouterAIOpenRouter的实验显示,调整推理努力(reasoning effort)对成本的影响远大于调整细节(detail)。细节变化可使准确率波动2到17个百分点,但几乎不改变成本。而限制推理努力能削减50%到75%的成本,准确率仅变动1到2个百分点(在噪声范围内)。这说明优化推理努力是控制成本的关键。技巧OpenRouter推理模型成本控制推荐理由:OpenRouter实测数据告诉你,想省钱只要调低推理努力,准确率几乎不掉,但成本能砍一半以上。原文稍后读已读值得跟进有用关注 OpenRouter