10:29官方账号arXiv cs.AI@Ilya Mikhelson这篇论文提出了Socratic Test的自动化计算机中介对话式评估框架,整合动态评估原则、多模态工作区、Bloom分类学实时监考和SOLO分类学结构评估。传统静态评估依赖减法扣分制,而面对面口试会引入表现焦虑和学术权力失衡等无关变量。Socratic Test通过渐进化支架量化最近发展区(ZPD),并采用非补偿性加法评分架构,优先衡量掌握程度而非惩罚错误。论文Socratic Test动态评估多模态推荐理由:这篇论文给考试设计开了个新脑洞:用多模态对话和动态评估测认知边界,比传统考试更看重进步而不是扣分。原文稍后读已读值得跟进有用关注 Socratic Test
03:56官方账号Perplexity@perplexity_aiWANDR不再使用预定义的黄金解决方案来评分,而是动态重新抓取每个引用的页面。它逐条核对每个声明与引证证据的一致性。这种方法适用于需要处理随时间变化事实的任务。AI模型WANDRPerplexity AI事实验证推荐理由:Perplexity AI 搞了个新评估方式 WANDR,不用固定答案打分,而是实时对证据,适合处理时效性事实。原文稍后读已读值得跟进有用关注 WANDR