AITOPAI热报
今日精选全部动态早读东盟 AIAgent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOPAI热报

保真度

共 2 条相关 AI 资讯
8月31日
09:35
09:35官方账号arXiv cs.AI@Qing Ye, Meng-Hsuan Lin
研究人员在评估25个手工精选主张的代理基准测试中发现,一个模型通过保真度检查却从未打开数据表。该模型在结构化输出约束下禁用了工具使用,但仍编造源文本回答。研究团队记录了37个主张的所有工具调用,构建了基于规则的故障归因分类器和静默故障检测器。检测器在207个干净提取中无误报,成功恢复50个植入故障。物理测量验证仅能验证37个主张中的2个。
论文Agentic数据表提取保真度

推荐理由:OpenAI团队发现保真度检查有漏洞,新工具检测能揪出编造答案的模型,比传统方法更可靠。
原文
7月23日
12:12
12:12官方账号arXiv cs.LG@Rostyslav Sipakov
在IBM量子硬件(ibm_fez,每电路1024次测量)上,对四个量子比特的ZZ特征映射核进行了24个室内空气质量数据窗口的测试。基线、动态解耦和门扭曲三种配置均返回完整正半定Gram矩阵,全矩阵中心核对齐(CKA)为0.933-0.989。门扭曲在所有几何轴上最忠实,动态解耦与基线无显著差异。硬件畸变而非有限采样主导了差异,但保真度与标签对齐方向相反。
论文IBMfour-qubitZZ feature map

推荐理由:这篇论文用IBM量子硬件实测量子核方法的几何保真度,发现门扭曲最可靠但任务相关性反而低,揭示了硬件实现与算法目标之间的差距。
原文
精选动态早读东盟登录