全部动态

AI 相关资讯全量信息流 · 90 条
5月15日
5月14日
论文多源确认精选75°13:27
30 Token 提示词让 12 个 LLM 停止推荐赞助内容

这篇论文揭示了 LLM 推荐中的赞助偏见,并提供了一个极简的对抗方法——用 30 token 提示词就能大幅降低推荐偏差。做 AI 安全、推荐系统或 LLM 应用的开发者值得一看,可以直接复现实验。

事件专题
arXiv: OpenAI@Andreas Maier 等 5 人10 个信源在谈原文
论文精选13:27
人格模型崩溃:微调导致大模型角色分化失控

做AI安全和对齐的研究者、模型微调工程师值得关注——这项研究用两个量化指标揭示了有害微调如何让模型角色扮演能力崩溃,比单纯看输出内容更早发现问题。建议点开看看指标计算方法。

arXiv: DeepSeek@Davi Bastos Costa, Renato Vicente原文
5月13日
5月12日
5月11日