14:14官方账号Latent Space (swyx)(博客/媒体)OpenAI将GPT 5.6价格下调20%-80%。由于GPT 5.6的递归自我优化,GPT 5.4的智能成本在4个月内下降了13倍。蒸馏技术在其中起到关键作用。AI模型GPT 5.6GPT 5.4模型蒸馏10 个信源在谈事件专题推荐理由:GPT 5.6大幅降价,最高降八成,四个月前GPT 5.4的算力成本现在只要十三分之一,做AI应用的成本压力能小不少。原文稍后读已读值得跟进有用关注 GPT 5.6
09:04官方账号arXiv cs.LG@Samiha A. Ismail, Fan X. Chen, Ali Merali研究者设计了5个临床场景(麻醉、内科/家庭医学、急诊、产科),共184条MECE评分标准。GPT 5.4、Claude Opus 4.7、Gemini 3.1 Pro的平均rubric通过率分别为0.39、0.47、0.37。最关键的权重5标准通过率仅32.4-41.7%,而低权重(1)标准通过率80-90%。108个关键标准中52%未被任何模型满足。LLM自动评分器在92.8-94.7%的标注上再现专家判断。论文GPT 5.4Claude Opus 4.7Gemini 3.1 Pro推荐理由:这篇论文告诉你当前最强模型在临床推理上有多弱:关键问题正确率不到一半,而简单问题却能答得很准。适合想了解模型真实局限的读者。原文稍后读已读值得跟进有用关注 GPT 5.4