事件专题 ·官方一手

JEV 与 GPT-6 Luna、Qwen3.8-27B 在政治学文本标注任务上的对比

论文在七项政治学复制研究上测试了 TypeSafe 推出的 JEV 模型与 LLM 的表现。结果显示 JEV 在多项任务上接近 GPT-6 Luna 和开源的 Qwen3.8-27B,但在 OpenAI 批量价格下没有成本优势。单次提问时 JEV 的概率校准优于 GPT-6 Luna,但不稳定地好于 Qwen3.8-27B。作者的结论是 JEV 的主要优势在于速度快和解析选择概率方便。

当前结论

有人测了 TypeSafe 那个号称便宜快的 JEV,结果在 OpenAI 批量价格下根本不省钱,校准也没明显赢 Qwen3.8-27B,想做文本标注的可以看看。

11 个信源31° AI 热度最后更新 2026/10/5 16:22:03

证据链

11 个信源
相关来源 2Simon Willison’s Weblog
查看原文
相关来源 10Clement Delangue
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。