01:43OpenRouter@OpenRouterAIOpenRouter 发布了 Ori TUI、Ori Harness 和 Ori Eval 三个工具的最新更新。这些工具位于 openrouter.ai/docs/guides/or 页面。Ori 系列工具为开发者提供了新的功能特性。技巧OpenRouterOri TUIOri Harness推荐理由:OpenRouter 更新了 Ori 系列工具,新增功能在官方文档有详细说明。原文稍后读已读值得跟进有用关注 OpenRouter
17:45OpenRouter@OpenRouterAIOpenRouter 在推特上为旗下模型评估工具 Ori Eval 征求开发者反馈,可私信 @jjacky。该工具的目标是帮开发者从 openrouter.ai/ori/eval 页面找到当前最合适的模型。目前这条推文已有 294 次查看,但暂无评论和转发。AI产品OpenRouterOri Eval模型评估推荐理由:OpenRouter 想继续打磨 Ori Eval,所以跑来问开发者要啥。你要是为选模型发愁,可以去他们的评估页试试。原文稍后读已读值得跟进有用关注 OpenRouter
10:08Geek@geekbbOpenRouter发布Ori Eval,用于在真实项目中评估模型表现。Ori Eval通过OpenRouter API对代码库各任务运行测试并给出评分。用户可通过curl命令获取该工具,例如从openrouter.ai下载。Ori Eval强调没有绝对最好的模型,只有最适合某个任务的模型。AI产品OpenRouterOri Eval模型评测1 个信源在谈事件专题推荐理由:OpenRouter出了个Ori Eval,能拿你项目的真实任务给模型打分,谁分高用谁,选模型不用瞎猜了。原文稍后读已读值得跟进有用关注 OpenRouter
00:28OpenRouter@OpenRouterAIOri Eval 允许用户用自然语言描述 bug,并自动生成一个能证明该 bug 存在的失败 eval。修复 agent 后,该 eval 转为通过并保留在测试套件中,持续验证修复效果。用户可以将 Ori Eval 集成到 GitHub Actions,确保回归问题不会进入生产环境。AI产品Ori EvalGitHub Actions测试生成推荐理由:它能把一句 bug 描述变成自动测试,先失败后通过,挂到 CI 里就能挡住回归,挺省心的。原文稍后读已读值得跟进有用关注 Ori Eval
00:27OpenRouter@OpenRouterAIOpenRouter 发布 Ori Eval,一款用于模型选型的评估工具。开发者只需在编码智能体中执行 curl -fsSL openrouter.ai/skills/spawn-o… 命令,即可按指引启动评估流程。Ori Eval 会自动对比候选模型在具体任务上的输出质量,给出可量化的对比结果。目前该工具已开放使用,相关说明见 openrouter.ai/ori/eval。AI产品OpenRouterOri Eval模型评估1 个信源在谈事件专题推荐理由:OpenRouter 新出的 Ori Eval 能让你的 coding agent 自动跑模型评测,哪个模型最适合你的项目,跑一下就知道。原文稍后读已读值得跟进有用关注 OpenRouter
00:26OpenRouter@OpenRouterAIOpenRouter 发布 Ori Eval,简化编写首个模型评估的流程。它利用 OpenRouter API 对代码库中的每个任务运行测试并评估结果,官方提供 curl -fsSL openrouter.ai/skills/spawn-o… 命令快速上手。Ori Eval 强调没有万能模型,只有最适合特定任务的模型。AI产品Ori EvalOpenRouter模型评估1 个信源在谈事件专题推荐理由:OpenRouter 出了个 Ori Eval,用它的 API 就能针对你的代码任务跑模型对比,一条 curl 命令就上手,适合想挑模型的人。原文稍后读已读值得跟进有用关注 Ori Eval