宝玉实测的省钱组合:贵的模型出方案,便宜的模型干活,再让贵模型自动验收,全程不用人工盯。Token 贵的都该看看这套闭环玩法。
全部动态
llama_index 团队开源的 DocJev 工具,能帮你快速分类或拆分文档,比 GPT-5.6 快 6 倍,准确率相当,适合处理大量文档。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
Datasette 发布了两个安全补丁版本,修复了 Claude Fable 5.1、GPT-5.6 和 GPT-6 Astra 等大模型审计发现的漏洞,对在公共网络上运行且混合了公开和私有表格的实例很重要。
Datasette 团队用 Claude Fable 5.1、GPT-5.6 Sol 和 GPT-6 Astra 审查了代码,修复了安全漏洞,公共网站用户需要升级。
花 1 美元订阅 Command Code,再用 Codex Router 转发给 Codex,就能用上 GPT-5.6 Luna 和 Grok 4.5,这操作可以学一下。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
这个流程很适合复杂任务:Fable 5 出方案、Codex 干活、Fable 5 把关,还讲了 /compact 省钱和省上下文的细节,挺实用。
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…
OpenAI 分享了两个超实用的 API 开关,GPT-5.6 Sol 在 ARC-AGI-3 上分数直接翻了三倍,token 还省了十二倍,搞推理优化的一定要看看。
作者做了两个PPT skill,经验很实在。他说Claude Opus做HTML比GPT好看,还对比了不同路线的优劣势,想省成本又出效果可以看看。
OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 上表现差是因为 API 设置没开对。改两个参数分数涨三倍,token 省六倍,学起来很实用。
Wang 分享了他用 GPT-5.6 Sol 解数学难题的完整工作流,你不需要是数学家也能跟着做,关键是那些提示词套路。
AWS把OpenAI GPT-5.6三个型号(Sol、Terra、Luna)搬到了Bedrock,能用提示缓存省钱,还能接Codex写代码,适合想用官方托管的人。