看看三款模型画同一个星球差多远。GLM-5.2偏沙漠,Fugu Ultra带滑块,Fable 5最像地球。
Anthropic 的 Claude Fable 5 回来了,能从一句话就写出埃菲尔铁塔代码,一次成型不用改,写代码神器。
Anthropic 的 Claude Fable 5 在 3D 生成上又刷屏了,60 多项测试全拿下,效果比之前强很多,值得一看。
Fable 5又回Arena了,还加了Agent模式,想自己动手测测看?直接去Battle Mode里玩,官方排名马上出。
用户实测发现 Claude Fable 5 能自己认出该用倾向评分匹配做留存分析,写文档改代码都更聪明了,省心很多。
用Claude Fable 5做的交易机器人,42天赚28.9万美元,日赚6878美元,胜率56%,初始5.4万变34.3万。核心是吃短期定价偏差。
看看3年前AI视频生成的水平,比同期好不少,现在进步更大,值得回味。
Anthropic的Claude模型爆出内部对话,原来它想问题时在喊"DATA! GO! GRRR!",像原始人一样。不是幻觉,是它真实的思考过程。
Fable 5和Codex联手,两天搞定AI SDK 7升级,额度还够用,挺省心的。
有人让Claude Fable不断把游戏改得更华丽,结果它一路升级画面、Boss战和音效,直到撑爆WebGL,挺有意思。
别光盯着大模型,Qwen 27b 免费开源又好用,工程团队实测都说香。
GLM-5.2 现在可以直接在 Claude Code 里选了,不用折腾部署,开源模型也能用上大厂一样的开发流程。
OpenAI 下周可能发 GPT-5.6,配额更宽松,专门抢 Claude 用户。同时 Gemini 3.5 Pro 也跳票到 7 月 17 日。想了解前沿模型动态的可以关注。
GitHub Copilot 现在能选 Kimi K2.7 Code 了,开源权重、低成本、性能强,写代码更灵活。
Anthropic的模型又升级了,一口气通过了60多项3D生成和世界构建测试,挺能打的。
机器人终于能听懂'把那个东西放好'这种模糊话了。MIT的Masked IRL用LLM先理清意图再干活,挺实用。
OpenAI 的新模型可能很快就要来了,代码里已经出现了三个新名字,看看是不是 GPT-5.6 的前奏。
Claude Fable 5 能把蜘蛛侠荡网变成可玩的 Godot 游戏,而且比 GPT-5.5 少出不少错,做游戏可以试试它。
AISI用更高的token预算测试模型,发现性能远超标准评测——8%的任务需要千万级token才能解决,前沿模型能力被低估了。
阿图因AI挖到了一个Mythos没发现的curl漏洞,但它是Agent,Mythos是模型,各有所长。
AI/ML API 实测了 Sonnet 5 和 Fable 5 做3D地球生成,Sonnet省87%钱但只有线框,Fable效果惊艳但贵。选模型前先看这对比。
Seedance 2.0 能把写满细节的提示词变成15秒的日常视频,连DV那种晃动感都模仿到位,比很多AI视频更自然。
想看这两个模型写代码的差距?Fable 5多花7倍钱,但画出的地球像真的,Sonnet 5的就像个线框球。
阿里和蚂蚁团队搞了个优化,Qwen3-Omni实时对话延迟从6秒降到0.6秒,吞吐还翻了5倍多,推荐看技术博客。
Claude Fable 5新版被砍了,调试分从86掉到26,重构分从73掉到38,你该看看这个评测。
Mollick发现,AI在创意推理这类没法打分任务上的进步比想象中大,前沿没那么崎岖。
Claude Fable 5 太强了,随便一句设计埃菲尔铁塔,它就能一次生成代码,值得试试其他模糊提示。
FABLE 5 能一次生成整款《我的世界》,不用分步调,代码能力太强了。
Claude Fable 5限制取消后,网友用它整出了10个离谱操作,快去围观
Epoch AI数据显示,Claude Mythos预览版让漏洞发现量狂飙3.5倍,AI挖洞能力被实锤了。
GPT-4霸榜352天,o1只撑了98天,看看到底谁才是真强者。
Epoch AI 搞了个新基准 EBR-bench,专门看 AI 能不能边玩边学,结果 Earthborne Rangers 这游戏 AI 完全没进步,挺有意思的。
字节开源了PAR蛋白生成模型,有400M和60M参数,Apache 2.0协议,支持多尺度结构生成,做生物计算的可以试试。
给个提示词就自动做出带动画和音效的整段视频,省掉剪辑烦恼,Claude Fable 5 这波操作太顶了
有个狠人用Claude Fable 5花了5小时就搞出一个完整的水墨风Roguelike游戏《墨守》。美术音乐Boss全自动,还能自我测试,太顶了。
Google 发了两个新 Gemini 媒体模型,Nano Banana 2 Lite 生成图片只要 4 秒,1 美元能买 30 张;Omni Flash 按秒收费 0.1 美元,适合实时处理。
Anthropic给Fable 5加了安全防护,结果调试能力暴跌70%,编程任务动不动就回退到Opus 4.8,相当于花高价用低配。
Arena开始让大家测Claude Fable 5了,有Battle和Agent两种模式,你还能投票影响排名,快去试试。
想看看 Claude 新模型和其他比谁强?去排行榜看一眼就知道大概位置了。
Fable 5 重部署后各维度表现稳定,Agent 依旧最强,前端小幅波动属正常。想看前沿模型对比可以关注。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。