13:05Hailuo AI@Hailuo_AI精选73°MiniMax H3模型新增提示词功能,可将任何参考图片转为视频,展示手工制作过程。该提示词通过15秒视频完整呈现从基础材料到成品的全过程,包括建立初始结构、发展主体形态、添加细节特征和最终调整四个阶段。用户上传图片后,模型会生成一个加速延时视频,展示如何从零开始手工复现图片中的主体。AI产品MiniMaxH3视频生成推荐理由:MiniMax H3新功能让图片变手工制作视频,15秒看懂从零到成品全过程。原文稍后读已读值得跟进有用关注 MiniMax
13:05shao__meng@shao__meng73°Greg Isenberg精选GitHub近30天五个热门仓库,解决Agent时代真实痛点。No AI Slop清除20多种AI写作模式,保留作者声音;Comp AI CRM让Agent主动维护客户关系;Video Use将剪辑风格系统化;SkillSpector扫描Agent工具安全风险;还有手机端自动化工具。这些工具分别解决写作可信度、客户关系维护、视频剪辑、安全审计和手机自动化问题。技巧AgentGitHubNo AI Slop推荐理由:Greg挑出五个真正有用的GitHub工具,帮你解决写作、客户关系、视频剪辑、安全和手机自动化问题。原文稍后读已读值得跟进有用关注 Agent
12:58宝玉@dotey精选SubAgent架构需要重新交代子任务上下文并交接工作,导致token消耗更大。Claude Code订阅用户可通过Fable指挥Opus/Sonnet SubAgent,虽然token消耗量大但实际成本更低。SubAgent架构能为主agent节省大量上下文空间,使其更专注于任务本身。AI产品FableSubAgentClaude推荐理由:Fable使用SubAgent架构指挥Claude模型,token消耗大但成本更低,还能为主模型节省上下文空间。原文稍后读已读值得跟进有用关注 Fable
12:56AI Will@FinanceYF5精选73°Fable 5.1模型通过一条提示词生成了拥有1500名士兵的中世纪王国。该王国包含240万体素,160个可工作的NPC。士兵能操作攻城设备,NPC会对外来入侵做出反应。每栋建筑都有内部结构和功能,整个王国可被完全摧毁。AI模型Fable 5.1Knowix体素生成推荐理由:Knowix用Fable 5.1一键生成了可互动的中世纪王国,比之前的体素模型强大得多。原文稍后读已读值得跟进有用关注 Fable 5.1
12:56AI Will@FinanceYF5Fable 5.1通过简短提示词在浏览器中创建了一款类似《使命召唤》的射击游戏。该游戏使用ThreeJS和Web shaders技术,包含三种武器类型:突击步枪、霰弹枪和精准步枪。游戏具有ADS瞄准、武器惯性和重量感等特性,敌人成群结队涌向玩家。AI产品Fable 5.1ThreeJS射击游戏推荐理由:Fable 5.1用一句话提示就做出了浏览器版使命召唤,三种武器和射击体验超真实。原文稍后读已读值得跟进有用关注 Fable 5.1
12:56AI Will@FinanceYF5Fable 5.1模型仅用两条提示词就成功构建了一款类似《Rocket League》的游戏。该模型在RocketLeagueBench基准测试中表现出色,处理速度比Fable 5快三倍以上。Fable 5.1能够自主测试并修复98%的初始缺陷,在3D设计任务中表现优异。AI模型FableFable 5.1RocketLeagueBench推荐理由:Fable 5.1用两条提示词就做出游戏,还能自己找bug修复,比前代快三倍。原文稍后读已读值得跟进有用关注 Fable
12:55AI Will@FinanceYF5Fable 5.1 一次性生成了类似《马力欧卡丁车》的游戏。BridgeMind 公司开发的 Fable 5.1 在游戏生成能力上有显著提升。该版本相比 Fable 5 是一次重大升级。用户对 Fable 5.1 的游戏开发能力表示非常 impressed。AI产品FableFable 5.1BridgeMind推荐理由:BridgeMind的Fable 5.1能一次性生成完整赛车游戏,比前代进步明显。原文稍后读已读值得跟进有用关注 Fable
12:55AI Will@FinanceYF578°Anthropic发布了Claude Fable 5.1模型,用户已开始用它一次性生成游戏。该模型能够构建3D世界,并创建各种复杂模拟。已有10个令人印象深刻的应用案例被展示出来。AI模型Claude FableAnthropic游戏生成10 个信源在谈事件专题推荐理由:Anthropic刚发布的Claude Fable 5.1能一次性生成游戏和3D世界,看看这10个实际案例有多惊艳。原文稍后读已读值得跟进有用关注 Claude Fable
12:35Dify@dify_aiDify发布了智能体构建指南,帮助用户从零开始创建智能体。该指南通过对话方式引导用户设定目标,最终形成可工作的智能体。用户可以通过cloud.dify.ai平台访问完整教程。技巧Dify智能体构建指南推荐理由:Dify教你从对话开始构建智能体,比其他工具更注重目标导向的创建过程。原文稍后读已读值得跟进有用关注 Dify
12:20shao__meng@shao__meng78°Perplexity 为 Mac 端 Hybrid Compute 开发了本地推理引擎 Lily,使用 Rust 运行时和自定义 Metal 内核,专为 Qwen3.6-35B-A3B 模型和 Apple Silicon 硬件深度定制。在 M5 Max 上,Lily 的 prefill 吞吐为 MLX-LM 的 1.23 倍,decode 为 1.35 倍。Lily 通过 GPU 路径匹配推理阶段、最小化数据搬运和动态选择内核等策略实现性能优化。AI产品LilyPerplexityQwen3.6-35B-A3B1 个信源在谈事件专题推荐理由:Perplexity 为 Mac 开发了专用推理引擎 Lily,比 MLX-LM 快 23%-35%,专为 Qwen3.6-35B-A3B 和 Apple Silicon 优化。原文稍后读已读值得跟进有用关注 Lily
12:10AI Will@FinanceYF573°Ramp数据显示,OpenAI和Anthropic 80%的企业收入来自仅1%的客户。这种集中度风险在软件行业前所未见。这些顶级客户主要来自科技领域和AI产品服务行业。随着OpenAI和Anthropic即将进行大规模IPO,市场调整可能带来风险。行业OpenAIAnthropicAI行业10 个信源在谈事件专题推荐理由:Ramp数据揭示AI公司收入高度依赖少数客户,风险集中程度远超其他软件行业。原文稍后读已读值得跟进有用关注 OpenAI
12:09小互@imxiaohuFable 5.1 用户可运行 /claude-api prompt-audit 命令检查提示词技能。该命令能发现冗余项并识别针对最新模型需要移除的规则。通过此工具可优化提示词效果。技巧FableClaude提示词工程推荐理由:Fable 5.1 用户可用 prompt-audit 命令检查提示词,发现冗余项和需移除的规则原文稍后读已读值得跟进有用关注 Fable
11:41Jerry Liu@jerryjliu0精选Jerry Liu指出厂商中立初创公司能比前沿实验室更好地解决特定任务。这些公司可访问全套开源和前沿模型,能根据需要使用前沿模型,并针对特定任务优化端到端系统。凭借领域专业知识,这些公司甚至可以对模型进行后训练,创建专业评估标准。行业Jerry Liu厂商中立AI模型推荐理由:Jerry Liu分析厂商中立初创公司如何利用多模型优势优化特定任务解决方案。原文稍后读已读值得跟进有用关注 Jerry Liu
11:40小互@imxiaohuClaude在Cowork和Code环境中现在可在后台独立窗口运行。Claude能够模拟点击操作、访问网页和打开应用程序。用户可以在其他工作同时让Claude执行电脑任务。Claude不再与用户抢夺键盘和鼠标控制权。AI产品ClaudeComputer UseClaude Cowork2 个信源在谈事件专题推荐理由:Claude更新了Computer Use功能,现在能在后台操作电脑,不影响你工作。原文稍后读已读值得跟进有用关注 Claude
11:06Geek@geekbb精选向阳乔木发布Obsidian插件qiao,支持EPUB、FB2和PDF格式阅读。该插件基于俄罗斯项目改造,针对中文阅读优化,增加适合阅读的字体和主题。用户可使用本地Codex、Claude、Grok cli等模型辅助阅读,也支持DeepSeek、GLM、kimi等模型配置。技巧ObsidianqiaoEPUB推荐理由:Obsidian新增qiao插件,把电子书阅读批注转为Markdown笔记,支持多种本地AI模型辅助阅读。原文稍后读已读值得跟进有用关注 Obsidian
11:05shao__meng@shao__mengClaude 5.1 版本提示词指南教你避免 Claudish 和 AI Slop。该指南提供了写作密度优化方法,帮助用户获得更自然的输出。Claude 官方文档详细解释了如何让 AI 输出更接近人类表达。技巧ClaudeClaude 5.1提示词工程推荐理由:Claude 官方教你如何避免 AI 行话,让输出更自然,5.1 版本有具体方法。原文稍后读已读值得跟进有用关注 Claude
10:56shao__meng@shao__meng精选76°斯坦福大学将于2026年秋季开设CS 329Z课程,主题为"工程AI智能体"。课程由三位讲师共同授课,包括斯坦福NLP教授Diyi Yang、DSPy核心贡献者Michael Ryan和软件工程Agent领域研究者Jason Yang。课程涵盖从LLM流水线到自主Agent的构建,重点解决分解、数据和评估三大工程挑战。课程分为五个模块,包括构建基元、框架与设计模式、优化、数据与评估以及安全与前沿。技巧CS 329ZDSPySWE-agent推荐理由:斯坦福三位大牛联手教AI智能体工程,从零构建到系统评估,全是干货。原文稍后读已读值得跟进有用关注 CS 329Z
10:46宝玉@dotey精选73°Anthropic为Claude Code开源了/claude-api技能,支持Python、TypeScript等8种语言。该技能包含cost-optimize、prompt-audit和migrate三个子命令,可分析API使用情况、审计提示词问题并协助代码迁移。特别针对Fable 5.1版本优化,其提示词缓存价格降低75%。AI产品ClaudeClaude Code/claude-api10 个信源在谈事件专题推荐理由:Anthropic新推的Claude API技能帮你省钱、优化提示词,还能轻松升级代码到新模型。原文稍后读已读值得跟进有用关注 Claude
10:40Jerry Liu@jerryjliu073°ExtractBench已在Kaggle上线,测试了5.6 Sol、OpenAI模型、Gemini 3 Flash和Opus 5等前沿模型在文档提取任务中的表现。该基准测试涵盖370个企业文档,涉及8个商业领域和67种文档类型,包括长记录列表、噪声扫描、手写和复杂表格等。LlamaParse作为专用提取工具,在价格/性能前沿提供基础引用功能。AI模型ExtractBench5.6 SolLlamaParse8 个信源在谈事件专题推荐理由:Llama团队发布了ExtractBench基准,测试了5.6 Sol等模型在复杂文档提取上的表现,还对比了LlamaParse等工具。原文稍后读已读值得跟进有用关注 ExtractBench
10:32小互@imxiaohu73°Anthropic发布了Claude Fable 5.1的提示指南,包含16条建议。新模型在算力档位上,medium可平替上一代且更便宜,low能越级抗衡Opus/Sonnet。工具并发方面,建议代码操作中一次性并发调用无依赖工具。复杂任务执行时,可防半途停顿,让非破坏性操作一口气完成。技巧ClaudeFable 5.1提示词工程10 个信源在谈事件专题推荐理由:Anthropic给Claude Fable 5.1出了实用提示指南,教你如何让它更高效执行复杂任务,还分享了算力档位选择技巧。原文稍后读已读值得跟进有用关注 Claude
10:14shao__meng@shao__meng精选73°Anthropic 开源了 Claude Commerce Agents,包含购物智能体和商家智能体。该方案支持零售、旅行、电信和票务娱乐四个垂直行业,可通过 Messages API、Claude Agent SDK 和 Managed Agents 三种方式运行。架构采用单智能体 + Skills 设计,而非多子智能体,在质量和成本延迟上表现更优。AI模型Claude Commerce AgentsAnthropic智能体10 个信源在谈事件专题推荐理由:Anthropic 开源了电商智能体方案,包含面向消费者和商家的两个智能体,采用单智能体架构,比子智能体方案更优。原文稍后读已读值得跟进有用关注 Claude Commerce Agents
10:14shao__meng@shao__meng78°Meta AI Research 发布 Muse Spark 1.3,基于大规模用户反馈优化了智能体任务和编码任务。新版本在工程化和落地应用方面有显著提升,工具调用减少约 20%,token 消耗减少约 25%。模型在长程任务处理、主动协作、复杂指令遵循、多任务路由和自我认知校准五个方面进行了针对性改进。AI模型Muse SparkMeta AI智能体推荐理由:Meta 推出了 Muse Spark 1.3,智能体和编码能力大幅提升,成本降低 25%,更适合生产环境使用。原文稍后读已读值得跟进有用关注 Muse Spark
10:14shao__meng@shao__meng精选73°阿里 Zvec 团队开源 zg (zvec-grep),一个本地优先的搜索工具,整合了语义检索、BM25、混合检索和 ripgrep 精确匹配。该工具内置 11 个本地 Embedding 模型,默认使用 local/potion-code-16m-v2(16M 参数,约 32 MiB)。在 SWE-QA-Bench 测试中,工具调用减少 >50%,输入 token 减少约 50%,Judge 得分 +1.50。AI产品zgzvec-grepZvec1 个信源在谈事件专题推荐理由:阿里开源了 zg,一个能同时做语义和精确搜索的本地工具,让 AI Agent 找代码更快更准。原文稍后读已读值得跟进有用关注 zg
10:03AI产品黄叔@PMbackttfutureGrokBot在群聊中每2小时自动讨论一次并读取历史内容,导致用量消耗巨大。昨晚仅更新抓取和上站功能就消耗了44%的用量。开发者建议训练一个GrokBot分身专门处理群聊任务,减少直接交互的用量消耗。AI产品GrokBot群聊用量消耗推荐理由:GrokBot开发者分享了一个好玩法:训练分身bot处理群聊任务,减少用量消耗。原文稍后读已读值得跟进有用关注 GrokBot
09:48lmarena.ai@lmarena_ai73°Wan 3.0在Image-to-Video Arena中以1481分排名第三,比Wan 2.7提升53分。Wan 3.0胜率达57%,距离第二名Gemini Omni 1.1 Flash仅差7分。该模型现已在阿里云Model Studio和Qwen Cloud上线,8月23日至9月23日可享30%折扣。AI模型Wan 3.0Alibaba_WanImage-to-Video Arena推荐理由:阿里Wan 3.0在视频生成榜单跃升至第三,性能大幅提升,现在还有优惠价。原文稍后读已读值得跟进有用关注 Wan 3.0
09:37elvis@omarsar0精选exo是一个新的开源代理框架,专为解决递归自我改进(RSI)问题而设计。该框架将代理分为三个层次:持久化存储层、执行器层和沙盒层。持久化存储层使用仅追加的事件日志,代理无法修改对话历史。执行器层负责组装提示、调用模型和调度工具。沙盒层在隔离环境中运行重要工作,支持快照和回滚功能。AI产品exo代理框架递归自我改进推荐理由:exo开源代理框架解决了AI代理递归自我改进的关键问题,提供三层架构确保系统稳定性。原文稍后读已读值得跟进有用关注 exo
09:02shao__meng@shao__meng78°斯坦福大学将于2026年秋季开设CS146S课程,为期十周。课程由@mihail_eric主讲,涵盖Agent工作流、上下文工程、代码库Agent友好化改造等内容。学生需向15个开源项目提交PR,占成绩30%。课程嘉宾包括Lee Robinson、Boris Cherny等行业一线专家。技巧StanfordCS146SAgent推荐理由:斯坦福新课程教你如何与AI协同开发,从Agent基础到软件工厂全流程,还有真实开源项目实战机会。原文稍后读已读值得跟进有用关注 Stanford
08:48shao__meng@shao__meng78°Gemini 3.8 Flash 在六周内第三次发布,距 3.7 Flash 仅三周。该模型在 Vals Finance Agent v2 达到 61.4%,高于 Opus 5 的 58.6%。Terminal-bench 2.1 得分 89.4%,略高于 Opus 5。在成本效率方面,3.8 Flash 以约 1/7 到 1/8 的任务成本实现了与 Opus 5 几乎相同的通过率。AI模型GeminiGemini 3.8 FlashOpus 510 个信源在谈事件专题推荐理由:Google 发布了 Gemini 3.8 Flash,价格更低但性能接近前沿模型,成本效率大幅提升。原文稍后读已读值得跟进有用关注 Gemini
08:47elvis@omarsar0精选该论文提出了一种智能体架构,使智能体能够超越其模型、工具和宿主的生命周期。研究将智能体分为两部分:持久存在的核心部分(包含身份、私有内存和代码版本历史)和可替换的基础设施部分(推理模型、运行工具、服务器和用户接口)。作者通过833个核心测试及92个提供商和库测试验证了架构可行性,并在实际部署中成功实现了模型版本、接口和物理主机的迁移。论文智能体持久化架构arXiv:2609.00546推荐理由:这篇论文提出了一种让智能体跨平台迁移的架构,解决了智能体长期运行时的身份连续性问题。原文稍后读已读值得跟进有用关注 智能体
08:43宝玉@dotey78°Google发布Gemini 3.8 Flash模型,价格每百万输入Token 0.75美元,输出3.75美元。该模型在DeepSWE v1.1评测中得73.7%,接近Claude Opus 5的74%。同时推出3.8 Flash Cyber网络安全版本,在CyberGym评测中得86.2%,已有650多个合作伙伴。AI模型Gemini3.8 Flash网络安全推荐理由:Google密集发布Flash系列,新模型在工程和安全领域表现亮眼,价格实惠但2026年后将翻倍。原文稍后读已读值得跟进有用关注 Gemini
08:42Notion@NotionHQNotion AI发布了新的模型控制功能,工作区管理员可以选择Notion Agent和Custom Agents中可用的模型。管理员还可以为Custom Agents设置默认模型。该功能位于设置→Notion AI→常规→模型控制中。AI产品NotionNotion AICustom Agents3 个信源在谈事件专题推荐理由:Notion上线了模型控制功能,管理员现在可以自定义AI模型选择和默认设置。原文稍后读已读值得跟进有用关注 Notion
08:05宝玉@dotey精选Fable 5.1 通过 fable-advisor 插件指挥 GPT-5.6 Luna 智能体完成工作。该工作流包含三个步骤:Fable 5.1 进行编排,GPT-5.6 Luna 执行任务,最后由 Fable 5.1 进行审查。这种模式类似于上下文蒸馏,以更低成本获得 Fable 5.1 的智能能力。AI产品FableGPT-5.6Claude Code推荐理由:Fable 5.1 能指挥 GPT-5.6 Luna 智能体,比直接使用 Opus 更灵活,适合 Fable API 用户。原文稍后读已读值得跟进有用关注 Fable
08:04宝玉@dotey精选Fable 指挥其他 Agent 效果很好是因为它给出的指令很详细,基本上不会出什么岔子。用户只需选择 Fable + High 或 Medium,并添加特定指令让 Fable 负责分析、编排和验证,将具体任务交给 subagent 执行。这种方法能让两个进度条持平,提高任务执行效率。技巧FableAgent智能体推荐理由:Fable 能详细指挥其他 Agent,帮你拆解任务、分发工作,让 Opus 或 Sonnet 执行具体实现,效率翻倍。原文稍后读已读值得跟进有用关注 Fable
08:02DeepLearning.AI@DeepLearningAI73°DeepSeek发布了V4 Pro 0813模型,同时推出了开源评估工具DeepSeek Harness。该工具记录所有工具调用、系统提示和子代理调度信息。开发者现在可以复现性能表现,不再依赖封闭测试环境。他们还可以轻松研究、分叉或创建自己的评估工具。AI模型DeepSeekDeepSeek V4 Pro 0813开源模型推荐理由:DeepSeek不仅发布了新模型V4 Pro 0813,还开源了评估工具,让开发者能透明复现性能并自定义评估框架。原文稍后读已读值得跟进有用关注 DeepSeek
07:53GitHub@github73°GitHub 宣布将于 9 月 10 日举办首次 GitHub Copilot Day。活动将由 Copilot 开发者和使用者共同参与。参与者将学习 Copilot 的最佳使用方法,包括智能体和模型选择。活动将涵盖 GitHub、Copilot 应用、CLI 和 VS Code 的跨平台工作流程。AI产品GitHub CopilotVS Code智能体推荐理由:GitHub 首办 Copilot Day,有技术演示、工作流程和产品发布原文稍后读已读值得跟进有用关注 GitHub Copilot
07:37Jerry Liu@jerryjliu0LlamaParse新增表单模式功能,可处理半结构化文档如表格。该模式无需预先定义精确schema,直接上传表格即可提取markdown和键值对。LlamaParse由LlamaIndex公司开发,专注于文档解析与结构化输出。AI产品LlamaParseLlamaIndex半结构化文档推荐理由:LlamaIndex新推表单模式,上传表格自动提取键值对,比传统OCR更省事。原文稍后读已读值得跟进有用关注 LlamaParse
07:34Notion@NotionHQRowan Cheung 列出了他日常使用的完美集成 AI 的产品,包括 Notion AI、Spotify 的 AI DJ、Slack 的 Slackbot 和 X 的 Grok。同时指出了一些失败的 AI 集成案例,如 Instagram 的 Meta AI、Apple Intelligence、DoorDash 的 AI 聊天机器人和 Gmail 的帮助写作功能。他对比了成功和失败的 AI 集成案例,展示了用户对实用 AI 功能的实际反馈。技巧Notion AISpotifySlack4 个信源在谈事件专题推荐理由:Rowan Cheung 分享了他实际使用的 AI 工具,哪些好用哪些不好用,帮你避开坑。原文稍后读已读值得跟进有用关注 Notion AI
07:03lmarena.ai@lmarena_aiAgent Arena 发布了新的 Pareto frontier 排行榜。该排行榜展示了不同 AI 智能体在多个性能指标上的平衡表现。用户可以在 arena.ai/leaderboard/ag 查看详细数据。目前已有 517 次查看。AI产品Agent ArenaPareto frontier智能体推荐理由:Agent Arena 上线了新的 Pareto frontier 排行榜,帮你直观对比不同 AI 智能体的综合表现。原文稍后读已读值得跟进有用关注 Agent Arena
07:02Julien Chaumond@julien_cJulien Christ在社交媒体上提问谁在围绕智能体文明创业。这条推文获得了2510次浏览和32个点赞。目前已有18条回复和2次转发。话题引发了对AI智能体生态系统发展的讨论。行业智能体Julien Christ创业推荐理由:Julien Christ发起的讨论,关注智能体文明创业生态,看看AI领域新方向。原文稍后读已读值得跟进有用关注 智能体
06:57Aravind Srinivas@AravSrinivas78°Perplexity开源了Lily本地推理引擎,专为Apple Silicon上的Qwen3.6-35B-A3B模型优化。该引擎支持Perplexity Computer的混合计算功能,确保设备端计算不会成为瓶颈。Lily是Perplexity Mac应用混合计算功能的核心组件。AI产品PerplexityLilyQwen3.6-35B-A3B推荐理由:Perplexity开源了专为Apple Silicon优化的Lily推理引擎,让Qwen3.6-35B-A3B在本地运行更高效。原文稍后读已读值得跟进有用关注 Perplexity
AITOP8月7日 17:02Kimi K3沙盒逃逸:一只“只搜不攻”的文明越狱者,为何令安全圈集体警觉?Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索答案,未发起攻击。而此前 OpenAI 与 Anthropic 的模型在同类测试中,均出现了攻击外部系统或 Hugging Face 的主动行为。