9月3日
12:16
12:16官方账号arXiv cs.AI@Yihang Chen, Yuxiang Chen, Yuxuan Huang, Meng Fang, Weilin Luo, Jun Wang
精选73°
该研究提出双层协调反射模型,将协调者与工作者的交互建模为双层协调博弈。研究分析了文本反思作为语义记忆状态上的随机运动,推导了有限时间上界,并证明了在特定条件下的下界。研究还引入了随机反思记忆上升(SRMA)算法,在500个SWE-bench实例上达到72.2%的解决率。
推荐理由:清华团队提出多智能体LLM系统的博弈论框架,新算法在SWE-bench上超越基准2.2个百分点。
9月1日
17:00
17:00官方一手pandaily@contact@pandaily.com (Pandaily)
精选
腾讯操作系统级AI助手Marvis于9月1日推出自定义模型功能。用户可接入Kimi、Zhipu GLM、DeepSeek和MiniMax等第三方模型。该功能还支持运行本地开源模型。模型设置可在多台设备间同步。

推荐理由:腾讯给Marvis加了自定义模型功能,现在能用Kimi、GLM这些第三方模型了,还能本地部署,跨设备同步。
8月11日
04:58
04:58Aravind Srinivas@AravSrinivas
Perplexity宣布其Agent API现已支持Kimi K3模型,由Moonshot AI开发。该模型独家托管在美国服务器上,面向开发者开放。用户可通过Perplexity开发者平台直接调用K3的能力。官方提供了试用链接,方便开发者快速体验。
推荐理由:Perplexity的API现在能直接用Kimi K3了,服务器在美国,想试玩K3的开发者可以去看看。
8月4日
7月29日
12:26
12:26官方一手歸藏(guizang.ai)@op7418
作者使用 Codepilot 的一条提示词,让 Grok 爬取 Twitter 信息、Kimi 生成网页、DeepSeek 撰写文案,并由 GLM 5.2 统筹。该 workflow 成功完成昨天 AI 热点事件统计,时效性与人工搜集相当,甚至补充了漏掉的信息。通过分模型调用,降低了昂贵模型的消耗。

推荐理由:想用最少的成本让不同模型干各自擅长的事?参考这个 workflow:Grok 爬推文、DeepSeek 写文案、Kimi 做网页、GLM 5.2 调度。
12:25
12:25官方一手歸藏(guizang.ai)@op7418
用户通过一句提示词,调用 Grok 进行 Twitter 热点事件信息爬取,Kimi 生成网页,DeepSeek 撰写文案。三个模型分工协作,完成了昨日 AI 热点事件的统计,结果与手动搜集高度一致,并补充了遗漏信息。展示了多模型组合工作流的实际效果。
推荐理由:用一句提示词让 Grok、Kimi、DeepSeek 各司其职,自动统计 Twitter 热点,省时又全面,适合想提升信息搜集效率的人。
7月28日
15:20
15:20AI Will@FinanceYF5
一条推特用户观点指出,Claude过去在“用起来舒服”方面是强项,但现在已被Grok和Kimi超越。该用户目前最喜欢Grok,并认为Kimi也不差。他观察到Anthropic和OpenAI正在降低RLHF的优先级,转而押注更容易规模化的RL方法。
事件专题

推荐理由:有个用户觉得Claude没以前好用了,现在更喜欢Grok和Kimi,还发现Anthropic和OpenAI都在押注RL而不是RLHF,挺有意思的观察。
12:03
12:03官方一手arXiv: DeepSeek@Bartol Bućan, Nikola Sočec, Sarah Isufi, Morena Granić, Luka Hobor, Agneza Krajna, Mihael Kovac, Mario Brcic
76°
该研究对GPT-5、Claude、Grok、Gemini、DeepSeek、Kimi、Qwen共7个主流模型进行了基于政治轴的可控性压力测试,使用12种意识形态角色提示和70个政治指南针项目,共收集63,700条回答。结果发现,上下文框架解释了经济和社会轴上约88%-93%的方差,而模型自身身份的影响不到3%。在威权提示下,不同模型在相同问题上表现出相似偏移。研究强调需要进行可操控性审计,报告分散性、对称性、饱和度和拒绝底线。数据集和代码已开源。
推荐理由:这篇论文用70道政治题+12种人格提示,测了GPT-5、Claude、Grok等7个模型,发现提示词比模型本身更能左右回答方向。想了解AI怎么被‘带节奏’的可以看看。
01:23
01:23官方账号Clement Delangue@ClementDelangue
月之暗面(Moonshot AI)在 HuggingFace 平台上传了名为 Kimi 的模型,推文获得 2741 次查看。该模型开源后迅速引发社区关注,但目前尚未公布具体版本号或基准测试成绩。HuggingFace CEO Clement Delangue 转发该链接,进一步提升了话题热度。
事件专题

推荐理由:月之暗面把 Kimi 模型放到 HuggingFace 上了,做中文 NLP 的可以直接拿来用,不用自己训。
7月23日
7月22日
7月21日
17:21
17:21AI Will@FinanceYF5
75°
34岁创始人杨植麟,清华本科+CMU博士,曾任职Meta AI和Google Brain。其博士论文工作XLNet累计被引超1万次,该技术脉络演进为Kimi K2模型的万亿参数MoE架构。这一技术路线被认为是Kimi在与美国模型竞争中获胜的关键因素之一。
事件专题

推荐理由:想知道Kimi K2的MoE架构从哪来的?原来源于创始人十年前的博士论文XLNet,技术传承很有意思。
7月20日
10:10
10:10官方一手pandaily@contact@pandaily.com (Pandaily)
73°
Moonshot AI 于 K3 模型发布仅三天后,因需求远超可用算力,暂停新消费者订阅。K3 发布获 Elon Musk 及硅谷好评。公司表示现有用户服务不受影响,但新用户加入需等待扩容完成。此次算力瓶颈凸显生成式 AI 模型规模化部署的硬件挑战。
事件专题

推荐理由:Moonshot AI 刚发 K3 就被用户挤爆了,算力跟不上只能暂停新订阅,看看这个国产模型怎么火的。
01:51