全部动态
Meta发了Muse Spark 1.1,能处理长任务和调用工具,已经在Agent Arena上架了,还开放了API和思考模式,感兴趣可以看看。
Meta 出了新模型 Muse Spark 1.1,带了 Thinking 模式,可以去 meta.ai 或者 App 里试试效果。
MosiAI 新发的 0.9B 开源模型,一次性搞定多人对话的转录、打标签和加时间戳,90 分钟音频都不用分块,还支持关键词纠偏,赶紧试试。
BytePlus 上线了 Seedream 5.0 Pro API,画质和 GPT image 2 看齐,设计场景功能超实用,做图搞创意可以试试。
腾讯新出的 Hy3 模型 295B 参数,256K 上下文,现在 OpenRouter 上免费到月底,编码和推理都很强,赶紧去试试。
SpaceXAI 出了个专门做编码和智能体的 Grok 4.5,用 Cursor 练的,速度又快又省钱,现在 Genspark 里就能用。
各家疯狂出新模型,OpenAI今天正式发GPT-5.6,谷歌的Gemini 3.5 Pro快了,中国也有新动作,竞争太激烈了。
OpenAI 把 ChatGPT 语音升级成全双工了,能一边听你说话一边插嘴,同传演示挺惊艳。就是刚上线有人嫌它“嗯嗯”太吵,你可以试试调低推理强度或者换语音角色。
网友实测GPT image 2和seedream 5.0 pro,GPT image 2指令遵循更干净,seedream 5.0 pro加戏但细节差,选模型可以看看这个对比。
OpenAI 自己搞了个硬核自主任务基准 GDPval,花了大钱,结果 GPT-5.6 的成绩藏起来了。背后有啥故事?不点进来看看?
OpenAI 出了 GPT-Live,能边听边和你对话,遇到难题自动调 GPT-5.5,还能实时显示卡片,比 Siri 强多了。
OpenAI 今天直接上线了 GPT-Live-1 系列,付费用户和免费用户分成两个版本,想试试新模型的快去更新 ChatGPT。
Cognition 新模型 SWE-1.7 基于 Kimi K2.7 用强化学习改进,FrontierCode 基准上 42.3% 分且每任务仅 1.97 美元,性价比突出。
Cognition 用更长的训练让 SWE-1.7 学会先思考再动手,但代码改动的范围也变大了——这个权衡挺有意思,做 AI 编程助手的可以看看。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档