全部动态
Inherent新推Faraday智能体,小模型大能力,强化学习助其超越GPT-5.5与Claude Opus 4.8,值得关注。
特斯拉FSD不支持中国,DeepSeek周末统一低谷价,成都铁路局回应占座事件,雷军携小米折叠新机,Anthropic计划IPO,OPPO暂停小屏手机项目,苹果上架Bellroy邮差包,iPhone 18 Pro手机壳曝光,世界人形机器人运动会开幕,微软Win11默认启用时光机,印度少年为iPhone威胁父母跳崖身亡,小米首款RGB-Mini LED电视开启盲订,雷军川渝续航挑战第一,豆包输入法鸿蒙版尝鲜,宝马新世代i3续航超1000公里,小米miclaw结束封测,特斯拉回应召回,漫威《复仇者联盟4》重映,小米调研洗鞋机,荣耀机器人破百米记录,OpenAI下调GPT-5.6 Sol模型价格。这些资讯都是最新的,值得关注。
OpenAI推出GPT-5.6 Sol后,收入增长显著,企业收入增长强劲,首次在商业API支出方面领先Anthropic,值得关注。
开源开发者有了新基准,Qwen3.8-27B横扫消费级硬件,比肩GPT-5.6 Luna和DeepSeek V4 Flash,参数量27亿,4位量化后适配24GB GPU,超越它才是新标准!
Promptwatch 发现 ChatGPT 搜索里 site: 运算符的使用比例从 0.5% 暴增到 17%,这和 GPT-5.6 的更新有关,还发现它现在不怎么用 Reddit 了。
AWS 在 Bedrock 上为 OpenAI GPT-5.6 模型增加了跨区域推理,能提升全球请求的吞吐量,适合需要低延迟和高可用性的开发者。
阿里刚发了 Qwen-UI-Agent,能直接操作手机电脑屏幕,移动端比 GPT-5.6 Sol 高 12 个点,还能在真实手机上跑任务,以后帮你自动查地址、订高铁、整理文件应该更靠谱了。
Codex 的 GPT-5.6 Sol 百万上下文现在 ChatGPT 账号也能开了,不用 API 密钥,Plus/Pro 用户手动配置就能处理大项目,但注意额度烧得快。
西蒙威利森今天做了个叫CORS Chat的小工具,能通过网页界面测试LM Studio和OpenRouter的聊天接口,还支持流式SVG渲染,挺实用。
Moonshot AI 出了个新测试 PerceptionBench,专门查 AI 的“眼神”。结果最强模型 GPT-5.6 Sol 准确率也不到 60%,而且很多错是从看图时就错了。
一个神经外科医生借 GPT-5.6 证明了 Crouzeix 猜想,数学家集体震惊。完整提示词和代码都开源了,可以看看。
这篇把6月以来中国AI密集发模型的节奏和全球企业采购逻辑说清楚了,还给了DeepSeek比Claude便宜39倍的实测成本对比。
OpenAI 给最强模型 GPT-5.6 Sol 上了个超快模式,每秒能出 750 个词元,比原来快 14 倍,适合客服、金融这些要抢时间的活儿。
谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
OpenAI搞了个叫Ultrafast的API新档位,跑GPT-5.6 Sol能快14倍,每秒750 token,用的是Cerebras的芯片。
Ramp用7万家企业账单告诉你,OpenAI的GPT-5.6 Sol收入反超了Fable 5,但采用率还是Anthropic领先,看企业AI花钱风向。
Simon Willison 发布了 alchemy-utils,相当于多数据库版 sqlite-utils,支持 PostgreSQL 和 DuckDB,一行命令导入查询,CSV 导 DuckDB 仅 35 秒。
xAI 的 Grok 4.6 跑分追平 GPT-5.6,智能体任务比 Claude 更省步数,价格还便宜一大截,想换 API 的可以看看。
SpaceXAI 的 Grok 4.6 发布,跑分追平 GPT-5.6 Sol,长流程编程和搭应用更强,已上线 Cursor,首周额度翻倍。
OpenAI把Daybreak拆成蓝红两档,红档独享的GPT-5.6-Cyber专门做漏洞研究,埃森哲、IBM这些公司已经在内测了。