全部动态
谷歌 Deepmind 发表观点,说 AI 模型显示思考过程(比如 Chain-of-Thought)对安全有好处,但现在很多模型(比如 GPT-4)正在减少这种透明度。
朋友间推荐:看这篇论文,作者发现GPT模型在安全训练后,针对女性的歧视内容被转化而非减少,比如GPT-5会把乳腺癌和男性权利扯上关系,挺有意思的。
朋友发了这个新基准数据集,专门用来测试模型在生物物理领域的科学推理能力,比之前的基准更复杂,能看出不同模型在这个专业领域的真实水平。
Gary Marcus 告诉你,他早在 2023 年就警告过美国参议院,AI 代理(比如 AutoGPT)可能带来难以预测的安全问题,现在的情况和当时他说的完全一致。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
Anthropic 推出了 Claude 3.5 Sonnet,这个新模型在多项任务上比 GPT-4 更强,你可以用它来写代码、做推理,甚至处理图片信息。
Salesforce 新发布的 Koa 模型挺有意思,它用公司自己的工作流规范文件来训练,在 Tau2Bench 和 CRM 基准上比 GPT-4 表现更好。
OpenRouter 新增了 US 和 Europe 地域限制功能,你可以直接在请求里指定,让模型只从支持这些地区的服务商里调用,更方便控制数据流向。
朋友推荐:Recursive 这个新公司刚融了 5 亿美金,创始人团队很强,他们要搞的是让 AI 自己变得更聪明的技术,听起来挺有意思的。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…