Anthropic用其最强大的模型Claude Mythos 5来加强网络安全,这比其他模型更有效。
Nvidia展示了AI模型之外的另一个关键因素——harness,它对AI性能至关重要。
Deepseek新推出的V4-Flash-Vision-Exp模型,将图像理解能力与文本处理结合,在多模态智能体基准测试中表现优异,与Opus 4.8不相上下,值得一试。
Amazon Bedrock新技巧降低RAG成本,提升效率。
DeepMind结合15年游戏AI研究,与游戏工作室合作,带来突破性游戏玩法,值得一试!
DeepSeek 更新,多模态识别更强,值得一试。
深度求索新模型上线,多模态能力提升,API 访问方便,适合各种 Agent 工具集成。
卡卡西机器人用GPT-3,3秒学会新动作,效率高,技能提升快!
小红书开源自研大模型,支持多模态理解,与华为Ascend深度适配,为内容平台构建AI基础,值得关注。
试试看Qwen-UI-Agent,它让模型在手机、电脑、网页和深度搜索等各种屏幕上都能真正派上用场,比同类产品更智能安全。
开源开发者有了新基准,Qwen3.8-27B横扫消费级硬件,比肩GPT-5.6 Luna和DeepSeek V4 Flash,参数量27亿,4位量化后适配24GB GPU,超越它才是新标准!
商汤新开源的SenseNova U1.5 Lite模型,支持4K图像输出,功能强大,是处理复杂视觉任务的利器,值得一试。
优必选发布的新模型行者,基于GPT-3.5,能自然理解和生成语言,适用于客服和助手,性能比行业基准好,值得一试。
阿里云新上线GLM-5.3和Deepseek-V4-Pro,编程和智能体应用场景更强大,值得开发者关注。
谷歌Gemma模型下载量突破10亿次,应用广泛,开发者社区活跃,值得了解。
蚂蚁百灵把 Ling-3.0-tiny 和 flash 的 Base 模型开源了,还把训练过程中的 6 个关键节点权重都放出来了。tiny 模型参数少但代码能力强,flash 模型参数多适合继续训练,对研究者挺有用。
Liquid AI给LFM2.5模型加了三个drafters,解码速度能快3.18倍,但输出结果和原来一模一样,不用改现有应用就能用。
Pangram CTO说,不是LLM写不好,是安全防护栏限制了它们。没加防护栏的基础模型,写作风格反而更多样。
阿里刚发了 Qwen-UI-Agent,能直接操作手机电脑屏幕,移动端比 GPT-5.6 Sol 高 12 个点,还能在真实手机上跑任务,以后帮你自动查地址、订高铁、整理文件应该更靠谱了。
Kimi K3用Harness框架,在18个Agent科研任务里,性能快追上GPT-4o了,挺厉害的。
Anthropic内部在用个叫Model 2的模型,比公开的Claude还强,但还没发布。
Generalist AI 刚刚发布了 GEN-1.5,它能通过一次演示就教会机器人新任务,比传统方法更高效。
你知道交通运输部推的AI吗?它能识别驾驶员疲劳、分心驾驶,准确率超95%,比之前人工巡查靠谱多了。
Z.ai的老总讲了GLM 5.3和那个新定律,讲清楚和以前不一样的地方,你去听听了解下。
DeepReinforce刚发布了Ornith-1.5系列开源模型,里面有量化版居然能在iPhone 17手机上用,而且大模型性能和Claude Opus 4.8差不多甚至更强,和其他模型比也有优势,值得看看。
墨奇发的MoRA模型,能让机器人做长程任务,比普通模型实战效果更好
Meta发布了Muse Video视频样片,能单次生成最长10秒视频,在时长上比同类项目更具优势,值得一看~
DeepSeek Harness 推出 v0.1.0 - rc.8 更新,加了图像请求和多模态功能,比之前能处理更多内容的了。
Modular发布了Mojo编译器和开发工具的开源代码,能让大家获取Mojo的完整开发组件,和之前开源的部分不同,这次补全了最后一块拼图,对想用Mojo做项目的开发者有帮助。
OpenAI说ChatGPT服务突然全区域故障,正在修复,这次影响比之前广,等他们弄好后就能用了。
华为开展仓颉编程语言高校教学,高校教师能系统学习这门语言,和国产其他编程语言比更适配鸿蒙生态,值得参考
杰里米·莫雷尔讲了可扩展软件和大型语言模型的事儿,能帮开发者做新应用,用大型语言模型补充功能,比以前方式方便安全。
亚马逊出了AgentCore在无服务器管道的异步调用方法,能帮你省闲置计算成本,比以前方式好
OpenAI 发布前沿模型零数据留存政策,对API客户友好,和以往政策相比更注重数据隐私保护
OpenAI修了Codex那个会乱删用户文件的bug,现在用的时候不用担心文件被误删,比之前更安全可靠了。
龙芯发的3B6600用1Xnm工艺,性能追平AMD和英特尔的7nm产品,比上一代提升不少,值得去了解下。
Anthropic放出Claude模型新功能,能让任意实验室完成全蛋白设计流程,比行业平均效率高很多。
Z.ai推出了GLM - 5.3模型,分数表现好登顶开源排名,和竞品比价格更低但发布推迟,可以去瞅瞅。
智谱GLM-5.3 API上线了,性能媲美GPT-5.6,成本却更低,下周还要开源,性价比超高!
支付宝小宝智能体接入汽车手机,打造跨设备商务新生态