朋友,有个挺有意思的事,彭博的 Carter Leffen 用 OpenAI GPT-6 Astra 破译了 83 年前的德军密文,花了 10 小时,挺有意思的。
月之暗面出了个金融行业的 Kimi 解决方案,能帮银行和券商把资料处理从一天变成一小时,还整合了 Wind 万得这些数据源,不用再跨平台找资料了。
智谱 GLM 做了个很酷的事,让 AI 自己去优化自己的推理系统,在十万张国产卡上把效率提升了三倍,比用普通 GPU 还划算。
三星这个AI内存方案挺有意思,把HBM直接堆叠在AI加速器上,就像给酒店客房装了直达大堂的专用电梯,能大幅提升响应速度,比现在每秒处理100个词元快10倍,达到每秒1000个词元。
Anthropic 把 Claude 的聊天和 Cowork 界面合并了,现在一个窗口就能搞定,不用再纠结该点开哪个标签页了,还新增了做 PPT 的功能,挺方便的。
朋友,Light Origins 开源了他们的导航模型 LightNav-0,这个模型能零样本迁移到 10 个单目导航基准上,比很多模型都强。
朋友推荐:Songyan Dynamics 新出的 HERON-CRA 模型,加了上下文记忆和强化学习引擎,能更好地控制机器人做袜子折叠,效果提升明显。
夏普和富士康合作搞AI服务器,企业版能装8块英伟达RTX PRO 6000 Blackwell GPU,比普通服务器性能强不少。
UIUC的汪浩瀚团队搞了个新项目,叫「协调式智能体生物学中心」,就是让AI模型像研究团队一样分工合作,解决单个模型做不了的复杂生物学问题,挺有意思的。
朋友,Almeida 公司推出个不生成文本的 AI 模型 Jev,直接输出结构化决策,比大语言模型快 200 倍还便宜,输出还免费,挺有意思的。
朋友,AMD 用 512 个 GPU 刷新了 AI 推理纪录,比英伟达的同类配置快,值得关注。
有个网友开发了个叫NvpwrControl的工具,能把你笔记本的RTX 5090显卡功耗从175W提到250W,性能提升挺明显的。
字节搞了个叫豆包的车载 AI 助手,能让你用手机远程控车、查车况,还能把对话里的行程推送到车机上,比普通车载系统更智能。
英伟达新出的 DSX MaxLPS 技术,能让 AI 工厂在相同电力下多处理 40% 的 token,对数据中心很实用。
Valve 新增两个兼容层,让 SteamOS 能运行更多游戏,特别是 Arm 设备和安卓应用包,对游戏玩家很有用。
朋友,这篇论文挺有意思的,作者发现用循环结构(looping)来改写模型架构,能显著提升计算效率。比如他们用7.4B模型就达到了GPT-3 13B的性能,但算力只用了1/20,这个方法挺有启发性的。
智谱AI最近发布的GLM-Image确实在AI图像生成领域投下了一枚重磅炸弹。免费、无水印、中文文本渲染能力强,这三个特点组合在一起,足以让整个行业重新审视中国AI技术的实际进展。 国内AI图像生成工具一直面临着中文文本渲染的难题。Mid…
AI制药新玩家:Anthropic的"不盈利疾病"战略能否颠覆传统药物开发? Anthropic,这家以AI安全著称的公司,突然宣布进军药物发现领域。不是辅助工具,而是直接下场开发药物,而且专门瞄准那些传统制药巨头认为无利可图的疾病。这究…
1107 vs 303:谷歌这个开源模型,把大模型的“打字机”拆了 同一张 H100 显卡。同一个 26B 参数架构。303 那个还开启了多 token 预测加速。DiffusionGemma 跑出了 1107 token/s,是标准版…
DiffusionGemma:当扩散模型开始“写”字,自回归的统治还能撑多久? 过去一周,我的信息流里“DiffusionGemma”这个词反复出现。在AI圈,当一个技术名词开始密集出现在各个群聊和推文中,通常意味着两件事:要么是又一轮泡…
每秒 1107 个 token,但问题从来不只是速度 昨天,Google 开源了 DiffusionGemma。 一个 26B 参数的模型,在 H100 上跑到 1107 tokens/s。对比之下,传统自回归的 Gemma 4,哪怕开启…