达摩院搞了个AI智能体,从240万晶体里筛出6.8万候选,还实战验证了4种超导新材料,比传统SuperCon数据库效率高太多,搞材料的人可以白嫖数据。
全部动态
Anthropic发现Claude Code的新模型Fable 5太聪明,系统提示反而碍事,直接砍掉80%。
葡萄牙政府新搞了个葡语开源大模型AMALIA,9B参数就能理解文本、图像和声音,年底还要出22B带智能体,搞葡语相关任务可以试试。
前Llama老大跑去做药了,他们用扩散模型搞的PEARL在OpenBind零样本赢了,共折叠也终于过了门槛。想了解AI怎么设计新药的可以看这个。
想测测 AI 在生物学研究里的实战能力?OpenAI 搞了个 GeneBench-Pro 基准,129 道题,合成数据防作弊,快看看你的模型能得几分。
中国初创搞的世界模型火了,能反复推演不同情境,Hugging Face上热度第一,周鸿祎和陆奇都投了,做推理模型的朋友可以看看。
三星 HBM4E 良率冲到 70%,离量产不远了,还给下一代 AI 加速器 Vera Rubin Ultra 供货,内存赛道竞争加速。
英伟达把 DeepSeek V4 的推理成本砍到五分之一,单 GPU 吞吐量暴增 20 倍,选 Blackwell 做推理的可以闭眼冲了。
Jim Keller 团队的新 RISC-V 内核,面积砍半性能保留七成,单位面积性能提升 40%,专为智能体场景优化。
Anthropic新出Claude Sonnet 5,智能体能力最强,能自己用浏览器和终端干杂活,价格比Opus便宜,做自动化任务很划算。
Google 出了个 Nano Banana 2 Lite 图像模型,最快最便宜,能生成沃尔多风格找图,比上一版好但拼写会错。
Anthropic 刚发了 Sonnet 5,性能接近 Opus 4.8 但更便宜,不过新 tokenizer 会让你的账单多掏 30%,用之前先算好账。
Google新出两个模型:一个4秒出图只要3分钱,另一个能文字生成视频,还能链着玩。
美团搞了个1.6万亿参数的大模型LongCat-2.0,全程用国产芯片,没碰Nvidia,性能还很强。想看看中国芯片能不能撑起大模型?这篇聊得清楚。
DeepSeek的DSpark用小型模型提候选token、大模型批量验证,让速度提升85%,还减少了芯片需求,挺实用的。
Meta 开源了 Brain2Qwerty v2,用脑磁图直接解码打字想法,单词准确率 61%,比上一代更准更快。