想了解如何用代码生成艺术作品的读者可以看看,这个模型基于CLIP,经过微调后能生成不错的水彩画,很有意思。
AI模型竞赛升级,安全防护加强
2026年9月3日,AI领域迎来多款重磅更新。Google发布Gemini 3.8系列,Flash (High)在Agent Arena排名第14,较前版本提升5.94%,定价每100万代币0.75-3.75美元。李飞飞团队推出Atlas世界模型,可从单张图片生成完整3D场景,支持1分钟1440p视频生成。AI安全防护升级,Anthropic发布EFS系统,OpenAI称Astra为最危险模型需监控思维链。
澜起科技CXL3.2芯片导入大厂,PCIe Switch芯片即将流片,值得关注其技术进展和市场表现。
Poet Engineer 推出了新的 AI 写作工具,功能实用,值得一试。
MiniMax的H3 Max Turbo比原版快一倍便宜一半,视频生成速度和质量平衡得很好。
Google发布Gemini 3.8 Flash,比前代仅三周就更新,推理和编码能力更强。
OpenAI首席科学家澄清Astra模型复杂度未跳跃增长,并宣布将加强思维链监控技术。
MiniMax H3新功能让图片变手工制作视频,15秒看懂从零到成品全过程。
Fable使用SubAgent架构指挥Claude模型,token消耗大但成本更低,还能为主模型节省上下文空间。
Knowix用Fable 5.1一键生成了可互动的中世纪王国,比之前的体素模型强大得多。
小米发布了玄戒 O3 纪念铝板,内嵌旗舰芯片和雷军签名,全球首款支持 LPDDR6,AI 性能提升 45%。
TRACE框架让自主机器人决策过程完全可追溯,解决了深度学习模型不可解释的问题。
电信专家团队用LLM解决5G/6G网络故障诊断,通过结构化推理减少幻觉,比传统方法更准更可靠。
SafeEvolve通过策略协同进化提升AI智能体安全性,在降低有害响应的同时保持性能,比现有方法更有效。
清华团队提出多智能体LLM系统的博弈论框架,新算法在SWE-bench上超越基准2.2个百分点。
DisCo代理把GitHub仓库变成可重用技能,在多个AI研究基准上大幅提升性能,比无技能版本表现更好。
DKL解决了RAG检索失败时的问题,比RAFT和PA-RAG方法更高效,还能保持指令模型的指令跟随能力。
这篇论文教你如何检测黑盒大模型的幻觉,有4种方法可选,无需监督标签也能用。
Loom框架通过嵌入空间重加权技术,在保持高准确率的同时大幅提升推理速度,适合工业场景的根因分析任务。
GRADSOLVE解决了ODE集合在GPU上求解与反向微分速度不匹配的问题,大幅提升计算效率。
研究人员提出Cliff方法,通过识别首次错误来改进强化学习,性能提升显著且适用性广。
PARSER方法通过输出重要性指标优化MoE模型压缩,在相同内存减少下提升模型精度。
NVIDIA提出新方法让FP4预训练更稳定,训练速度提升21.2%,模型性能全面超越现有方案。
DeepSeek和GLM-5.2通过将推理痕迹前置,长上下文推理准确率大幅提升,最高达100%。
研究将LLM与本体排序器融合,提升罕见病诊断准确率,同时保留可追溯的证据链。
FUSE框架首次系统评估了12个商业LLM的危险能力,发现模型间存在显著差异,新模型知识增强但安全提升有限。
这篇论文揭示了压缩传感中可调线性生成先验的理论边界,解释了为什么神经网络先验的可调性在实际应用中有效。
研究人员展示了如何针对代码生成系统进行精准知识投毒,成功率高达93%,连安全防御都难以完全阻挡。
研究人员发现影响函数选中的样本通过重写而非重加权能更有效改变模型行为,这对训练数据归因方法评估有重要启示。
HiPoly框架能从实验数据直接预测聚合物性质并设计可持续替代品,比传统方法更高效准确。
Jerry Liu分析厂商中立初创公司如何利用多模型优势优化特定任务解决方案。

