阿里把2.4万亿参数的Qwen 3.8开源了,预览版现在就能玩,性能只比Fable 5差一点。想试试顶级开源大模型千万别错过。
#开源模型
阿里千问刚放了个2.4T参数的 Qwen3.8 预览版,官方说只比 Fable 5 差点,想尝鲜直接去 Token Plan 体验吧。
OpenMOSS 开源了一个 0.9B 参数的端到端模型,能一次搞定 90 分钟多人音频,告诉你谁说了什么、什么时候说的,单卡 4090 跑得飞快。
Google 出了个新工具 gemma-trainer,让你在自己电脑上就能微调 Gemma,不用上云,操作简单,适合想定制专属模型的朋友。
Zyphra 把 EEG 模型输入从固定5秒扩展到0.5-30秒,还开源了 Apache 2.0,搞脑电研究的可以直接上手。
想了解顶尖 AI 模型是怎么造出来的?Ai2 团队在 SeattleTechWeek 直播拆解开放模型的技术细节,很硬核。
月之暗面刚发的Kimi-K3直接打败了Fable,中国模型第一次在Frontend Code Arena登顶,开源领域又一大动静。
Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。
杨植麟把用了十年的优化器、注意力、残差连接全换了:MuonClip数据效率翻倍,Kimi Linear百万Token不掉分,Agent Swarm能并行100个智能体,开源模型离闭源又近了一步。
Kimi-K3刚拿了前端代码领域第一,全面超越Claude Fable 5,权重下月底就开源,搞AI的值得关注。
NVIDIA 开源了三个嵌入模型,8B 的 RTEB 第一,1B 的量化版速度翻倍还能保持 99% 精度,适合做检索和 RAG。
中国气象局开源了千亿参数的气象大模型“风和”,能直接用于天气分析、风险预警,还在GitHub和Hugging Face上给了完整代码和API,开发者可以自己接入。
商汤把检测、分割、深度预测、3D重建全塞进一个开源模型,还在HuggingFace拿了第一,做视觉的兄弟可以试试。
Kimi 发了 K3 开源模型,2.8T 参数加上百万上下文,在编程评测里甚至超过了 Claude 和 GPT,做智能体特别合适。
脑科学研究有多繁琐你懂的,BrainPilot开源出来帮你自动查文献、做分析、防编造,性能不输顶级框架还省钱。