Ollama是一个本地部署大型语言模型的平台,让用户能够在个人设备上运行开源AI模型。近期,Ollama积极整合多种高性能开源模型,包括DeepSeek系列和Qwen系列,为用户提供本地化AI解决方案。
Ollama 近期进展
2024年7月,Ollama在旧金山举办聚会,展示了开源模型与编程助手的结合应用,强调本地化AI开发体验。Ollama周四旧金山聚会:开源模型与编程助手
Ollama宣布deepseek v4 flash性能最佳,同时本地用户可以选择qwen3.8模型,体现了其模型选择的多样性。Ollama称deepseek v4 flash性能最佳,本地可选qwen3.8
DeepSeek-V4-Pro已登陆Ollama云服务,Pro和Max订阅用户可使用,标志着Ollama云服务的进一步扩展。DeepSeek-V4-Pro 登陆 Ollama 云,Pro 和 Max 订阅可用
Ollama联合阿里Qwen,推出Qwen3.8-27B模型,该模型可接入Claude Code等工具,增强了编程辅助能力。Ollama 联合阿里 Qwen,Qwen3.8-27B 正式上线
当前焦点与观察点
Ollama正逐步构建一个完整的本地AI生态系统,从模型选择到工具集成,为用户提供一站式解决方案。其支持多种编程辅助工具,如Claude Code,表明其正专注于开发者市场。
随着MLX-Serve等Apple Silicon原生推理服务器的出现,Ollama在本地部署领域面临新的竞争与机遇。Z.ai发布的GLM-5.3模型也将加入Ollama支持列表,进一步丰富其模型库。
Ollama的发展反映了开源AI模型与本地化部署的结合趋势,用户可以在保护隐私的同时享受高性能AI服务。这种模式可能成为未来AI应用的主流方向之一。