主要来源shao__meng
查看原文事件专题 · 单一信源
Perplexity 开源 Mac 本地推理引擎 Lily
Perplexity 为 Mac 端 Hybrid Compute 开发了本地推理引擎 Lily,使用 Rust 运行时和自定义 Metal 内核,专为 Qwen3.6-35B-A3B 模型和 Apple Silicon 硬件深度定制。在 M5 Max 上,Lily 的 prefill 吞吐为 MLX-LM 的 1.23 倍,decode 为 1.35 倍。Lily 通过 GPU 路径匹配推理阶段、最小化数据搬运和动态选择内核等策略实现性能优化。
当前结论
Perplexity 为 Mac 开发了专用推理引擎 Lily,比 MLX-LM 快 23%-35%,专为 Qwen3.6-35B-A3B 和 Apple Silicon 优化。
2 个信源78° AI 热度最后更新 2026/9/3 03:35:47
证据链
相关来源 1marktechpost
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。