资讯🔥7.0
Perplexity Open Sources Lily: A Rust + Metal Inference Engine for Qwen3.6-35B-A3B on Apple Silicon
📋总体概括
Perplexity开源了Lily,这是其Perplexity Computer中Hybrid Compute功能背后的本地推理引擎。Lily用Rust编写,针对单一模型Qwen3.6-35B-A3B和Apple Silicon单一芯片家族定制Metal内核,在40核心、128 GB的M5 Max上实测平均达到MLX-LM预填充吞吐的1.23倍、解码吞吐的1.35倍。这一动作表明Perplexity正把端侧AI算力优化作为产品竞争力,并通过开源向开发者生态展示其底层工程能力。
⚡关键信息
- ▸Perplexity正式开源本地推理引擎Lily,它原本服务于Perplexity Computer的Hybrid Compute功能
- ▸Lily以Rust编写,并为单一模型Qwen3.6-35B-A3B定制了专用Metal内核
- ▸在40核心、128 GB内存的M5 Max上,Lily预填充吞吐平均达MLX-LM的1.23倍
- ▸同一测试环境下,Lily解码吞吐平均达到MLX-LM的1.35倍
- ▸Lily只针对一个模型和Apple Silicon一个芯片家族做深度优化,走极致定制路线
🔥犀利点评
开源Lily本质是Perplexity的工程实力宣言:与其在通用框架里卷参数,不如为一个模型、一颗芯片把Metal内核写到极致,1.23倍预填充、1.35倍解码的收益就是这么榨出来的。但代价也很清楚——深度定制意味着模型一换、芯片一代,优化就要重来,维护成本极高。MLX背靠苹果生态,Lily能否持续跟上硬件迭代才是真考验。开源更多是招揽开发者与人才的品牌动作,别急着当成MLX的替代品。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 marktechpost.com 阅读全文 →