产业观察

Perplexity推出Photon:基于Rust的检索引擎,将p99延迟从800毫秒降至65毫秒

原标题: Perplexity推出Photon:基于Rust的检索引擎,将p99延迟从800毫秒降至65毫秒

marktechpost.com·2026/9/30 08:26:52🔗 原文

📋总体概括

Perplexity发布了自研检索排序引擎Photon,采用Rust编写,替换此前基于fork开源引擎的检索栈。Photon目前已承接全部生产流量检索与排序,并为Search API新增的Fast Search模式提供支持。性能上,p99延迟从约800ms降至65ms,单次调用延迟降至160ms左右。这一改造显著压缩了AI搜索响应时间,也体现了Perplexity在核心检索基础设施上走向完全自研,降低对外部开源引擎依赖的战略取向。

⚡关键信息

  • ▸Perplexity发布Rust自研检索排序引擎Photon,替换原先fork的开源引擎方案
  • ▸p99延迟从约800ms大幅降至65ms,降幅接近12倍
  • ▸Photon已承接Perplexity全部生产流量的检索与排序任务
  • ▸Photon同时驱动Search API新推出的Fast Search模式,单次调用延迟约160ms

🔥犀利点评

p99从800ms砍到65ms,这不是调参调出来的,是换语言、换架构换出来的。检索排序这种热路径用Rust重写,本质是把GC抖动和调度开销从延迟账本里彻底删掉。更值得玩味的是Perplexity宁可自研也不继续养fork——AI搜索的护城河不在模型,而在检索这条命脉上,谁敢把命脉交给别人的代码库?这一步走对了。

本文由本站自动聚合,以下为原始来源:前往 marktechpost.com 阅读全文 →