产业观察
Perplexity推出Photon:基于Rust的检索引擎,将p99延迟从800毫秒降至65毫秒
原标题: Perplexity推出Photon:基于Rust的检索引擎,将p99延迟从800毫秒降至65毫秒
📋总体概括
Perplexity发布了自研检索排序引擎Photon,采用Rust编写,替换此前基于fork开源引擎的检索栈。Photon目前已承接全部生产流量检索与排序,并为Search API新增的Fast Search模式提供支持。性能上,p99延迟从约800ms降至65ms,单次调用延迟降至160ms左右。这一改造显著压缩了AI搜索响应时间,也体现了Perplexity在核心检索基础设施上走向完全自研,降低对外部开源引擎依赖的战略取向。
⚡关键信息
- ▸Perplexity发布Rust自研检索排序引擎Photon,替换原先fork的开源引擎方案
- ▸p99延迟从约800ms大幅降至65ms,降幅接近12倍
- ▸Photon已承接Perplexity全部生产流量的检索与排序任务
- ▸Photon同时驱动Search API新推出的Fast Search模式,单次调用延迟约160ms
🔥犀利点评
p99从800ms砍到65ms,这不是调参调出来的,是换语言、换架构换出来的。检索排序这种热路径用Rust重写,本质是把GC抖动和调度开销从延迟账本里彻底删掉。更值得玩味的是Perplexity宁可自研也不继续养fork——AI搜索的护城河不在模型,而在检索这条命脉上,谁敢把命脉交给别人的代码库?这一步走对了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 marktechpost.com 阅读全文 →