Perplexity 发布嵌入模型 GPU 高速推理服务架构研究
💡 灵机 AI 深度洞见与核心提炼
Perplexity 发布研究博客,介绍其为支撑搜索结果嵌入与排序模型构建的 SoTA 推理服务基础设施。研究说明 Perplexity 每个答案的第一步都由嵌入和排序模型为查询挑选最相关结果,全文见 https://www.perplexity.ai/hub/blog/fast-embeddings-on-gpus。
信源媒体:X:Perplexity (@perplexity_ai)
访问出处网页 ↗