Vespa(7,037星)2026:面向向量搜索、排序和推荐的大数据服务引擎

📘 教程 2026-08-06 约 4 分钟阅读

Vespa(7,037星)是雅虎开源的服务引擎,用于大规模向量搜索、实时排序和推荐。本文教你部署并运行混合搜索。

💡 你将学到

Vespa(7,037星)是雅虎开源的服务引擎,用于大规模向量搜索、实时排序和推荐。本文教你部署并运行混合搜索。

📜 目录

直接给结论

vespa-engine/vespa(7,037星,Java)是一个开源大数据服务引擎——雅虎搜索排序背后的技术。它在一个系统里同时处理向量搜索、BM25和机器学习排序,支持实时写入,海量数据下查询延迟亚秒级。

Vespa的独特之处

本地部署

docker run --detach --name vespa --hostname vespa-container \n  --publish 8080:8080 --publish 19071:19071 \n  vespaengine/vespa

# 部署示例应用
vespa deploy sample-apps/vector-search
vespa query 'select * from doc where userQuery()' 'input.query(q)=embed(foo)'

Vespa CLI(brew install vespa-cli)驱动部署和查询工作流。

最小混合搜索schema

schema doc:
  document doc:
    field text type string { indexing: index }
    field embedding type tensor<float>(x[384]) {
      indexing: attribute | index
    }
  rank-profile hybrid inherits default {
    first-phase {
      expression: bm25(text) + cos(distance(field, embedding))
    }
  }

实用技巧

FAQ

谁在用? 雅虎、Spotify等都在生产环境用它做搜索和推荐。

它是向量数据库吗? 它是完整的服务引擎:向量DB+搜索+排序一体化。

免费吗? 是——Apache-2.0开源。

相关文章

❓ 常见问题

Who uses it?

Yahoo, Spotify, and many others run it in production for search and recommendations.

Is it a vector database?

It is a full serving engine: vector DB + search + ranking in one.

相关文章
2026-07-17
AI Agent Backup Restore:构建可靠AI Agent的必备实践
2026-07-17
AI Agent语义缓存:意思相同的问题不要重复算
2026-07-23
对这些人,WSL 3 是个大礼包:

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论