小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
从零开始构建RAG系统 — 总结与未来展望

本文总结了构建完整AI系统的过程,包括数据库设置、索引创建、文档嵌入和相似性搜索等步骤。使用pgvector与PostgreSQL集成,设计决策关注工具选择、记忆管理和多步骤推理。未来将探讨评估、可观察性和安全性等主题。

从零开始构建RAG系统 — 总结与未来展望

mongona news
mongona news · 2026-06-27T22:21:00Z
安东尼·佩格:您的 AI 应用在 PostgreSQL 上运行。现在,无需从头开始即可使其准备好投入生产

pgEdge ColdFront 提供了一种将 AI、分析和 OLTP 工作负载无缝整合的方法,降低存储成本。用户可以在 PostgreSQL 中使用 pgvector 进行相似性搜索,无需更换数据库或重构数据模型。pgEdge 引入的模型上下文协议(MCP)使 AI 代理能够直接访问数据库架构,提升开发效率。此外,pgEdge 支持多主复制,确保高可用性和一致性,简化生产环境管理。

安东尼·佩格:您的 AI 应用在 PostgreSQL 上运行。现在,无需从头开始即可使其准备好投入生产

Planet PostgreSQL
Planet PostgreSQL · 2026-06-17T11:27:59Z
什么是pgvector?

pgvector是一个开源的PostgreSQL扩展,支持存储和搜索向量嵌入,适用于语义搜索和推荐功能。它简化了相似性搜索,能够处理数百万到数千万个向量,支持余弦相似度,并可与Postgres全文搜索结合使用。对于高性能需求,pgvectorscale可扩展pgvector的能力。

什么是pgvector?

Databricks
Databricks · 2026-04-17T06:59:30Z
向量数据库的三种难度级别解析

向量数据库通过将非结构化数据转换为向量,支持相似性搜索。它们采用近似最近邻算法提高检索速度,解决大规模数据搜索问题。主要技术包括HNSW、IVF和PQ等索引方法,结合元数据过滤和混合检索,提升搜索精度和效率。

向量数据库的三种难度级别解析

MachineLearningMastery.com
MachineLearningMastery.com · 2026-03-26T14:55:52Z
Redis中的向量索引:算法、混合搜索与扩展

Redis 8集成了多种向量索引算法,支持高效的大规模相似性搜索,优化数据结构以提升搜索速度,适用于语义搜索和推荐系统等应用。

Redis中的向量索引:算法、混合搜索与扩展

Redis Blog
Redis Blog · 2026-03-08T00:00:00Z
在生成AI中使用向量数据库

现代生成AI依赖快速数据和向量数据库来存储和检索嵌入,支持高维向量的快速相似性搜索,适用于聊天机器人和个性化推荐等应用。Redis提供低延迟和高吞吐量的向量搜索,优化AI工作流,提高响应速度和用户体验。

在生成AI中使用向量数据库

Redis Blog
Redis Blog · 2026-02-17T00:00:00Z
向量数据库:生产前需要了解的事项

向量数据库通过将非结构化数据转化为可搜索的数值表示,解决了传统数据库在相似性搜索中的局限性。它们支持高效的语义搜索,适用于推荐系统和自然语言处理等AI应用。选择独立数据库或统一平台会影响性能和复杂性,其中HNSW算法在速度和准确性方面表现最佳。

向量数据库:生产前需要了解的事项

Redis Blog
Redis Blog · 2026-01-29T00:00:00Z
如何为您的AI技术栈选择最佳向量数据库

每个AI项目都会面临并发用户和延迟峰值等挑战。选择向量数据库时,应关注性能、检索质量和操作复杂性。向量数据库通过存储高维向量嵌入来解决相似性搜索问题,适用于需要快速检索的场景。评估时需测试实际数据和查询模式,以确保满足需求。

如何为您的AI技术栈选择最佳向量数据库

Redis Blog
Redis Blog · 2026-01-20T00:00:00Z
推出Vector Buckets

Supabase推出了Vector Buckets,提供高效的向量存储和内置相似性搜索功能,支持存储数千万个向量,适用于语义搜索和推荐系统。与pgvector结合使用,简化了大规模数据集的向量管理和查询过程。目前该功能处于公共测试阶段,用户可免费试用。

推出Vector Buckets

Blog - Supabase
Blog - Supabase · 2025-12-01T07:00:00Z
机器学习向量数据库完全指南

向量数据库在现代机器学习中至关重要,克服了传统数据库在高维嵌入相似性搜索的局限。它们通过专用算法实现快速、可扩展的搜索,适用于大规模数据集。主要算法包括HNSW、IVF和PQ,各有速度与准确性的不同权衡。了解这些数据库的原理和应用场景,有助于构建更优的AI应用。

机器学习向量数据库完全指南

MachineLearningMastery.com
MachineLearningMastery.com · 2025-10-17T16:34:47Z
AWS在Amazon S3上推出向量功能

在纽约AWS峰会上,AWS预览了Amazon S3 Vectors,这是首个原生支持大规模向量数据集的云对象存储,提供亚秒级查询性能并降低AI数据存储成本。S3 Vectors引入向量桶,支持向量数据组织和相似性搜索,开发者可附加可过滤的元数据,并与Amazon OpenSearch集成以进一步降低存储成本。

AWS在Amazon S3上推出向量功能

InfoQ
InfoQ · 2025-07-26T13:50:00Z
Redis 8引入向量集,并在Redis Cloud Essentials上预览

Redis 8在Redis Cloud Essentials上预览,提供强大性能和新功能,包括向量集数据结构、30多项性能提升及Redis查询引擎,专为AI应用设计,支持高维向量存储和快速相似性搜索,显著提升开发者体验。

Redis 8引入向量集,并在Redis Cloud Essentials上预览

Redis Blog
Redis Blog · 2025-07-22T00:00:00Z
人工智能代理如何记忆:向量存储在大型语言模型记忆中的作用

大型语言模型(LLMs)通过向量存储模拟记忆,将文本转换为向量以根据意义查找相关信息。尽管存在相似性搜索可能导致不相关结果的局限性,但这种方法使AI显得更智能和人性化。

人工智能代理如何记忆:向量存储在大型语言模型记忆中的作用

freeCodeCamp.org
freeCodeCamp.org · 2025-07-17T14:08:19Z

Weaviate是一个开源向量数据库,专为高维向量数据设计,支持高效的相似性搜索。它采用先进的索引技术(如HNSW)实现快速查询,易于使用,并支持多种编程语言。与微软的Semantic Kernel集成后,增强了智能应用的构建能力,适用于语义搜索和推荐系统等场景。

.NET 原生驾驭 AI 新基建实战系列(七):Weaviate ── 语义搜索的智能引擎创新者

dotNET跨平台
dotNET跨平台 · 2025-05-14T00:00:48Z
pgvector:企业AI战略中至关重要的PostgreSQL组件

pgvector是一个开源的PostgreSQL扩展,支持高效的相似性搜索,适用于AI应用。它允许在PostgreSQL中存储和查询高维向量数据,简化基础设施,降低成本,同时确保数据安全和合规。企业可以利用pgvector在现有数据库中实现智能搜索和推荐系统,提升数据处理能力。

pgvector:企业AI战略中至关重要的PostgreSQL组件

Percona Database Performance Blog
Percona Database Performance Blog · 2025-04-25T12:32:41Z

Qdrant是一款开源高性能向量数据库,专为AI和机器学习应用设计,支持高维数据存储与相似性搜索,具备实时查询和分布式部署功能,适用于语义搜索、推荐系统和多媒体检索。与.NET生态系统结合,便于开发者集成,提高智能应用开发效率。

.NET 原生驾驭 AI 新基建实战系列(四):Qdrant ── 实时高效的向量搜索利器

dotNET跨平台
dotNET跨平台 · 2025-04-24T00:01:33Z
实践中的向量搜索:使用FAISS和Chroma进行嵌入

本文介绍了如何利用FAISS和Chroma库进行高效的向量搜索。FAISS用于相似性搜索和聚类,而Chroma则简化了嵌入和搜索的流程。通过将文本数据转化为嵌入,开发者能够快速构建高效的搜索解决方案。

实践中的向量搜索:使用FAISS和Chroma进行嵌入

DEV Community
DEV Community · 2025-04-14T15:52:49Z
MicroNN:一种可更新的设备端磁盘驻留向量数据库

MicroNN是一款嵌入式最近邻向量搜索引擎,专为低资源环境设计,支持设备上的向量搜索、更新和混合查询。其内存占用低,能够在百万规模的向量基准上以不到7毫秒的时间检索前100个最近邻。

MicroNN:一种可更新的设备端磁盘驻留向量数据库

Apple Machine Learning Research
Apple Machine Learning Research · 2025-04-10T00:00:00Z
宣布向量集合:Redis的新数据类型,用于向量相似性

Redis推出了向量集合这一新数据类型,旨在提升其在AI应用中的能力。向量集合支持高维向量嵌入的存储与查询,能够高效进行相似性搜索,并与Redis查询引擎互补,提供简单直观的API,适合向量相似性应用。

宣布向量集合:Redis的新数据类型,用于向量相似性

Redis Blog
Redis Blog · 2025-04-08T00:00:00Z
快速提示:如何使用Ollama、DeepSeek-R1和SingleStore构建本地LLM应用

本文介绍了如何在Ollama中用DeepSeek-R1替换LLM,利用LangChain存储向量嵌入和文档,通过相似性搜索获取相关信息并生成响应。最终结果展示了骆驼与美洲驼的关系,强调了本地Ollama安装的灵活性。

快速提示:如何使用Ollama、DeepSeek-R1和SingleStore构建本地LLM应用

DEV Community
DEV Community · 2025-03-17T19:20:51Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码