小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
利用DynamoDB和Bedrock构建统一AI代理架构

本文介绍如何利用DynamoDB原生向量搜索与Bedrock构建统一AI代理架构。该方案将操作数据与向量嵌入存储在同一DynamoDB表中,通过Lambda调用SearchVectors实现语义搜索,并利用DynamoDB Streams自动生成嵌入,避免单独向量数据库,降低基础设施成本与同步复杂性,适用于频繁更新且需实时搜索的文档管理场景。

利用DynamoDB和Bedrock构建统一AI代理架构

AWS Architecture Blog AWS Architecture Blog · 2026-08-21T18:19:23Z
利用参数化查询模板降低Text2SQL延迟

本文介绍通过参数化查询模板缓存降低Text2SQL延迟的方法。系统将SQL查询泛化为模板,用语义搜索匹配用户问题,命中时跳过LLM生成,直接执行查询。生产部署中,缓存命中率达60%,端到端延迟降低80%,token消耗减少超50%,并支持强化学习持续扩充缓存。

利用参数化查询模板降低Text2SQL延迟

AWS Architecture Blog AWS Architecture Blog · 2026-08-13T00:40:32Z
向量嵌入与语言:模型如何将词语转化为几何空间

本文介绍向量嵌入如何将文本转化为高维空间中的点,使语义相近的内容距离更近,从而解决关键词搜索的语义匹配问题。文章回顾了从word2vec、GloVe到BERT等模型的发展,强调上下文建模和池化技术的重要性,并指出向量搜索需结合高效索引(如HNSW)和实时数据平台(如Redis)以支持生产应用。

向量嵌入与语言:模型如何将词语转化为几何空间

Redis Blog Redis Blog · 2026-08-10T00:00:00Z
使用LangChain和Qdrant构建问答应用

本文介绍了如何使用LangChain和Qdrant构建问答应用。通过将事实转化为向量并存储在Qdrant中,系统能够进行语义搜索并提取相关文档。使用两个模型,一个用于特征提取,另一个用于文本生成。配置知识库后,用户可以通过简单代码实现问答功能,LangChain会自动处理大部分流程。

使用LangChain和Qdrant构建问答应用

Qdrant - Vector Database Qdrant - Vector Database · 2026-07-30T07:00:00Z
Cerebras知识库架构的三大杀手锏,你绝对想不到Slack才是核心

Cerebras构建企业知识库,融合Slack、代码库等多源数据,采用混合检索(向量、全文、词频加权)与LLM提炼线程卡片,提升搜索准确率。系统通过项目机制收敛范围,MCP接口解耦检索与推理,支持灵活调用。核心原则是不改变用户习惯,数据就地接入,实现可扩展的语义搜索。

Cerebras知识库架构的三大杀手锏,你绝对想不到Slack才是核心

极道 极道 · 2026-07-18T23:59:00Z
Cerebras知识库架构的三大杀手锏,你绝对想不到Slack才是核心

Cerebras构建企业知识库,整合Slack、代码库等多源数据,采用混合检索(向量、全文、词频加权)与LLM提炼线程,提升搜索准确率。系统通过项目机制收敛范围,MCP接口解耦检索与推理,支持灵活调用。核心原则是不改变用户习惯,数据就地提取,实现可扩展的语义搜索。

Cerebras知识库架构的三大杀手锏,你绝对想不到Slack才是核心

极道 极道 · 2026-07-18T23:59:00Z
向量嵌入解析:从理论到实际应用

本文介绍了向量嵌入在语义搜索和AI代理中的应用,强调其通过数值表示相似性来提升检索效率。Redis Iris结合语义缓存、向量搜索和代理记忆,优化数据存储和检索速度,适用于大规模应用。有效的检索层和模型选择对生产价值至关重要。

向量嵌入解析:从理论到实际应用

Redis Blog Redis Blog · 2026-07-13T00:00:00Z
通过Managed Weaviate加速扩展:现已在DigitalOcean公开预览

DigitalOcean推出了Managed Weaviate,提供易于使用的向量数据库服务,支持语义搜索和RAG功能。该服务每月起价20美元,自动处理备份、安全更新和存储扩展,兼容现有代码,旨在简化AI应用程序的构建。

通过Managed Weaviate加速扩展:现已在DigitalOcean公开预览

The DigitalOcean Blog The DigitalOcean Blog · 2026-07-09T19:08:52Z
Understand-Anything:代码知识图谱

Understand-Anything 是一个开源项目,旨在帮助 AI 理解代码,通过将代码库转化为知识图谱,AI 能快速进行语义搜索和影响分析。该工具支持多种编程语言,适合大型团队和长期维护的项目,提升新人上手速度。它采用 Tree-sitter 和 LLM 的混合架构,确保高效的结构解析和语义理解。

Understand-Anything:代码知识图谱

鸟窝 鸟窝 · 2026-06-28T08:30:00Z
什么是向量搜索?

向量搜索是一种基于语义的搜索技术,通过比较文本和图像的嵌入表示来找到相关结果。它包括创建嵌入、构建索引和匹配查询三个阶段,适用于现代AI助手和语义搜索系统。与传统关键词搜索相比,向量搜索更能理解概念关系,支持多种格式和语言。混合搜索结合了向量和关键词搜索的优点,提升了信息检索的效率和准确性。Databricks平台支持这种搜索方式。

什么是向量搜索?

Databricks Databricks · 2026-06-23T08:51:49Z
使用Transformers.js和句子嵌入构建语义搜索

本文介绍了如何使用Transformers.js和句子嵌入构建客户端语义搜索引擎,包括句子嵌入的工作原理、余弦相似度的计算、嵌入的生成与缓存,以及可重用的SemanticSearch类的创建。通过比较句子的语义而非关键词,语义搜索提高了搜索结果的相关性。

使用Transformers.js和句子嵌入构建语义搜索

MachineLearningMastery.com MachineLearningMastery.com · 2026-06-05T12:00:01Z
Airtable如何构建其AI功能背后的搜索层

Airtable构建了一个支持自然语言查询的语义搜索系统,面临数据规模、查询速度和隐私等挑战。通过使用Milvus数据库和HNSW索引,Airtable实现了高效的数据处理和快速响应。团队分析用户行为,优化了内存使用,确保系统的高效性和可靠性。

Airtable如何构建其AI功能背后的搜索层

ByteByteGo Newsletter ByteByteGo Newsletter · 2026-05-27T15:30:43Z
在RAG中实现混合语义-词汇搜索

本文介绍了在RAG系统中实现混合语义-词汇搜索的方法,结合BM25词汇搜索与语义搜索,通过互惠排名融合(RRF)进行整合。混合搜索策略有效提升了检索效果,提供了Python实现的详细步骤,包括库的安装、数据集加载、BM25和语义搜索的独立执行及结果融合。通过示例查询,展示了混合搜索的优势。

在RAG中实现混合语义-词汇搜索

MachineLearningMastery.com MachineLearningMastery.com · 2026-05-25T12:00:35Z
使用LLM嵌入和元数据构建上下文感知的Python搜索

本文介绍了如何使用Python构建上下文感知的语义搜索引擎,结合嵌入式相似性和结构化元数据过滤。内容涵盖句子嵌入和余弦相似度的原理,构建元数据感知的搜索索引,以及索引的持久化方法。这些技术能够有效找到与用户查询相关的文档,同时考虑上下文约束。

使用LLM嵌入和元数据构建上下文感知的Python搜索

MachineLearningMastery.com MachineLearningMastery.com · 2026-05-22T12:00:56Z

SharpVector 是一个轻量级的 .NET 向量数据库,专为语义搜索和 RAG 应用设计。它支持内存级文本向量存储与相似度搜索,易于集成,适合本地或嵌入式场景。该项目基于 .NET 8 开发,功能灵活,支持多种向量生成器,适合快速构建 AI 应用。

强烈推荐一个轻量可嵌入的 .NET 向量数据库:SharpVector

dotNET跨平台 dotNET跨平台 · 2026-05-08T00:02:16Z
你所说的语义搜索究竟是什么意思?

文章讨论了语义搜索的概念,比较了传统文本搜索引擎与现代向量数据库的区别,强调了向量搜索在日志和安全分析中的精确匹配需求,以及语义搜索在用户发现和非精确结果中的应用。Qdrant正在扩展视频嵌入和本地代理上下文,以提供高性能的向量搜索服务。

你所说的语义搜索究竟是什么意思?

Stack Overflow Blog Stack Overflow Blog · 2026-05-05T07:40:00Z
什么是pgvector?

pgvector是一个开源的PostgreSQL扩展,支持存储和搜索向量嵌入,适用于语义搜索和推荐功能。它简化了相似性搜索,能够处理数百万到数千万个向量,支持余弦相似度,并可与Postgres全文搜索结合使用。对于高性能需求,pgvectorscale可扩展pgvector的能力。

什么是pgvector?

Databricks Databricks · 2026-04-17T06:59:30Z
Ahsan Hadi:pgEdge Vectorizer和RAG服务器:将语义搜索引入PostgreSQL(第二部分)

pgEdge推出了一个新的AI工具包,旨在简化在PostgreSQL上构建AI驱动的搜索应用。pgEdge Vectorizer作为后台进程,自动监控数据变化,生成嵌入并保持搜索索引同步,消除了手动维护的需求。pgEdge RAG Server提供简单的HTTP API,结合向量相似性和关键词匹配,生成基于实际数据的准确回答,使得在PostgreSQL上实现语义搜索变得高效且易于管理。

Ahsan Hadi:pgEdge Vectorizer和RAG服务器:将语义搜索引入PostgreSQL(第二部分)

Planet PostgreSQL Planet PostgreSQL · 2026-04-15T06:29:33Z
设计解耦:亿级向量搜索

Databricks重新设计了向量搜索系统,以应对从百万到十亿向量的数据集扩展问题。新系统提供标准和存储优化两种部署选项,后者通过分离存储与计算,降低成本和延迟。采用反向文件索引和产品量化等技术,使索引构建速度提高20倍,服务成本降低7倍,适用于语义搜索和推荐系统等应用。

设计解耦:亿级向量搜索

Databricks Databricks · 2026-03-09T19:00:00Z
Redis中的向量索引:算法、混合搜索与扩展

Redis 8集成了多种向量索引算法,支持高效的大规模相似性搜索,优化数据结构以提升搜索速度,适用于语义搜索和推荐系统等应用。

Redis中的向量索引:算法、混合搜索与扩展

Redis Blog Redis Blog · 2026-03-08T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码