小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

该数据集包含 300 个元认知陷阱问题,覆盖数学、物理、生物、法律、医学、经济学、统计学、伦理学、计算机科学等 121 个领域,涵盖 8 种元认知行为类型,包括自我纠正、陷阱逃脱、转换检测、矛盾解决、渐进发现、多约束处理、专家面板和不确定性决策。GLM-5.2 Agent 是由 TeichAI 使用 Teich 生成的一个 GLM – 5.2...

文本/LaTeX/HTML表格一步搞定!OvisOCR2实现端到端文档智能解析;1.4 万+ 元素标注、万条语言指令!Voxel51 发布 SceneFun3D 室内场景微观交互数据集

HyperAI超神经
HyperAI超神经 · 2026-07-27T06:58:36Z
VLOOK 2026.7:Markdown 排版工具对小团队文档链路的实际价值

VLOOK 2026.7 更新了主题和幻灯片视图。比起视觉效果,我更关心它能否让 Markdown 文档更容易维护、导出和交付,尤其是在小团队缺少完整文档平台时。

VLOOK 2026.7:Markdown 排版工具对小团队文档链路的实际价值

mongona news
mongona news · 2026-07-25T22:39:32Z
视频问诊 SDK 接入怎么评估:看延迟、集成成本、弱网表现、文档质量

确定了用 SDK 接入的方案之后,下一步是在多家 SDK 供应商之间做选择。SDK 接入不是一个”换供应商成本很低”的决定。接入之后至少会绑定一到两年,中途...

视频问诊 SDK 接入怎么评估:看延迟、集成成本、弱网表现、文档质量

实时互动网
实时互动网 · 2026-07-23T07:09:18Z

定位文档库默认引擎 WiredTiger 相对 PG/InnoDB/SQLite/RocksDB 的生态位;钉住 Session→Cache→Reconcile→HS→Checkpoint 主线、站内分工与 17 篇阅读路线,并以 Berenson 隔离词汇与 Durable History 为学术/工程锚点。

【WiredTiger 内核】文档库存储引擎全景:MongoDB 默认引擎的生态位

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-22T00:00:00Z

Keel 0.3 发布:Rust 写的静态类型解释语言补上标准库、Map 和文档站 Keel 0.3 这次更新挺像一个“从实验玩具往可用语言继续推进”的节点。作者把它定位成一门用 Rust 编写、语法接近 Rust、使用体验又想靠近 Python的静态类型解释语言,而且继续强调它在解释执行场景下的速度目标:大约能做到 Python 的 2 到 10 倍,同时维持零注解式的类型推断体验。对...

【Rust日报】2026-07-20 Keel 0.3 发布:Rust 写的静态类型解释语言补上标准库、Map 和文档站

Rust.cc
Rust.cc · 2026-07-20T01:08:09Z

拆解 MongoDB WiredTiger 如何把旧版本挪到 History Store(WiredTigerHS.wt),在 reconciliation / eviction 后仍服务快照读;对照 PostgreSQL 堆版本与 InnoDB undo,并交代 Lookaside 到 Durable History 的工程分叉。

【WiredTiger 内核】History Store 与 Durable History:文档库里的第三种 MVCC

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-19T00:00:00Z
企业文档安全最佳实践(四):集团权限归集与统一管理——横纵立体,密钥定界

文章讨论了文档安全管理中密级体系与密钥体系的结合。密级体系控制文档安全等级,密钥体系确保部门间文档隔离。两者结合实现有效文档共享与安全管理,保护敏感信息,支持总部统一管理与审计,形成立体化文档安全管控体系。

企业文档安全最佳实践(四):集团权限归集与统一管理——横纵立体,密钥定界

绿盟科技技术博客
绿盟科技技术博客 · 2026-07-17T01:07:25Z
如何使用Node.js、Google Gemini和pgvector构建文档的RAG聊天机器人

本文介绍了如何使用检索增强生成(RAG)技术处理大型API文档。通过将文档分块和提取向量,用户可以快速查询相关信息。系统使用Node.js、PostgreSQL和Google Gemini等技术,支持用户上传PDF并通过自然语言提问,返回相关答案。教程详细说明了项目设置、数据库连接、文档处理和查询流程,旨在提高文档的可用性和查询效率。

如何使用Node.js、Google Gemini和pgvector构建文档的RAG聊天机器人

freeCodeCamp.org
freeCodeCamp.org · 2026-07-15T15:26:34Z

本文探讨了Lucene 9.x/10.x中的索引结构,重点介绍了Document、Field、docID及其在倒排和正排索引中的作用。Lucene通过独立的开关管理字段的索引、存储和DocValues,支持多种查询方式。同时分析了Elasticsearch与Lucene的映射关系,以及文档的业务主键和排序聚合的处理方法。

【全文检索引擎】Lucene 文档模型:Field、docID 与正排/倒排

土法炼钢兴趣小组的博客
土法炼钢兴趣小组的博客 · 2026-07-15T00:00:00Z

Rust Web 框架 Cot v0.7 更新了表单、ORM、安全性和文档维护等功能,提升了框架的成熟度。表单系统增加了更多 HTML 属性,ORM 允许字段名与数据库列名解耦,并支持外键策略配置。安全性方面,改进了敏感数据存储方式,文档维护也得到了加强,确保与实际 API 一致。整体上,v0.7 版本注重长期维护和实用性。

【Rust日报】2026-07-14 Cot v0.7 发布:表单、ORM、安全和文档链路一起补强

Rust.cc
Rust.cc · 2026-07-14T01:07:30Z
OCR 教程汇总丨覆盖长文档/端到端/多语言,百度/小红书/华中科大等面向不同场景开源高性能模型,实现多模态文档精准解析

随着大模型的发展,OCR技术成为连接视觉数据与智能应用的重要工具。新一代多模态模型整合了文字识别和信息抽取等功能,推动了OCR在科研、金融和医疗等领域的应用。本文介绍了五款开源OCR模型,包括Unlimited-OCR、Chandra-ocr-2、dots.mocr、Qianfan-OCR和FireRed-OCR,适用于文档解析和手写文字处理等场景,帮助开发者选择合适的解决方案。

OCR 教程汇总丨覆盖长文档/端到端/多语言,百度/小红书/华中科大等面向不同场景开源高性能模型,实现多模态文档精准解析

HyperAI超神经
HyperAI超神经 · 2026-07-13T09:31:26Z
OfficeAce|AI 文档智能生成,轻松搞定简报、纪要、报告

AI Doc产品正式上线,旨在解决临时文档需求和会议纪要整理的痛点。用户可一键生成发布会简报和高质量会议纪要,提升效率,节省时间。AI Doc通过智能识别和整合多种格式材料,确保文档结构清晰、内容准确,适用于多种场景,满足专业需求。

OfficeAce|AI 文档智能生成,轻松搞定简报、纪要、报告

华为云官方博客
华为云官方博客 · 2026-07-09T08:42:02Z
开源DocuBrowser:将一堆文档转化为可搜索、可用的知识库

DocuBrowser 是一款专为 AI 和开发者设计的文档浏览器,通过高效索引和上下文组织,解决传统文档查阅的痛点。它支持多种文档格式,优化 AI 信息获取,提升开发效率,适合大型开源项目和企业知识库,未来有望成为 AI 开发的基础组件。

开源DocuBrowser:将一堆文档转化为可搜索、可用的知识库

极道
极道 · 2026-07-08T22:56:00Z
使用GitHub代理工作流自动化跨仓库文档

文章讨论了GitHub Copilot的功能和应用,强调其能够在14分钟内将空仓库转变为带HTTPS的自定义域,无需手动编辑DNS记录。此外,GitHub Copilot在多个基准测试中表现优异,提供高效的模型选择。作者还分享了使用自动化工具后,高级领导者的工作日常。

使用GitHub代理工作流自动化跨仓库文档

The GitHub Blog
The GitHub Blog · 2026-07-08T21:11:56Z

在将Elasticsearch集群迁移到无服务器时,发现密集向量在文档源中未显示。Elasticsearch为了节省存储,故意省略向量字段。要显示向量字段,需要在搜索API中添加参数:`{ "_source": { "exclude_vectors": false } }`。

文档源中未显示的密集向量

jdhao's blog
jdhao's blog · 2026-07-07T16:18:29Z

Gemma 4是谷歌DeepMind推出的文档解析工具,能够处理扫描和数字PDF,提取发票信息。它通过将PDF页面渲染为高分辨率图像,利用视觉语言模型读取内容,克服传统文本提取工具的局限性。该工具支持灵活的视觉令牌预算,以适应不同文档的复杂性,确保高效准确的提取。

使用Gemma 4进行零样本本地文档解析:将PDF视为图像

KDnuggets
KDnuggets · 2026-07-07T14:00:04Z
企业文档安全最佳实践(三):人员密级匹配与审批流程控制

文章讨论了企业文档的安全管理,强调员工安全等级与文档密级匹配的重要性。为防止敏感信息泄露,文档的升降密需严格审批。通过合理的权限设置和审批流程,企业可有效防止越权访问,提升文档保护效率,确保外发可控可溯,符合合规要求。

企业文档安全最佳实践(三):人员密级匹配与审批流程控制

绿盟科技技术博客
绿盟科技技术博客 · 2026-07-07T09:41:38Z

我的HP OfficeJet 4650打印机坏了,换成了HP OfficeJet Pro 8125e。在Ubuntu 26.04 LTS上设置后,打印正常,但扫描时出现“文档进纸器为空”的问题。运行命令“simple-scan --debug”可以永久修复此问题。

修复Ubuntu文档扫描仪“文档进纸器为空”问题

Lei Mao's Log Book
Lei Mao's Log Book · 2026-07-05T07:00:00Z
如何使用LangChain v1构建RAG驱动的文档问答AI代理

本文介绍了如何使用LangChain、Ollama和Python构建本地RAG驱动的问答AI代理。该代理可以读取个人文档并回答相关问题,确保隐私安全。教程包括Ollama的安装、文档准备、Python代码编写及代理运行步骤。用户可离线使用,无需支付API费用,并可根据需求调整模型和参数以提高回答质量。

如何使用LangChain v1构建RAG驱动的文档问答AI代理

freeCodeCamp.org
freeCodeCamp.org · 2026-07-02T23:21:11Z
在线教程丨32K上下文一次解析数十页文档,百度开源Unlimited OCR,重构长文档复杂场景

近年来,OCR 技术已从简单的文字识别发展为完整的文档理解。新一代 DeepSeek OCR 模型通过引入大语言模型,提升了识别准确率和复杂版面解析能力。百度的 Unlimited OCR 解决了传统 OCR 的效率低和上下文割裂问题,采用 R-SWA 机制,降低计算成本,支持长文档的高效处理,并可扩展至其他任务。

在线教程丨32K上下文一次解析数十页文档,百度开源Unlimited OCR,重构长文档复杂场景

HyperAI超神经
HyperAI超神经 · 2026-06-29T12:57:58Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码