RAG设计之评估系统

没有测试数据的性能优化就是放屁。靠脑补做的优化99%都是无效的。 这是我们开会时,大领导们的评价。我觉得说的没毛病🥹 最终沉淀的评估系统是:后端

BFF层服务的前端工程化

这个系列是基于在鹅厂的工程实践,抽象出来的MVP版本实践。 本文就是为了BFF层设计的前端基建内容,在做前端基建之前,还是要再次复习一下我们之

RAG设计之分词器架构实现

分词器不属于单纯的文档解析器,也不属于向量模型,它属于 RAG 的词法检索基础层,是“检索质量增强组件”,核心是: 离线阶段,它在 chunk 生成之后,把 chunk 正文

BFF的服务端设计

号外:发现hono.js是个神器呀,配合上 cloudflare,再加上 AI 时代的需要,又能跨平台、性能还猛…… 这个系列是基于在鹅厂的工程实践,

RAG设计之PDF解析器优化

本文主题是 pdf 解析器,是离线解析文档的入口,也是比较难的一部分,因为 PDF 里面的内容比较复杂,需要考虑很多细节。 例如:表格数据(尤以多个表格排布最难)、图片、页脚引用等等。本文使用到的资料均已脱敏,不涉及到任何公司隐私,仅做个人复盘。