Heibaimeng · 个人技术博客
记录 Web 开发、AI 应用与工程实践的学习笔记—— 把踩过的坑、想通的事,一篇一篇写下来。
最近更新的学习与工程笔记
VS Code + Sweetpad 原生构建插件 + XcodeGen 声明式纯文本管理的组合,打造了一个“无 Xcode 界面依赖”的现代原生 iOS 开发闭环,让 AI 协作更方便。
RAG 中,单靠向量或稀疏检索等粗筛手段,难以应对生产级高精度要求,且多路混合检索的分数存在打分尺度不统一等局限。为此,RAG 通常引入重排序精排模型作为过滤屏障。本文从介绍重排模型的基本概念与基础使用,到多源数据合并、动态截断算法以及字符预算控制等核心流水线的设计与实现。
本文对比了稠密向量与稀疏向量的几何特征,并结合 PyMilvus SDK 提供了双路混合检索(加权分数融合与倒数排名融合 RRF 算法)从特征生成、多特征建表索引到单路与多路检索调用的开发实战。
在 RAG 系统中,多模态结构化提取能力是重要基石,我们可以使用以 MinerU 这类智能多模态解析方案,在复杂文档的处理中还原表格与物理图像的真实轮廓,极大增强知识切片的高可信度。
对于大模型对话 Agent 的会话与记忆管理,黑白梦博客助手采用了一套“双存储解耦架构”:以 Redis 作为轻量级的短期运行快照,结合 LangGraph 的 Checkpoint 机制实现动态上下文剪裁;以 MySQL 作为长期全局档案,实现精准溯源与冷启动恢复。
在构建大模型系统时,流式输出已成为 AI 产品的标配。本文将详解一套基于 Server-Sent Events (SSE) 的全链路方案,涵盖基础的单接口双流同步与流中断机制,延伸至双通道异步队列解耦与长连接生命周期清理,以及 Nginx 反向代理部署和防缓冲优化。
成体系的主题合集,适合按顺序阅读
使用 Next.js 搭建 SSR 全栈 demo ,以及构建 SSG 纯静态博客,记录学习和使用笔记
整理一些开发相关的好用软件、网站、工具等
收集一些好用的前端开源库,主要是 npm 包
记录 JavaScript 刷题时用到的一些语法、代码片段、工具、经验等
一些 MySQL 使用过程中的记录
一些博客建设的记录