共 210 篇,记录学习与工程实践中的心得与笔记
VS Code + Sweetpad 原生构建插件 + XcodeGen 声明式纯文本管理的组合,打造了一个“无 Xcode 界面依赖”的现代原生 iOS 开发闭环,让 AI 协作更方便。
RAG 中,单靠向量或稀疏检索等粗筛手段,难以应对生产级高精度要求,且多路混合检索的分数存在打分尺度不统一等局限。为此,RAG 通常引入重排序精排模型作为过滤屏障。本文从介绍重排模型的基本概念与基础使用,到多源数据合并、动态截断算法以及字符预算控制等核心流水线的设计与实现。
本文对比了稠密向量与稀疏向量的几何特征,并结合 PyMilvus SDK 提供了双路混合检索(加权分数融合与倒数排名融合 RRF 算法)从特征生成、多特征建表索引到单路与多路检索调用的开发实战。
在 RAG 系统中,多模态结构化提取能力是重要基石,我们可以使用以 MinerU 这类智能多模态解析方案,在复杂文档的处理中还原表格与物理图像的真实轮廓,极大增强知识切片的高可信度。
对于大模型对话 Agent 的会话与记忆管理,黑白梦博客助手采用了一套“双存储解耦架构”:以 Redis 作为轻量级的短期运行快照,结合 LangGraph 的 Checkpoint 机制实现动态上下文剪裁;以 MySQL 作为长期全局档案,实现精准溯源与冷启动恢复。
在构建大模型系统时,流式输出已成为 AI 产品的标配。本文将详解一套基于 Server-Sent Events (SSE) 的全链路方案,涵盖基础的单接口双流同步与流中断机制,延伸至双通道异步队列解耦与长连接生命周期清理,以及 Nginx 反向代理部署和防缓冲优化。
在构建大模型应用时,RAG 检索增强生成是引入私有知识的标配方案。本次实战以黑白梦博客的数据为基础,从数据处理、向量库同步、多视角检索等维度,探索如何从零构建一个 RAG 检索系统。
在 Electron 中运行重度依赖 C/C++ 原生模块或高负载计算任务时,内置的 Node.js 可能会遇到底层兼容瓶颈。为此,将标准的 Node.js 可执行文件打包进应用,并作为独立子进程运行,是一种稳妥的架构解法。本文结合打包 onnxruntime-node 等原生模块的踩坑记录,分享该方案的落地细节。
Transformers.js 是 Hugging Face 生态系统中的一款工具库,可以在浏览器或 Node.js 环境中执行自然语言处理、计算机视觉和音频处理等任务。本文结合一款 Electron 本地翻译应用的项目开发经验,探索 Transformers.js 在真实场景下的落地过程。
Tesseract.js 提供了一套轻量级的 JavaScript OCR 解决方案,兼容浏览器与 Node.js 环境。本文将结合项目的工程实践,阐述如何通过本地语言包、图像预处理与任务队列机制,在 Electron 客户端构建完整的离线图像文字识别模块。
视觉小说(Visual Novel)作为一种重叙事、沉浸感的游戏类型,也是 Galgame 题材中的最主要游戏类型。Ren'Py 是最常用的开发引擎之一,基于 Python ,跨平台。本次实战规划了一个简单的的项目,尝试系统性入门 Ren'Py 的最常用的核心技术点。
Python 的异步核心是 `asyncio`,它是一个内置的标准库。它跟 JS 都是 “事件循环 + 非阻塞 IO” 的结构,可对照学习其异同。本文涵盖 async await 语法、创建任务、并发运行、异步生成器、并发数控制、错误处理等方面。
介绍 React Query 的核心概念、API ,及其在项目管理后台项目中的实践,涵盖了基于 Next.js App Router 的单例 Provider 配置、结合 URL 参数的数据获取策略以及自动缓存失效机制。
Lucia 提供基于 Session + Cookie 的登录校验方案,服务端通过校验会话拿到用户信息,前端通过受保护页面与接口的组合完成登录态管理。本篇笔记用于记录博客的 SSR 改造中,Lucia 在 Next.js App Router 中的实践。
使用 unstable_cache + revalidateTag 组合实现 Next.js 服务端函数缓存,并了解 fetch 缓存和多个实例间共享缓存等。
在 iOS Safari 中有一个奇怪的问题,在输入框做复杂的编辑,忽然发现整个网页所有按钮都无法点击了。该问题是 iOS Safari 在粘贴过程中的焦点状态不稳定导致。需要在粘贴后失焦时,轻量恢复焦点与选区,保证用户粘贴后的光标位置正确。
记录如何在 Ubuntu 上创建并启用 Swap 交换空间,并配置为开机自动生效,同时包含可选的内核参数调优步骤。
最近将博客从 SSG 改成了 SSR ,基于原有的数据库和前台界面,通过 AI 编程完全重写写了后端接口和管理端界面,实现前后端同构、服务端渲染等。在此记录一些部署中遇到的问题,以及 PM2 + Nginx 的部署配置信息。
为 AI 编程搭建一套稳定、可复用的工作流,通过 SPEC → PLAN → TASK 这套流程,可解决需求混乱、上下文漂移、输出不稳定等常见问题。
Agent Skill 推出以来,各个 AI 编程工具都已增加对它的支持。这里以 Trea 为示例,了解如何使用已有的成熟 Skill ;并可通过 npx skills 查看、发现和一键安装 Skill 。以及初步尝试创建自定义 Skill。