<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>AI on Leanku 的博客</title><link>https://www.leanku.com/tags/ai/</link><description>Recent content in AI on Leanku 的博客</description><generator>Hugo</generator><language>zh-cn</language><lastBuildDate>Fri, 21 Nov 2025 00:01:01 +0800</lastBuildDate><atom:link href="https://www.leanku.com/tags/ai/index.xml" rel="self" type="application/rss+xml"/><item><title>从零到一搭建个人AI知识库</title><link>https://www.leanku.com/post/ai/%E4%BB%8E%E9%9B%B6%E5%88%B0%E4%B8%80%E6%90%AD%E5%BB%BA%E4%B8%AA%E4%BA%BAai%E7%9F%A5%E8%AF%86%E5%BA%93/</link><pubDate>Fri, 21 Nov 2025 00:01:01 +0800</pubDate><guid>https://www.leanku.com/post/ai/%E4%BB%8E%E9%9B%B6%E5%88%B0%E4%B8%80%E6%90%AD%E5%BB%BA%E4%B8%AA%E4%BA%BAai%E7%9F%A5%E8%AF%86%E5%BA%93/</guid><description>&lt;h1 id="从零到一搭建个人ai知识库"&gt;从零到一搭建个人AI知识库&lt;/h1&gt;&#10;&lt;p&gt;为什么要搭建个人AI知识库？&lt;/p&gt;&#10;&lt;p&gt;电脑里存了几百个文档，却怎么也找不到上周写的那份技术方案；&#10;收藏了无数篇优质文章，等到想用时却像大海捞针。&#10;在这个信息过载的时代，我们每个人都在知识管理的泥潭中挣扎。&lt;/p&gt;&#10;&lt;p&gt;AI知识库，正在改变这一切。想象一下：当你需要某个资料时，不用在十几个软件间来回切换，只需在一个搜索框里输入问题，AI就能立即从所有文档中精准定位，不仅给出答案，还会把相关内容整理好放在你面前。&lt;/p&gt;&#10;&lt;p&gt;本篇将介绍从零开始，一步步搭建一个属于自己的AI知识库。&lt;/p&gt;&#10;&lt;h2 id="一理解核心概念什么是rag"&gt;一、理解核心概念：什么是RAG？&lt;/h2&gt;&#10;&lt;p&gt;RAG（检索增强生成，Retrieval-Augmented Generation）&lt;/p&gt;&#10;&lt;p&gt;传统的AI大模型（如GPT）虽然知识渊博，但它们有一个致命缺陷：知识是固定的，且可能产生“幻觉”（编造出看似合理但完全错误的信息）&lt;/p&gt;&#10;&lt;p&gt;RAG的出现完美解决了这个问题。它的核心思想可以形象地理解为“给AI递小抄”——在回答问题前，先从外部知识库中检索出最相关的信息，然后将这些信息连同问题一起“喂”给AI，让它基于给定的材料进行回答。这就像一场开卷考试：AI不再是凭记忆瞎编，而是有参考资料可以查阅。&lt;/p&gt;&#10;&lt;p&gt;一个完整的RAG系统包含两个阶段：&lt;/p&gt;&#10;&lt;h3 id="阶段一索引构建离线-把文档搬进知识库"&gt;阶段一：索引构建（离线） ——把文档“搬进”知识库&lt;/h3&gt;&#10;&lt;ol&gt;&#10;&lt;li&gt;&lt;strong&gt;加载&lt;/strong&gt;：读取PDF、Word、Markdown等各种格式的文档&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;切分&lt;/strong&gt;：将长文档切成语义完整的小块&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;向量化&lt;/strong&gt;：通过嵌入模型将文本块转换成高维数字向量&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;存储&lt;/strong&gt;：将向量存入专门的向量数据库&lt;/li&gt;&#10;&lt;/ol&gt;&#10;&lt;h3 id="阶段二检索生成在线-回答用户问题"&gt;阶段二：检索生成（在线） ——回答用户问题&lt;/h3&gt;&#10;&lt;ol&gt;&#10;&lt;li&gt;&lt;strong&gt;用户提问&lt;/strong&gt; → 将问题也转换成向量&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;检索&lt;/strong&gt;：在向量数据库中找最相似的Top K个文本块&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;增强&lt;/strong&gt;：将检索结果与问题组合成提示词&lt;/li&gt;&#10;&lt;li&gt;&lt;strong&gt;生成&lt;/strong&gt;：AI基于参考资料生成准确回答&lt;/li&gt;&#10;&lt;/ol&gt;&#10;&lt;p&gt;这个流程听着复杂，但现在有大量开源工具帮你自动完成这一切。&lt;/p&gt;&#10;&lt;h2 id="二选择工具链"&gt;二、选择工具链&lt;/h2&gt;&#10;&lt;p&gt;搭建AI知识库，你不需要从零写代码。以下几类工具可以大幅降低门槛：&lt;/p&gt;&#10;&lt;h3 id="21-大模型ai的大脑"&gt;2.1 大模型（AI的大脑）&lt;/h3&gt;&#10;&lt;ul&gt;&#10;&lt;li&gt;Ollama + DeepSeek：本地部署方案。Ollama是一个模型管理工具，设计思路类似于Docker，专门针对AI模型进行了优化。执行 ollama run deepseek-r1 就能自动下载并运行模型。数据完全留在本地，隐私无忧。&lt;/li&gt;&#10;&lt;li&gt;云API（DeepSeek API、OpenAI等） ：无需本地显卡，按调用量付费，开箱即用。&lt;/li&gt;&#10;&lt;/ul&gt;&#10;&lt;p&gt;对于个人知识库，推荐先从Ollama + DeepSeek入手——免费、隐私保护、够用。&lt;/p&gt;&#10;&lt;h3 id="22-向量数据库知识的仓库"&gt;2.2 向量数据库（知识的仓库）&lt;/h3&gt;&#10;&lt;p&gt;向量数据库是RAG系统的核心存储组件。以下是主流选择：&lt;/p&gt;&#10;&lt;table&gt;&#10;&#9;&lt;thead&gt;&#10;&#9;&#9;&#9;&lt;tr&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;th&gt;数据库&lt;/th&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;th&gt;特点&lt;/th&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;th&gt;适合场景&lt;/th&gt;&#10;&#9;&#9;&#9;&lt;/tr&gt;&#10;&#9;&lt;/thead&gt;&#10;&#9;&lt;tbody&gt;&#10;&#9;&#9;&#9;&lt;tr&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;&lt;strong&gt;Chroma&lt;/strong&gt;&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;轻量级，Python原生，上手最快&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;快速原型、个人项目&lt;/td&gt;&#10;&#9;&#9;&#9;&lt;/tr&gt;&#10;&#9;&#9;&#9;&lt;tr&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;&lt;strong&gt;Qdrant&lt;/strong&gt;&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;性能优秀（5-8ms），单服务部署简单&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;中小规模生产项目&lt;/td&gt;&#10;&#9;&#9;&#9;&lt;/tr&gt;&#10;&#9;&#9;&#9;&lt;tr&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;&lt;strong&gt;Milvus&lt;/strong&gt;&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;性能最强（4-6ms），但需3个服务（etcd+MinIO）&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;大规模、企业级&lt;/td&gt;&#10;&#9;&#9;&#9;&lt;/tr&gt;&#10;&#9;&#9;&#9;&lt;tr&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;&lt;strong&gt;PgVector&lt;/strong&gt;&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;PostgreSQL扩展&lt;/td&gt;&#10;&#9;&#9;&#9;&#9;&#9;&lt;td&gt;已有PostgreSQL的项目&lt;/td&gt;&#10;&#9;&#9;&#9;&lt;/tr&gt;&#10;&#9;&lt;/tbody&gt;&#10;&lt;/table&gt;&#10;&lt;p&gt;&lt;strong&gt;个人项目推荐从Chroma或Qdrant开始&lt;/strong&gt;，资源占用低，部署简单。&lt;/p&gt;&#10;&lt;h3 id="23-一站式平台"&gt;2.3 一站式平台&lt;/h3&gt;&#10;&lt;p&gt;如果你不想自己拼装各个组件，这些开源平台可以一站式搞定：&lt;/p&gt;&#10;&lt;ul&gt;&#10;&lt;li&gt;AnythingLLM：开箱即用，支持多种文档格式，可本地部署.&lt;/li&gt;&#10;&lt;li&gt;Dify：功能全面的开源LLM应用开发平台，支持可视化工作流&lt;/li&gt;&#10;&lt;li&gt;FastGPT：国产开源，知识库功能强大，高性能RAG框架&lt;/li&gt;&#10;&lt;li&gt;MaxKB：轻量级，知识库优先的垂直解决方案&lt;/li&gt;&#10;&lt;/ul&gt;&#10;&lt;h2 id="三动手搭建两种路径"&gt;三、动手搭建：两种路径&lt;/h2&gt;&#10;&lt;h3 id="路径一零代码低代码"&gt;路径一：零代码/低代码&lt;/h3&gt;&#10;&lt;h4 id="步骤1安装ollama并下载模型"&gt;步骤1：安装Ollama并下载模型&lt;/h4&gt;&#10;&lt;pre tabindex="0"&gt;&lt;code&gt;# 安装Ollama（Mac/Linux）&#10;curl -fsSL https://ollama.com/install.sh | sh&#10;&#10;# 下载DeepSeek模型（7B版本，约4GB）&#10;ollama pull deepseek-r1:7b&#10;&#10;# 下载嵌入模型（用于向量化）&#10;ollama pull nomic-embed-text&#10;&lt;/code&gt;&lt;/pre&gt;&lt;h4 id="步骤2安装anythingllm"&gt;步骤2：安装AnythingLLM&lt;/h4&gt;&#10;&lt;p&gt;从 anythingllm.com 下载对应系统的安装包并安装。&lt;/p&gt;</description></item></channel></rss>