ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

PandaWiki 快速上手指南:从 Docker 安装到 AI 知识库搭建全流程

PandaWiki 快速上手指南:从 Docker 安装到 AI 知识库搭建全流程 后端前端人工智能AI 应用RAG知识管理【免费下载链接】PandaWikiPandaWiki 是一款 AI 大模型驱动的开源知识库搭建系统帮助你快速构建智能化的 产品文档、技术文档、FAQ、博客系统借助大模型的力量为你提供 AI 创作、AI 问答、AI 搜索等能力。项目地址https://gitcode.com/gh_mirrors/pa/PandaWiki点击查看免费下载PandaWiki 是一款 AI 大模型驱动的开源知识库搭建系统帮助团队快速构建产品文档、技术文档、FAQ 与博客站点并提供 AI 创作、AI 问答、AI 搜索三大智能化能力。本文以仓库根目录 README.md 为主线结合 backend/config/config.go、backend/handler/v1/model.go 等源码完整讲解从 Docker 环境准备、一键安装、控制台登录到 AI 模型接入、知识库创建与内容导入的实战全流程读完即可上手搭建属于自己的智能 Wiki 站点。PandaWiki 是什么PandaWiki 是一个前后端分离的开源项目仓库结构可参考 PROJECT_STRUCTURE.md主体由以下几部分组成后端服务backend/使用 Go 语言编写提供 API、业务逻辑与数据存储入口位于 backend/cmd/api/main.go其中panda-wiki-api提供 HTTP 服务panda-wiki-consumer负责消费消息队列中的异步任务如文档解析、RAG 学习。管理后台web/admin/React TypeScript 编写的控制台用于管理知识库、用户、模型与站点。Wiki 网站前台web/app/面向访问者的知识库阅读与 AI 问答界面支持网页挂件、钉钉/飞书/企业微信机器人等形态。RAG SDKsdk/rag/面向开发者的检索增强生成Retrieval-Augmented Generation工具包包含数据集、文档、检索等能力。它的核心价值在于以知识库为单位组织文档为每个知识库分别生成独立的 Wiki 网站并用大模型为文档赋予创作、问答与搜索能力。功能与特色AI 驱动智能化AI 辅助创作、AI 辅助问答、AI 辅助搜索底层依赖大模型与 RAG 检索能力。强大的富文本编辑能力兼容 Markdown 与 HTML支持导出为 Word、PDF、Markdown 等多种格式。轻松与第三方应用集成可做成网页挂件挂在其他网站上也可做成钉钉、飞书、企业微信等聊天机器人对应实现位于 backend/pkg/bot/。通过第三方来源导入内容支持按网页 URL 导入、通过网站 Sitemap 导入、通过 RSS 订阅、通过离线文件导入等对应实现位于 backend/pkg/anydoc/ 与 backend/usecase/crawler.go。系统架构与部署形态一览在正式安装前先理解系统的运行形态有助于排障。从源码与 Docker 构建文件可以梳理出部署的基本组成API 服务与消费者服务Dockerfile 同时构建panda-wiki-api与panda-wiki-migrate两个二进制见 backend/Dockerfile.api启动时会先执行数据库迁移再启动 API 服务而消费者服务backend/cmd/consumer/main.go负责启动 MQ 消费者处理异步任务。基础组件从 backend/config/config.go 的默认配置可以看到系统依赖 PostgreSQL数据库、NATS消息队列mq.type默认nats、Redis缓存、MinIOS3 对象存储与 Caddy反向代理/证书管理默认配置caddy_api。RAG 检索组件默认rag.provider为ct对接ct_rag服务用于文档切片、向量化与检索。上述是源码中体现的默认拓扑实际一键安装时官方安装脚本会以 Docker 容器形式编排这些组件读者无需手工搭建。环境要求安装 PandaWiki 需要一台支持 Docker 20.x 及以上版本的 Linux 服务器并使用 root 权限登录执行安装命令。安装脚本会完成环境检查、镜像拉取与容器编排整个过程会持续几分钟请耐心等待。安装 PandaWiki登录服务器后直接执行官方提供的一键安装命令bash -c $(curl -fsSLk https://release.baizhi.cloud/panda-wiki/manager.sh)执行过程中按照命令提示的选项进行安装即可。安装完成后命令终端会输出如下形式的部署结果信息SUCCESS 控制台信息: SUCCESS 访问地址(内网): http://*.*.*.*:2443 SUCCESS 访问地址(外网): http://*.*.*.*:2443 SUCCESS 用户名: admin SUCCESS 密码: **********************请妥善保存输出的访问地址、用户名、密码后续登录与配置都会用到。从后端入口代码 backend/cmd/api/main.go 可以看出API 服务会读取配置中的HTTP.Port并启动 HTTP 服务同时会执行证书初始化检查setup.CheckInitCert这也是安装阶段需要等待几分钟的原因之一。登录 PandaWiki 控制台使用浏览器打开安装输出中的访问地址即可看到 PandaWiki 控制台的登录入口。使用输出的用户名admin和密码登录即可进入控制台。控制台web/admin/是日常管理入口你可以在这里管理知识库并上传文档等待系统完成文档学习配置 AI 模型与模型参数管理导航、用户权限、访问控制与统计信息等。配置 AI 模型让 AI 能力生效的前提PandaWiki 是由 AI 大模型驱动的 Wiki 系统在未配置大模型的情况下AI 创作、AI 问答、AI 搜索等功能无法正常使用。首次登录时会提示需要先配置 AI 模型可自行选择一键配置或手动配置两种配置模式从源码 backend/domain/model.go 与 backend/handler/v1/model.go 可以看到模型配置支持auto自动与manual手动两种模式SwitchModeReq.Mode字段取值manual/auto一键配置自动模式填写百智云BaiZhiCloudAPI Key 即可自动接入对话、向量化等模型适合希望最快跑通全流程的用户SwitchModeReq中的AutoModeAPIKey与AutoModeProvider即对应此模式。手动配置手动模式自主填写供应商、模型名称、BaseURL、API Key 等字段适合已有其他大模型服务商的用户。模型类型与参数说明模型中Type字段支持以下类型ModelType见 backend/domain/model.go类型说明chat对话模型用于 AI 问答与创作embedding向量化模型用于文档切片后的向量索引rerank重排序模型用于提升检索结果相关性analysis文档分析模型RAG 分析analysis-vl视觉分析模型支持图片理解手动配置时还会用到以下字段BaseModelInfoprovider模型供应商如BaiZhiCloudmodel模型名称base_url服务地址必填api_keyAPI 密钥api_header自定义请求头可选api_versionAzure OpenAI 等场景下的 API 版本号可选。此外模型还支持高级参数ModelParamcontext_window上下文窗口、max_tokens最大生成长度、temperature采样温度以及support_images、support_prompt_cache等能力开关。保存前控制台会调用/api/v1/model/check接口对模型连通性进行校验对应 backend/handler/v1/model.go 中的CheckModel底层通过 ModelKit 发起真实请求验证也可通过获取供应商支持模型列表接口/api/v1/model/provider/supported拉取某个供应商当前可用的模型清单避免手填名称出错。后端模型配置的底层实现在 backend/domain/model.go 中Model结构体记录了每次调用的 token 消耗PromptTokens、CompletionTokens、TotalTokens方便控制台统计用量。配置完成后系统会将模型元数据供应商、名称、API Key、BaseURL、温度等转换为 ModelKit 的ModelMetadata见ToModelkitModel供 LLM 调用链路统一使用。创建知识库知识库是一组文档的集合PandaWiki 会根据知识库中的文档为不同的知识库分别创建对应的Wiki 网站。在控制台创建知识库时需要为知识库规划对外访问方式。从领域模型 backend/domain/knowledge_base.go 可以看到每个知识库都带有AccessSettings访问设置包括ports/ssl_portsHTTP / HTTPS 访问端口hosts绑定的域名或主机public_key/private_keyHTTPS 证书base_url自定义基础访问地址simple_auth简单密码访问开启后需输入密码才能阅读enterprise_auth企业认证对接统一登录源is_forbidden是否禁止访问。系统会根据这些设置自动推导出 Wiki 网站的访问地址见GetBaseUrl方法优先使用base_url否则依据 hosts 与端口拼接 http/https 地址。也就是说每个知识库既可以完全公开也可以设置密码保护或企业认证。创建完成后即可向知识库上传文档系统会将文档纳入 RAG 学习流程等待学习成功后可进行 AI 问答。通过第三方来源导入内容除了直接上传文档PandaWiki 还支持从多种第三方来源批量导入内容。从爬虫 API 定义 backend/api/crawler/v1/crawler.go 与用例层 backend/usecase/crawler.go 可以看到crawler_source支持以下来源来源说明URL按网页链接导入单个页面Sitemap通过网站 Sitemap 批量导入整站内容RSS通过 RSS 订阅源持续导入File离线文件导入上传后解析Feishu飞书文档空间导入需配置 AppID / AppSecret / UserAccessToken / SpaceIdDingtalk钉钉文档导入ConfluenceConfluence 空间导入EpubEPUB 电子书导入Mindoc / Wikijs / Siyuan / Yuque其他常见 Wiki 系统内容导入导入任务通过消息队列异步执行任务状态包含pending、in_process、completed、failed四种见 backend/consts/crawler.go控制台可查询任务结果并选择性地将解析出的文档加入知识库。开始使用如果你顺利完成了以上步骤那么恭喜你属于你的 PandaWiki 已经搭建成功接下来你可以访问控制台来管理你的知识库并上传文档等待文档学习成功访问Wiki 网站使用知识库并测试 AI 问答效果。在 Wiki 网站上访问者可以浏览文档目录、全文搜索并与知识库进行 AI 问答——系统基于 RAG 技术先从知识库中检索相关片段再交由对话模型组织回答从而让问答结果有据可依RAG 相关能力可参考 sdk/rag/ 中的数据集、文档与检索接口定义。遇到问题怎么办如在使用产品过程中遇到问题可以通过以下方式获取帮助查阅官方文档中的常见问题章节更多内容请参考官方文档目录不想翻文档时使用官方文档站内的 AI 问答快速获取答案加入官方交流群images/wechat.png 为交流群二维码与更多用户及官方人员交流经验、获得帮助。贡献与许可证欢迎通过提交 Pull Request 或创建 Issue 来帮助改进项目。本项目采用GNU Affero General Public License v3.0 (AGPL-3.0)许可证详见 LICENSE这意味着你可以自由使用、修改和分发本软件你必须以相同的许可证开源你的修改如果你通过网络提供服务也必须开源你的代码商业使用需要遵守相同的开源要求。附录部署相关配置参考对于需要深度定制部署如自建组件、替换默认存储与消息队列的场景可以参考后端配置模块 backend/config/config.go。配置采用默认值 配置文件 环境变量覆盖三级机制默认值内置 PostgreSQLpanda-wiki-postgres、NATSnats://169.254.15.13:4222、Redispanda-wiki-redis:6379、MinIOpanda-wiki-minio:9000等默认连接配置文件支持config.yml覆盖通过 viper 加载环境变量覆盖敏感信息优先以环境变量注入例如环境变量作用POSTGRES_PASSWORD/PG_DSN数据库连接NATS_PASSWORD/MQ_NATS_SERVER消息队列REDIS_PASSWORD/REDIS_ADDRRedisJWT_SECRETJWT 签名密钥S3_SECRET_KEY/S3_ENDPOINT对象存储RAG_CT_RAG_BASE_URLRAG 检索服务地址ADMIN_PASSWORD初始管理员密码LOG_LEVEL日志级别-4debug、0info、4warn、8error数据库迁移脚本位于 backend/store/pg/migration/API 服务启动时会自动执行迁移见 backend/Dockerfile.api 中的panda-wiki-migrate确保表结构与版本匹配。按照本指南完成安装、模型配置与知识库创建后你就拥有了一个可对外发布、可 AI 问答、可持续从第三方来源导入内容的智能知识库站点。赞分享后端前端人工智能AI 应用RAG知识管理【免费下载链接】PandaWikiPandaWiki 是一款 AI 大模型驱动的开源知识库搭建系统帮助你快速构建智能化的 产品文档、技术文档、FAQ、博客系统借助大模型的力量为你提供 AI 创作、AI 问答、AI 搜索等能力。项目地址https://gitcode.com/gh_mirrors/pa/PandaWiki点击查看免费下载相关推荐WeKnora快速上手指南10分钟搭建企业级AI知识库WeKnora是一款基于大语言模型的AI框架为深度文档理解、语义检索和上下文感知回答提供强大支持。本指南将带您快速完成WeKnora的容器化部署实现从零到一人工智能大模型RAGAI Agent后端前端MCP 服务知识库dsh-plugin工具调用Open Notebook快速上手5步搭建私有AI知识库Open Notebook快速上手5步搭建私有AI知识库 为什么选择Open Notebook 在数据隐私日益重要的今天你是否厌倦了将个人研究数据交给第三方人工智能AI 应用RAG后端前端终极AI知识库搭建指南用PandaWiki打造智能知识管理系统终极AI知识库搭建指南用PandaWiki打造智能知识管理系统 PandaWiki是一款由AI大模型驱动的开源知识库搭建系统帮助用户快速构建智能化的产品文档后端前端人工智能AI 应用RAG知识管理上一篇如何永久备份微信聊天记录WeChatMsg完整导出与数据分析终极指南下一篇Forza Mods AIO地平线4/5玩家必备的3大核心功能完全指南创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表