
RAG检索增强优化指南
目录 RAG检索增强优化指南一、三代RAG架构对比1.1 架构演进时间线1.2 三代架构详细对比1.3 Naive RAG - 基础架构Python实现示例 1...

目录 RAG检索增强优化指南一、三代RAG架构对比1.1 架构演进时间线1.2 三代架构详细对比1.3 Naive RAG - 基础架构Python实现示例 1...

摘要: 随着大模型从“对话时代”迈向“任务执行时代”,智能体工作流(Agentic Workflow)已...

文章目录 一、LLAMA-Factory简介二、安装LLaMA-Factory三、准备训练数据四、模型训练1. 模型下载2. 全量微调3.lora微调4.QLo...
文章浏览阅读211次。简单来说,提示词工程是关于如何设计、优化和迭代输入给大语言模型的文本指令(即“提示词”),以引导模型生成期望输出的科学和艺术。LLM 本质...

文章浏览阅读1k次,点赞36次,收藏17次。本文介绍了在4卡4090服务器上部署GraphRAG环境的过程。硬件配置包括双路至强金牌6148处理器、128GB内...
文章浏览阅读786次,点赞5次,收藏13次。安装相应的依赖项。“可编辑” 模式意味着当你修改本地项目代码时,Python 环境会直接使用修改后的代码,而不需要重...

文章浏览阅读185次,点赞2次,收藏3次。此demo是自己提的一个需求:用modelscope下载的本地大模型实现RAG应用。毕竟大模型本地化有利于微调,RAG...
文章浏览阅读665次,点赞14次,收藏18次。我们使用的是FreedomIntelligence医疗推理数据集。Question:医学问题描述。:详细的医学推理...

文章浏览阅读1.1k次,点赞30次,收藏27次。模型上下文协议(MCP)是大型语言模型(LLM)与外部数据交互的标准化接口,类似于AI的"USB端口&...

文章浏览阅读811次,点赞29次,收藏8次。本文详细介绍了在配备4块NVIDIA 4090显卡的高性能服务器上部署Ollama环境的全过程。内容包括:硬件配置(...