描述
內容簡介
| .智慧代理定義與發展:代理等級、使用動機與落地路徑
.智慧代理核心元件:LLM、工具、記憶、規劃與 RAG .實驗環境建置:網頁對話、程式碼對話與工程骨架 .大模型基礎:Transformer、資料清洗、斷詞、預訓練、微調與對齊 .解碼策略與模型評測:Sampling、幻覺機制、MMLU、C-EVAL、GSM8K、HumanEval 與 OpenCompass .提示詞工程:結構化 Prompt 與常見提示框架 .RAG 系統構建:文件解析、檢索索引、查詢路由、最佳化與 RAGas 評測 .記憶系統工程:token 計數、摘要壓縮、短期與長期記憶,MemGPT、Mem0、BoT .規劃與多智慧代理:CoT、Function Calling、ReAct、Plan-and-Execute,以及 AutoGen、MetaGPT、CrewAI、LangGraph;案例涵蓋智慧家居、AI 辦公、翻譯、知識庫、程式助手與智慧客服
【書籍簡介】 本書共分8章,第1章介紹智慧代理定義、核心元件、代理等級與實驗環境;第2章介紹 Transformer 與大模型訓練流程、解碼與能力評測,並以 OpenCompass 示範評測;第3章介紹提示詞與結構化提示詞,整理多種提示框架與最佳化方法;第4章介紹 RAG 系統建構、文件解析、最佳化策略與 RAGas 評測;第5章介紹記憶模組的手動實作與 MemGPT/Mem0/BoT 框架;第6章介紹規劃能力方法群,包含 CoT、Self-Ask、Function Calling、ReAct、Plan-and-Execute 等;第7章介紹多智慧代理系統核心概念與 AutoGen/MetaGPT/CrewAI/LangGraph 實作;第8章以智慧家居、AI辦公、翻譯、知識庫、程式助手與智慧客服等案例完成整合實戰。 |
作者簡介
| 尹浩
畢業於對外經濟貿易大學,研究方向為邊緣智能、多智能體系統、自然語言處理與大數據,先後任職於開鴻、中國平安等公司,擔任資深算法工程師。擅長大模型應用、深度學習、自然語言處理、大數據中台等相關技術,特別是在AIOS、非結構化文檔理解等領域有深入研究,目前主要從事開源鴻蒙操作系統的原生AI推理和大模型智能體開發工作。發表了三篇技術專利和一篇實用性發明專利論文。 |
目錄
| 第 1 章 智慧代理系統概述
1.1 什麼是智慧代理 1.1.1 智慧代理初識 1.1.2 智慧代理的概念 1.2 智慧代理的核心元件概述 1.2.1 大語言模型 1.2.2 工具模組 1.2.3 記憶模組 1.2.4 規劃模組 1.2.5 RAG 模組 1.3 智慧代理的發展歷程 1.4 智慧代理的等級劃分 1.4.1 RASA 1.4.2 Google 1.4.3 類自動駕駛 1.5 為什麼要使用智慧代理 1.5.1 大型模型的缺點 1.5.2 智慧代理的特點 1.6 什麼是多智慧代理協同 1.7 實驗環境建置 1.7.1 網頁版對話測試 1.7.2 程式碼版對話測試 1.8 本章小結 第 2 章 認識大型模型 2.1 Transformer 的架構原理 2.2 大型模型的訓練流程 2.2.1 資料清洗 2.2.2 分詞技術 2.2.3 位置編碼 2.2.4 模型預訓練 2.2.5 大型模型微調 2.2.6 大型模型對齊 2.2.7 解碼策略 2.2.8 大型模型幻覺 2.3 國內外大型模型介紹 2.3.1 國外知名大型模型 2.3.2 國內知名大型模型 2.3.3 垂直領域大型模型 2.4 大型模型呼叫實戰 2.4.1 呼叫GPT-4 大型模型 2.4.2 呼叫百度文心一言大型模型 2.4.3 呼叫本地大型模型 2.5 大型模型能力評測 2.5.1 為什麼要做大型模型評測 2.5.2 需要評測大型模型的哪些能力 2.5.3 如何評測大型模型 2.6 常用的評測資料集介紹 2.6.1 MMLU 資料集 2.6.2 C-EVAL 資料集 2.6.3 MATH 資料集 2.6.4 GSM8K 資料集 2.6.5 HumanEval 資料集 2.7 大型模型評測網站—OpenCompass 2.7.1 OpenCompass 介紹 2.7.2 大型模型排行榜 2.7.3 OpenCompass 評測工具介紹 2.7.4 資料集評測實戰 2.8 本章小結 第 3 章 提示詞工程 3.1 提示詞 3.1.1 提示詞的基本概念與特點 3.1.2 提示詞的範例 3.2 結構化提示詞 3.2.1 結構化提示詞的基本概念 3.2.2 結構化提示詞的範例 3.3 提示工程 3.3.1 ICIO 框架 3.3.2 CRISPE 框架 3.3.3 APE 框架 3.3.4 BROKE 框架 3.3.5 CARE 框架 3.3.6 COAST 框架 3.3.7 RACE 框架 3.3.8 RISE 框架 3.3.9 ROSES 框架 3.3.10 TAG 框架 3.3.11 TRACE 框架 3.4 提示詞的最佳化方法 3.5 自動生成提示詞 3.6 本章小結 第 4 章 RAG 系統的建構 4.1 RAG 介紹 4.1.1 RAG 的基本概念 4.1.2 RAG 系統的構成 4.2 極簡RAG 實作 4.2.1 建置階段實作 4.2.2 檢索生成實作 4.2.3 RAG 流程測試 4.3 文件解析 4.3.1 檔案類型介紹 4.3.2 Word 文件擷取 4.3.3 半結構化文本擷取 4.3.4 郵件文字擷取 4.3.5 PDF 文字擷取 4.3.6 表格文字擷取 4.3.7 圖片文字擷取 4.4 RAG 最佳化方法 4.4.1 資料處理最佳化方法 4.4.2 查詢路由最佳化方法 4.4.3 索引最佳化方法 4.5 基於 LangChain 的 RAG 實作 4.5.1 LangChain 介紹 4.5.2 LangChain 的RAG 資料流程 4.5.3 文件載入器 4.5.4 文件轉換器 4.5.5 文本嵌入模型 4.5.6 向量儲存 4.5.7 知識檢索 4.5.8 基於LangChain 建構完整的RAG 系統 4.6 評測RAG 系統的效能 4.6.1 RAGas 框架介紹 4.6.2 RAG 系統評測實戰 4.7 本章小結 第 5 章 記憶體模組 5.1 記憶體模組介紹 5.1.1 什麼是記憶 5.1.2 記憶的作用 5.1.3 記憶的資訊類型 5.1.4 記憶的壓縮方法 5.2 手動實作 Memory 實踐 5.2.1 計算token 數 5.2.2 摘要總結實作 5.2.3 短期記憶實作 5.2.4 長期記憶實作 5.2.5 記憶測試 5.3 MemGPT 框架 5.3.1 MemGPT 框架介紹 5.3.2 基於MemGPT 的案例實作 5.3.3 MemGPT 框架原始碼解析 5.4 Mem0 框架 5.4.1 Mem0 框架介紹 5.4.2 基於Mem0 的案例實作 5.4.3 Mem0 框架原始碼分析 5.5 BoT 框架 5.5.1 BoT 框架介紹 5.5.2 基於BoT 的案例實踐 5.5.3 BoT 框架原始碼解析 5.6 本章小結 第 6 章 規劃能力 6.1 思維鏈 6.1.1 思維鏈介紹 6.1.2 CoT 案例分析 6.1.3 CoT 程式設計實踐 6.2 Self-Ask 6.2.1 Self-Ask 介紹 6.2.2 Self-Ask 案例實踐 6.2.3 Self-Ask 程式設計實踐 6.3 Self-Reflexion 6.3.1 Self-Reflexion 介紹 6.3.2 Self-Reflexion 案例實踐 6.3.3 Self-Reflexion 程式實作 6.4 Function Calling 6.4.1 Function Calling 介紹 6.4.2 Function Calling 案例實作 6.4.3 Function Calling 程式設計實務 6.5 ReAct 6.5.1 ReAct 介紹 6.5.2 ReAct 案例實踐 6.5.3 ReAct 程式設計實作 6.6 Plan-and-Execute 6.6.1 Plan-and-Execute 介紹 6.6.2 Plan-and-Execute 案例實作 6.6.3 Plan-and-Execute 程式實作 6.7 Self-Discover 6.7.1 Self-Discover 介紹 6.7.2 Self-Discover 案例實踐 6.7.3 Self-Discover 程式設計實作 6.8 本章小結 第 7 章 多智慧代理系統 7.1 多智慧代理系統介紹 7.1.1 單智慧代理系統概述 7.1.2 多智慧代理系統的特點 7.2 多智慧代理系統的核心 7.2.1 互動環境 7.2.2 協作類型 7.2.3 組織結構 7.2.4 通訊機制 7.2.5 衝突解決 7.3 AutoGen 框架 7.3.1 AutoGen 框架介紹 7.3.2 基本概念 7.3.3 單智慧代理範例說明 7.3.4 多智慧代理範例說明 7.3.5 原始碼分析 7.4 MetaGPT 框架 7.4.1 MetaGPT 框架介紹 7.4.2 單智慧代理範例說明 7.4.3 多智慧代理範例說明 7.4.4 原始碼分析 7.5 CrewAI 框架 7.5.1 CrewAI 框架介紹 7.5.2 基本概念 7.5.3 單智慧代理範例說明 7.5.4 多智慧代理範例說明 7.5.5 原始碼分析 7.6 LangGraph 框架 7.6.1 LangGraph 框架介紹 7.6.2 單智慧代理範例說明 7.6.3 多智慧代理範例說明 7.6.4 原始碼分析 7.7 本章小結 第 8 章 智慧代理案例實戰 8.1 智慧家居助手 8.1.1 MCP 介紹 8.1.2 MCP 架構說明 8.1.3 建置智慧家庭MCP 伺服端 8.1.4 建立智慧家庭MCP 使用者端 8.1.5 建構智慧家庭MCP 智慧代理應用 8.1.6 測試智慧家居智慧代理 8.1.7 案例小結 8.2 AI 辦公助手 8.2.1 AiPPT 介紹 8.2.2 API KEY 申請 8.2.3 自動生成PPT 8.2.4 建構MCP 服務 8.2.5 建構 AiPPT 智慧代理 8.2.6 測試智慧辦公智慧代理 8.2.7 案例小結 8.3 語言翻譯助手 8.3.1 語言翻譯介紹 8.3.2 翻譯素材準備 8.3.3 翻譯助手的架構設計 8.3.4 翻譯助手智慧代理 8.3.5 測試語言翻譯智慧代理 8.3.6 案例小結 8.4 知識庫助手 8.4.1 知識庫助手介紹 8.4.2 知識問答助手 8.4.3 進階版知識問答助手 8.4.4 案例小結 8.5 程式助手 8.5.1 程式助手介紹 8.5.2 程式助手架構設計 8.5.3 LangGPT 結構化提示詞 8.5.4 智慧代理開發 8.5.5 工作流程測試 8.5.6 案例小結 8.6 智慧客服 8.6.1 智慧客服介紹 8.6.2 智慧客服架構設計 8.6.3 資料庫設計 8.6.4 資料庫操作實作 8.6.5 智慧代理開發 8.6.6 智慧客服測試 8.6.7 案例小結 8.7 本章小結 |
序
| 序言
站在人工智慧技術日新月異的風口浪尖,我們正見證一場深刻的變革。以大型模型為代表的生成式 AI 技術蓬勃發展,不僅重塑了人機互動的方式,更催生了智慧代理(Agent)這一充滿潛力的新興技術範式。從最初的單智慧代理執行簡單任務,到如今的多智慧代理協同攻克複雜挑戰,AI 正以前所未有的速度和廣度滲透到我們工作和生活的方方面面。
近年來,筆者親身經歷了 ChatGPT 的橫空出世、國產大型模型效能的飛速迭代,也親自體驗了智慧代理應用從單智慧代理到多智慧代理的進化歷程。這些實踐經歷讓筆者深刻體會到,大型模型技術的飛速發展正帶來無限可能。然而,在這片充滿機遇的技術藍海中,初學者往往面臨資訊碎片化、概念混淆、優質學習資源匱乏的困境。各種專有名詞層出不窮,像「大型模型」「提示詞工程」「RAG」「記憶」「CoT」「多智慧代理協同」等,對於初學者而言,極易感到迷惘和不知所措。與此同時,筆者觀察到國內關於智慧代理和多智慧代理協同的教學資源相對零散。網路上雖然有大量公眾號文章、技術部落格,它們或許能提供一些零星的啟發,但往往缺乏系統性和深度。而相對專業一些的資料,則大多停留在外文論文文獻的層面,閱讀門檻較高,且與實踐應用結合不夠緊密。作為一名電腦領域的從業者,筆者深知一套系統、專業、接地氣的教學對於技術普及和人才培育的重要性,深感有責任將筆者在這幾年實踐中的所見、所學、所思、所感整理成冊,提供給那些渴望系統掌握智慧代理應用開發的同道中人。因此,便有了這本書。
筆者希望這本書能夠成為一座橋樑,幫助那些對大型模型或智慧代理尚不熟悉,但又懷揣熱情與好奇心的讀者,快速、系統地掌握智慧代理的核心概念、關鍵技術,並最終學會建構實用的多智慧代理協同系統。筆者力求用清晰的邏輯、詳實的案例和實用的程式碼,撥開技術迷霧,讓讀者能夠腳踏實地地踏上智慧代理開發之路,將理論知識轉化為解決實際問題的能力。
本書內容 本書共分為8 章,內容安排遵循由淺入深、從理論到實踐的原則,旨在為讀者建立一個完整的多智慧代理協同知識體系。在第1 章代理系統概述中,會先帶領讀者認識什麼是代理,從初識概念到精確定義,並深入瞭解代理的核心元件(如大型語言模型、工具使用、記憶、規劃、RAG 等)及其在系統中的角色,最後還會指導讀者建置基礎的實驗環境。
第2 ∼ 6 章是智慧代理模組的深度解析,是本書的核心部分,將逐一深入剖析智慧代理的各個關鍵模組,為建構強大的智慧代理奠定堅實基礎。
第2 章聚焦「大型模型」,不過度深入訓練細節,而是重點講解其運作原理(如 Transformer)、國內外主流模型、呼叫實戰以及效能評測方法與框架(如OpenCompass),讓讀者掌握如何有效利用大型模型這一「引擎」。
第3 章探討「提示詞工程」,介紹其基本概念、結構化提示詞的設計與應用,並詳細講解多種主流的提示詞最佳化框架(如ICIO、CRISPE、APE 等),幫助讀者學會精準「指揮」大型模型。
第4 章講解「檢索增強生成(RAG)」,闡述其原理、流程,並透過極簡實作、文件解析、最佳化方法以及基於 LangChain 的完整實踐,讓讀者掌握如何為大型模型「賦能」,提升其知識準確性和時效性。
第5 章聚焦「記憶模組」,探討記憶的類型、作用、實作方法,並深入剖析MemGPT、Mem0、BoT 等主流開源框架的原理與原始碼,讓讀者理解如何賦予代理「記憶」能力。
第6 章聚焦「規劃能力」,介紹思維鏈(CoT)、自問自答(Self-Ask)、自我反思(Self-Reflexion)、函式呼叫(Function Calling)、思考行動(ReAct)、計劃與執行(Plan-and-Execute)、自我發現(Self-Discover)等多種認知框架,透過案例和程式設計實踐,讓讀者掌握智慧代理「思考」和「決策」的核心技巧。
第7 章多智慧代理協同部分是本書的重點與昇華,將系統介紹多智慧代理系統的概念、優缺點、核心要素(如互動環境、協作類型、組織結構、通訊機制、衝突解決等)。更重要的是,該章將深入剖析目前主流的多智慧代理協同的開源框架,包括AutoGen、MetaGPT、CrewAI、LangGraph 等,不僅介紹其基本概念和範例,還將進行原始碼層面的解析,讓讀者不僅知其然,更知其所以然,為獨立設計和實作複雜的多智慧代理系統提供強而有力的參考。
第8 章是智慧代理案例實戰,理論最終要服務於實踐。該章將透過6 個精心設計的案例,涵蓋智慧家居、智慧辦公、語言翻譯、知識庫、程式設計輔助、智慧客服等多個熱門領域,完整演示如何從需求分析、架構設計到程式碼實作,建構單智慧代理和多智慧代理應用。這些案例將綜合運用前面章節所介紹的知識和技術,讓讀者在動手實踐中鞏固所學,體驗多智慧代理協同解決實際問題的魅力與價值。
本書特點 本書在撰寫過程中,始終秉持以下幾個原則: (1)實踐導向,程式碼先行:本書並非一本純理論的教科書。筆者深知,對於開發者而言,看得懂、學得會、用得上才是硬道理。因此,本書在講解每個概念、每個模組、每個框架時,都配備了大量的、可直接執行的程式碼範例。相信透過動手實踐,讀者能夠更深刻地理解原理,更快地掌握技能。例如,在介紹大型模型呼叫時,不僅講解其原理,還會給出呼叫 GPT-4、文心一言、本地大型模型的完整程式碼;在講解 RAG 時,會從零開始實作一個簡單的 RAG 流程,並展示如何使用 LangChain 建置完整的 RAG 應用。
(2)聚焦應用,精簡理論:在介紹大型模型等複雜技術時,本書刻意避免陷入過於深奧的理論探討,如大型語言模型的訓練細節、複雜的數學推導等,關 注點在於如何理解、評測、呼叫和應用大型模型,使其更好地服務於智慧代理的建構。例如,第2 章將詳細介紹大型模型的評測方法和框架,因為這直接關係到如何選擇和最佳化用於智慧代理的模型,而不僅僅是模型是如何被訓練出來的。
(3)系統全面,邏輯清晰:本書試圖建構一個相對完整的智慧代理和多智慧代理協同知識體系。從智慧代理的基本概念到各個核心模組的深度解析,再到多智慧代理協同的理論與實踐,內容層層遞進,邏輯清晰連貫。讀者既可以按照章節順序進行系統學習,也可以根據自己的興趣和需求,選擇特定章節進行深入學習。
(4)緊跟前瞻,案例新穎:本書在撰寫過程中,參考了大量最新的研究成果和開源專案,力求內容的前瞻性和時效性俱佳。第8 章的案例選擇也盡量貼近當前的熱門應用情境,如MCP 協定在智慧家庭中的應用、AI 生成PPT 的辦公助手等,旨在讓讀者接觸到最鮮活的技術應用。
本書適合的讀者 本書是為那些希望系統學習並實踐智慧代理與多智慧代理協同技術的讀者而寫的。具體來說,本書適合以下族群: (1)有一定Python 程式設計基礎的開發者:本書包含大量的Python 程式碼範例,讀者需要具備基本的Python 語法知識和程式設計能力,能夠讀懂並嘗試執行這些程式碼。如果讀者完全零基礎,可能需要先補充一些Python 程式設計知識。
(2)對大型模型和智慧代理技術感興趣的技術愛好者或學生:即使不是專業的程式設計師,只要你對人工智慧、大型模型、智慧代理這些熱門話題充滿好奇,並願意投入時間和精力去學習,本書也可以作為你的入門和進階指南,不過具備一定的程式設計基礎會讓你的學習更順暢。
(3)希望將智慧代理技術應用於實際工作場景的工程師或產品經理:如果你正在從事或計畫從事與AI 應用開發相關的工作,本書將為你提供一套系統的方法論和實踐指導,幫助你將智慧代理和多智慧代理協同技術轉化為實際生產力。
(4)已經接觸過大型模型,但希望深入理解智慧代理建構細節的開發者:如果你對大型模型有基本的了解,但在建構真正有用的智慧代理應用時感覺力不從心,那麼本書對智慧代理各模組的深入解析和實戰案例將對你大有裨益。
當然,本書並非要求讀者必須具備深厚的理論背景。筆者相信,透過本書提供的程式碼範例和循序漸進的講解,即使是背景知識相對薄弱的讀者,也能夠在實作的過程中逐步建立起對智慧代理和多智慧代理協同系統的深入理解。智慧代理技術正站在一個激動人心的起點上,其潛力遠未被完全發掘。撰寫本書的過程,於筆者而言,也是一次重新學習和系統梳理的過程。筆者衷心希望,這本書能夠成為讀者探索這片技術新大陸的可靠嚮導,幫助讀者在智慧代理的奇妙世界中找到屬於自己的方向,並最終建構出能夠解決實際問題的、充滿智慧的協同系統。現在,就讓我們一起翻開這本書,踏上這段充滿挑戰與機遇的學習之旅吧! 筆 者 2025 年9 月 |

































