获取下载链接
标签
渴望洞悉人工智能浪潮中的下一站前沿?厌倦了纯粹的理论灌输,想亲手打造改变世界的人工智能应用? 那么,你手中握住的,正是一张通往未来智能世界的通行证! 想象一下,你不再仅仅是信息接收者,而是能与AI进行深度对话,指令一下,它便能理解你的意图,生成精准回复,甚至自动执行复杂任务。这,便是我们即将探索的——新一代智能体Agent! 它不只是一款华丽的内容生成器,更是您串联零散任务、整合复杂流程的核心引擎。本书将带您冲破AI技术的迷雾,深度揭示Agent的奥秘。从底层技术框架到上层开发工具,从充满挑战的实战项目到启发未来的前沿进展,我们为您精心设计了7个功能强大的Agent实战案例。无需望洋兴叹,您将亲手搭建,见证这些Agent如何从概念走向现实,让您的AI之旅不再纸上谈兵。 无论您是孜孜不倦的研究学者、寻求突破的开发精英、运筹帷幄的企业管理者,还是渴望走在时代前沿的学子,这本书都将是您不可多得的宝藏。 跟随“咖哥”和“小雪”的智慧足迹,您将踏上一段妙趣横生的Agent开发之旅。我们将带您零距离接触GPT-4模型那令人惊叹的智慧、OpenAI API和Assistants的强大魔力、LangChain的优雅链接、LlamaIndex的知识聚合,以及MetaGPT的革新力量。亲眼见证Agent在办公自动化中如何提升效率,在智能调度中如何优化资源,在知识整合中如何洞察先机,以及在检索增强生成(RAG)领域如何施展非凡本领。 这不止是一本书,更是一次邀请,邀请您一同开启人工智能时代的无限可能。让我们携手并进,在人机协作的浩瀚星空中,共同点亮那颗最璀璨夺目的Agent之星!准备好了吗?未来的智能世界,正向您招手!
第1章 何为Agent,为何Agent 1 1.1 大开脑洞的演讲:Life 3.0 2 1.2 那么,究竟何为Agent 5 1.3 Agent的大脑:大模型的通用推理能力 9 1.3.1 人类的大脑了不起 10 1.3.2 大模型出现之前的Agent 11 1.3.3 大模型就是Agent的大脑 12 1.3.4 期望之峰和失望之谷 14 1.3.5 知识、记忆、理解、表达、推理、反思、泛化和自我提升 18 1.3.6 基于大模型的推理能力构筑AI应用 22 1.4 Agent的感知力:语言交互和多模态 23 1.4.1 语言交互能力 23 1.4.2 多模态能力 24 1.4.3 结合语言交互和多模态能力 25 1.5 Agent的行动力:语言输出和工具使用 25 1.5.1 语言输出能力 25 1.5.2 工具使用能力 26 1.5.3 具身智能的实现 27 1.6 Agent对各行业的效能提升 28 1.6.1 自动办公好助手 29 1.6.2 客户服务革命 29 1.6.3 个性化产品推荐 30 1.6.4 流程的自动化与资源的优化 30 1.6.5 医疗保健的变革 31 1.7 Agent带来新的商业模式和变革 32 1.7.1 Gartner的8项重要预测 33 1.7.2 Agent即服务 34 1.7.3 多Agent协作 36 1.7.4 自我演进的AI 37 1.7.5 具身智能的发展 38 1.8 小结 39 第2章 基于大模型的Agent技术框架 41 2.1 Agent的四大要素 41 2.2 Agent的规划和决策能力 44 2.3 Agent的各种记忆机制 45 2.4 Agent的核心技能:调用工具 46 2.5 Agent的推理引擎:ReAct框架 49 2.5.1 何为ReAct 50 2.5.2 用ReAct框架实现简单Agent 53 2.5.3 基于ReAct框架的提示 56 2.5.4 创建大模型实例 60 2.5.5 定义搜索工具 61 2.5.6 构建ReAct Agent 62 2.5.7 执行ReActAgent 63 2.6 其他Agent认知框架 66 2.6.1 函数调用 66 2.6.2 计划与执行 66 2.6.3 自问自答 66 2.6.4 批判修正 66 2.6.5 思维链 67 2.6.6 思维树 67 2.7 小结 68 第3章 OpenAI API、LangChain和LlamaIndex 70 3.1 何为OpenAI API 71 3.1.1 说说OpenAI这家公司 71 3.1.2 OpenAI API和Agent开发 76 3.1.3 OpenAI API的聊天对话示例 78 3.1.4 OpenAI API的图片生成示例 85 3.1.5 OpenAI API实践 89 3.2 何为LangChain 91 3.2.1 说说LangChain 92 3.2.2 LangChain中的六大模块 98 3.2.3 LangChain和Agent开发 100 3.2.4 LangSmith的使用方法 102 3.3 何为LlamaIndex 105 3.3.1 说说LlamaIndex 105 3.3.2 LlamaIndex和基于RAG的AI开发 106 3.3.3 简单的LlamaIndex开发示例 110 3.4 小结 113 第4章 Agent 1:自动化办公的实现——使用Assistants API和DALL·E 3模型创作PPT 115 4.1 OpenAI公司的Assistants是什么 117 4.2 不写代码,在Playground中玩Assistants 118 4.3 Assistants API的简单示例 123 4.3.1 创建助手 124 4.3.2 创建线程 128 4.3.3 添加消息 130 4.3.4 运行助手 132 4.3.5 显示响应 138 4.4 创建一个简短的虚构PPT 141 4.4.1 数据的收集整理 142 4.4.2 创建OpenAI助手 142 4.4.3 自主创建数据分析图表 144 4.4.4 自主创建数据洞察 149 4.4.5 自主创建页面标题 152 4.4.6 用Dall-E为主题配图 152 4.4.7 自主创建PPT 154 4.5 小结 160 第5章 Agent 2:多功能选择的引擎——通过Functions Calling调用函数 161 5.1 OpenAI中的Functions 163 5.1.1 什么是Functions 163 5.1.2 Function的说明文字很重要 164 5.1.3 Function定义中的Sample是什么? 165 5.1.4 什么是Functions Calling 166 5.2 在OpenAI Playground中定义Function 168 5.3 用Assistants API来实现Functions Calling 173 5.3.1 创建能使用Functions的Assistant 175 5.3.2 不调用Function,直接运行Assistant 177 5.3.3 在Run进入requires_action状态之后跳出循环 185 5.3.4 拿到Assistant返回的元数据信息 186 5.3.5 利用Assistant的返回信息调用函数 187 5.3.6 通过submit_tool_outputs提交结果完成任务 190 5.4 用ChatCompletion API来实现Tool Calls 196 5.4.1 初始化对话和定义可用函数 197 5.4.2 第一次调用大模型,向模型发送对话及工具定义,并获取响应 198 5.4.3 调用模型选择的工具并构建新消息 201 5.4.4 第二次向模型发送对话以获取最终响应 204 5.5 小结 205 第6章 Agent 3:推理与行动的协同——使用LangChain中的ReAct框架实现自动定价 207 6.1 复习一下ReAct推理框架 208 6.2 LangChain中ReAct Agent 的实现 210 6.3 LangChain中的工具和工具包 212 6.4 通过create_react_agent创建鲜花定价Agent 215 6.5 深挖AgentExecutor的运行机制 221 6.5.1 在AgentExecutor中设置断点 221 6.5.2 第一轮思考:模型决定搜索 224 6.5.3 第一轮行动:工具执行搜索 233 6.5.4 第二轮思考:模型决定计算 239 6.5.5 第二轮行动:工具执行计算 241 6.5.6 第三轮思考:模型完成任务 245 6.6 小结 249 第7章 Agent 4:计划和执行的解耦——使用LangChain中的Plan-and-Execute智能调度库存 251 7.1 Plan-and-Solve策略的提出 252 7.2 LangChain中的Plan-and-Execute Agent 257 7.3 用Plan-and-Execute Agent实现物流管理 258 7.3.1 为Agent定义一系列进行自动库存调度的工具 258 7.3.2 创建Plan-and-Execute Agent并尝试一个“不可能完成”的任务 260 7.3.3 改动一下请求,Agent就会成功完成任务 268 7.4 从单Agent到多Agent 273 7.5 小结 273 第8章 Agent 5:知识的提取与整合——使用Llama Index实现检索增强生成Agent 275 8.1 何为检索增强生成 276 8.1.1 提示工程vs RAG vs 微调 278 8.1.2 技术角度的检索 Pipeline 280 8.1.3 用户视角的RAG流程 281 8.2 RAG和Agent 282 8.3 用LlamaIndex的ReAct Agent来实现花语秘境财报检索 284 8.3.1 获取并加载电商文档 284 8.3.2 将文档转换为嵌入向量 285 8.3.3 构建查询引擎和工具 287 8.3.4 配置文本生成引擎大模型 288 8.3.5 创建 Agent查询财务信息 288 8.4 小结 289 第9章 Agent 6:GitHub的网红聚落——AutoGPT、BabyAGI、CAMEL和Generative Agents 292 9.1 AutoGPT 293 9.1.1 AutoGPT简介 293 9.1.2 AutoGPT实战 294 9.2 BabyAGI 298 9.2.1 BabyAGI简介 299 9.2.2 BabyAGI实现 301 9.3 CAMEL 317 9.3.1 CAMEL简介 318 9.3.2 CAMEL论文中的股票交易场景 319 9.3.3 CAMEL实现 324 9.4 小结 333 第10章 Agent 7:多Agent系统框架——AutoGen和MetaGPT 335 10.1 AutoGen 336 10.1.1 AutoGen简介 336 10.1.2 AutoGen实战 340 10.2 MetaGPT 343 10.2.1 MetaGPT简介 343 10.2.2 MetaGPT实战 345 10.3 小结 353 第11章 下一代Agent的诞生地:科研论文中的新思路 355 11.1 两篇高质量的Agent综述 355 11.2 论文选读:Agent自主学习、多Agent合作、Agent可信度的评估、边缘系统部署以及具身智能落地 358 11.3 小结 359 参考文献 361 后记 创新与变革的交汇点 362
《我看见的世界》
《我看见的世界》既是李飞飞的个人史,也是一部波澜壮阔、跌宕起伏的人工智能发展史。 在这本书里,李飞飞回忆了自己从底层移民成长到顶尖科学家的经历。她度过了困顿艰辛的青少年时代,但对科学的热爱不断激励着她持续追寻人生的“北极星”,并最终走进科学的殿堂。 当李飞飞和家人努力适应在美国的生活时,恰逢现代人工...
查看详情 →《生命3.0:人工智能时代,人类的进化与重生》
《生命3.0》一书中,作者迈克斯·泰格马克对人类的终极未来进行了全方位的畅想,从我们能活到的近未来穿行至1万年乃至10 亿年及其以后,从可见的智能潜入不可见的意识,重新定义了“生命”“智能”“目标”“意识”,并澄清了常见的对人工智能的误解,将帮你构建起应对人工智能时代动态的全新思维框架,抓住人类与人...
查看详情 →《为什么:关于因果关系的新科学》
本书聚焦因果关系领域的权威朱迪亚·珀尔及其团队在多年的研究中取得的突破,清晰地揭示了知识的本质以及科学探究对因果框架的核心地位。作者把因果观念带入人工智能领域,强调其真正的应用价值在于此。书中要回答的核心问题是:如何让智能机器具备像人类一样的思考能力?换言之,强人工智能是否能够实现?通过对因果推理分...
查看详情 →《克拉拉与太阳》
阳光始终会照在我们身上,无论我们身处何地。 克拉拉是一台专为陪伴儿童而设计的太阳能人工智能机器人,具备出色的观察、推理与共情能力。她安放在商店的橱窗里,注视着经过的人群与前来逛橱窗的孩子们的一举一动。她始终期望着被人选中,获得改变命运的机会;然而,当这样的时刻来临时,她又被提醒不要过分相信人类的承...
查看详情 →