AI应用基础

智能体的基础知识

智能体(Agent)是一种基于大模型,能够理解目标、规划步骤、调用工具并完成任务的 AI 系统。

1

什么是智能体

智能体(Agent)是一种基于大模型,能够理解目标、规划步骤、调用工具并完成任务的 AI 系统。

智能体配合大模型有哪些能力:

  • 理解人的目标
  • 分析任务
  • 制定步骤
  • 调用工具
  • 完成工作

一句话:

大模型负责思考,智能体负责行动。

2

大模型和智能体的区别

大模型拥有各种能力,文字理解与生成,图像生成与识别,视频生成与理解,语音处理,代码生成等。智能体是把大模型的能力组合调度起来,完成一系列的任务。

制作一个短视频的智能体

  1. 使用文字大模型(多模态大模型)理解要做的短视频是什么
  2. 使用文字大模型生成分镜脚本
  3. 根据分镜脚本使用文字大模型生成分镜图片提示词
  4. 根据分镜图片提示词调用图片大模型生成分镜图片
  5. 根据分镜图片以及分镜脚本调用视频生成大模型生成分段视频
  6. 根据分段视频以及分镜脚本调用音频模型生成分短配音
  7. 使用代码生成模型生成程序合成分段视频+分段配音

大模型提供各种AI能力,智能体根据用户任务需求,自动组合和调用这些能力。

相关文章

操作系统的基础知识封面操作系统的基础知识操作系统是管理电脑资源,调度电脑硬件,拥有最大的权限,没有操作系统电脑就是一块砖头,他可以让用户使用电脑的软件。查看 软件的基础知识封面软件的基础知识一个需求最终可以通过什么软件形态实现,同一个需求,可以使用不同的软件形态实现,只有合理的给AI确定一个软件形态,AI才不会跳出框架去做事。查看 API与工具调用封面API与工具调用智能体如果想使用大模型的能力,比如生成图片,生成视频,生成音频的多模态能力,就必须使用一个标准的方式去调用,目前主流的调用方式就是API的形式,随着深入的了解,会发现智能体的沟通基本都是通过API的形式。查看