Agent (智能体)
在人工智能理论中,智能体 (Agent) 是指任何能够通过传感器 (Sensor) 感知其环境 (Environment),并通过执行器 (Actuator) 作用于该环境的事物。智能体是分析和设计 AI 系统的一种通用框架与核心工具。
数学定义
- 智能体函数:智能体的行为在数学上由智能体函数 (Agent Function) 描述,该函数负责将任意给定的感知序列映射到一个具体的动作。
- 智能体程序:智能体函数是一个抽象的数学表述,而在实际计算机系统中的具体实现,则被称为智能体程序 (Agent Program)。
Source: 2026-06-21-note-人工智能-现代方法-第4版--上下册(来源未公开)
理性智能体 (Rational Agent)
- 定义:一个理性的智能体应当选择采取“期望能够最大化其性能度量(基于已获得的感知序列和内置的先验知识)”的动作。理性智能体也是控制理论、博弈论、运筹学及微观经济学的共同理论内核。
- 局限性与改进:在现实中,由于完美的“计算最优动作”代价太高,完美理性往往是不可行的,需要对智能体模型进行改进。
Source: 2026-06-21-note-人工智能-现代方法-第4版--上下册(来源未公开)
智能体与对齐
- 价值对齐难题:传统的智能体标准模型要求人类给机器设定完全指定的目标。然而,当智能体足够强大时,这会导致“迈达斯国王问题”(对不完美目标的冷酷执行)。
- 可证益智能体:AI 科学家 stuart-russell 提倡设计可证益智能体——即让智能体在明确知道“不确信人类真实目标”的前提下工作,使其有动力在面临不确定偏好时向人类寻求许可,甚至允许人类将其关闭。
Source: 2026-06-21-note-人工智能-现代方法-第4版--上下册(来源未公开)