一、工具简介
运行时实例(Runtime Instances)是亚马逊云科技在 Amazon Bedrock AgentCore 中推出的第二种计算选项。它在客户账户内的托管 EC2 上运行智能体,同时保留既有的 AgentCore API、身份与可观测性模型。该功能面向那些已无法完全适应 AgentCore 最初无服务器 microVM 会话 8 小时运行上限的团队,为生产级 AI 智能体提供由 EC2 支撑的持久计算。它让长时间运行的智能体不再被迫拆分成短任务,从根本上简化了有状态代理的工程复杂度与运维负担。对于依赖长时间推理、持续记忆与多步工具调用的智能体而言,这一能力补齐了无服务器方案的能力空白,使复杂代理应用的工程实现大幅简化。
二、主要功能
1. 持久会话:提供 EC2 支撑的持久会话,单次最长可运行 14 天。
2. 共享文件系统:多个智能体可部署到同一运行时,通过共享会话目录协作。
3. GPU 加速:支持 GPU 加速的实例类型,承载重算力工作负载。
4. 框架兼容:引入 CrewAI、LangGraph、LlamaIndex、Strands 等框架,仅需 @app.entrypoint 装饰器与 ZIP/容器镜像。
5. 容量提供程序:定义实例系列、操作系统、网络与存储,由 AgentCore 代表团队预置、修补与扩缩。
6. 成本可控:会话存活时间可设至 14 天,复用现有 EC2 承诺折扣。
三、技术原理
运行时实例复用了 AgentCore Runtime microVM 中相同的 API、身份控制与可观测性,降低采用阻力。底层由容量提供程序(Capacity Provider)原语支撑,它作为智能体与 EC2 容量之间的契约,定义允许使用的实例族与边界,团队只需设置实例数量上下限、目标利用率等,AgentCore 代为管理自动扩缩组、启动模板与 AMI 流水线。多个智能体可在同一主机共享会话目录,彼此作为工具调用、自主迭代。这种“同住一台机器”的协作方式,显著降低了跨进程通信与上下文传递的开销,让多智能体系统更接近人类团队的协作体验。
四、应用场景
适合需要连续运行 8 小时以上、需要 GPU 或较大内存、或受益于多智能体同主机紧密协作的工作负载:例如多专业智能体共用工作目录处理代码、测试、文档与安全工件;长时间有状态推理;此前被迫维护独立 EC2 集群的团队。短时间、突发式、请求—响应型智能体仍建议使用 microVM。实际落地中,多数团队会同时运行两种模型,将高流量短任务放在 microVM,把实例留给少量长周期、有状态或重加速器的负载,以兼顾成本与能力。
五、使用方法
开发者用 @app.entrypoint 装饰器定义入口,将智能体打包为 ZIP 文件或容器镜像,关联到某个容量提供程序与运行时实例,设置会话生存时间(最长 14 天)。编排智能体运行在 microVM 上,将长任务分派给实例上的工作智能体,形成混合拓扑。Azure Foundry 托管智能体采用了类似思路。这一趋势表明,持久化、有状态的智能体运行时正成为云厂商的标配能力,生产级 Agent 的工程范式正在重塑。
六、优缺点介绍
优点:
1. 将会话上限从 8 小时提升到 14 天,支持真正长周期任务。
2. 共享文件系统让多智能体同主机协作,无需反复 API 调用。
3. GPU 支持与框架兼容性强,迁移成本低。
4. 复用 EC2 Savings Plans/预留实例折扣,长期更经济。
缺点:
1. 持续 CPU 利用率低于约 24% 时,microVM 更划算,需权衡成本。
2. 运行在客户账户中,管理费另计,计费模型更复杂。
3. 需理解容量提供程序与混合拓扑,运维心智负担上升。
对于已在 AWS 上构建智能体的团队,运行时实例是与现有体系契合度最高的持久计算升级,能够让生产级代理应用更快走向规模化落地。

阿里最新旗舰大模型,Arena国产第一,支持35小时长程执行,推理速度提升10倍