AWS AgentCore 推出持久计算:多个智能体「同住」一台EC2,会话最长14天

生产级 AI 智能体的野心,正在撞上运行时间的天花板。亚马逊云科技在 Amazon Bedrock AgentCore 中最初提供的无服务器 microVM 会话,单次上限为 8 小时,难以承载跨天、有状态、需紧密协作的长周期任务。为此,AWS 近期推出第二种计算选项——运行时实例(Runtime Instances):在客户账户内的托管 EC2 上运行智能体,同时保留既有的 AgentCore API、身份与可观测性模型。这套持久计算能力,正在重塑生产级智能体的部署方式。AWS AgentCore 持久计算

<strong><strong>AWS AgentCore</strong></strong> 推出持久计算:多个智能体「同住」一台EC2,会话最长14天

一、持久会话与共享文件系统

运行时实例为智能体提供由 EC2 支撑的持久会话,单次最长可运行 14 天,并提供共享文件系统、GPU 加速实例类型,以及对 Python 与容器镜像的支持。多个智能体可部署到同一个运行时,通过共享会话目录在同一主机上协作,而无须在每次交接时相互调用 API。这意味着代码、测试、文档与安全工件可以共用工作目录,被多个专业智能体并行处理,显著降低了多智能体系统的通信与调度开销。

二、框架兼容与容量提供程序

团队可引入 CrewAI、LangGraph、LlamaIndex、Strands 等框架,无需改变打包模型,只需使用简单的 @app.entrypoint 装饰器,配合 ZIP 文件或容器镜像即可。底层由“容量提供程序”原语支撑:它定义允许使用的实例系列、操作系统、网络与存储,作为智能体与 EC2 容量之间的契约。AgentCore 代表团队预置、修补与扩缩,开发者只需设置实例数量上下限、目标利用率与会话存活时间(最长 14 天)。

三、与microVM互补,而非替代

AWS 将运行时实例定位为 microVM 的补充:短时间、突发式、请求—响应型智能体仍建议留在 microVM(启动快、按秒计费、最长 8 小时);需要连续运行 8 小时以上、需要 GPU 或大内存、或受益于多智能体同主机协作的负载,则交给实例。成本分析显示,持续 CPU 利用率约 24% 是两者的盈亏平衡点,且实例运行在客户账户中,可叠加 Savings Plans 等 EC2 折扣。想了解部署方式,可前往工具站查看 AgentCore 持久计算详解。 AWS AgentCore 持久计算。

AD:精心整理了2000+好用的AI工具!点此获取

相关推荐

1 1

免费AI工具合集,点击进入

AI对话

玉米AI助手