TL;DR
- Amazon Bedrock推出GPT-5.6 Sol/Terra/Luna,支持百万token上下文窗口和内置Web Search功能,可直接检索公开网站内容并提供引用
- AgentCore运行时实例支持最长14天会话,可在专用EC2实例(GPU/内存/计算优化)上运行长期Agent任务,已扩展至US West和Asia Pacific (Hyderabad)
- 新增跨Region推理能力,覆盖25+ AWS区域,支持Global profiles(大容量低价)和Geo profiles(地理边界控制)
- OpenAI Daybreak Red/Blue安全工具上线,分别支持防御性安全工作和授权进攻性安全任务
- AgentCore新增时间策略、速率限制和支付控制,实现Agent行为的精细化治理和基础设施级支出限制
为什么值得看
这篇文章展示了AWS在AI Agent基础设施领域的全面布局,从模型能力扩展到Agent运行时、安全控制和成本治理,为生产级Agent应用提供了完整的技术栈。对于正在构建企业级Agent的开发者而言,这些更新解决了长期运行、成本控制和安全治理等关键痛点。
技术解析
GPT-5.6上下文与搜索能力:Sol、Terra、Luna三个型号均支持百万token上下文窗口,配合prompt caching降低重复上下文的延迟和成本。Web Search功能无需集成第三方搜索服务,模型可直接检索公开网站内容并返回带引用的回答,适合实时定价、最新文档等场景。
跨Region推理架构:支持在25+ AWS Region访问GPT-5.6系列,Global profiles提供最大容量和更低单价,Geo profiles确保推理处理在指定地理区域内完成,帮助企业在吞吐能力和数据合规之间灵活权衡。
AgentCore运行时与扩展:运行时实例支持在专用EC2计算资源上运行Agent,会话最长14天,涵盖GPU加速、内存优化和计算优化实例类型。区域扩展至US West (N. California)和Asia Pacific (Hyderabad),支持更贴近用户和系统的部署。
Agent治理与控制机制:时间策略(Temporal policies)基于Agent历史行为验证每个动作,强制执行序列、前置条件、审批关卡和数据新鲜度;速率限制按用户或组控制请求、token和并发连接;AgentCore支付支持基础设施级支出限制和端到端可观测性。
成本可见性与安全工具:IAM主体成本分配可将推理支出归属到用户、团队、项目或成本中心;AWS Cost Anomaly Detection监控第三方基础模型支出并提供异常根因分析。Daybreak Blue支持漏洞发现、检测工程和事件响应,Daybreak Red支持漏洞研究、漏洞利用复现和缓解开发。
行业启示
Agent基础设施竞争加剧:云厂商正从单纯的模型托管向完整的Agent运行时、治理和安全栈延伸,形成差异化竞争壁垒。企业选择平台时应评估其对长期会话、成本控制和行为约束的原生支持能力。
从模型能力到系统治理的范式转移:随着Agent承担更复杂的端到端工作流,关键挑战已从"模型能做什么"转向"如何安全、可控、可追溯地委托责任"。时间策略、支付限制和成本分配等治理工具将成为生产级Agent的标配。
安全AI的合规化趋势:Daybreak Red/Blue的推出表明,授权进攻性安全测试正被纳入主流云平台的合规框架,企业可在零操作员访问基础设施和强身份验证下开展红队演练,降低安全测试的运营风险。