AI Practices AI实践 17h ago Updated 11h ago 更新于 11小时前 43

ICYMI: What landed for AI builders in August 2026 ICYMI:2026年8月AI开发者动态回顾

Amazon Bedrock now supports GPT-5.6 Sol, Terra, and Luna with million-token context windows, prompt caching, and integrated Web Search with citations Cross-Region inference enables accessing GPT-5.6 models from 25+ AWS Regions with Global and Geo profiles for capacity and data sovereignty control AgentCore runtime instances allow agents to run on dedicated EC2 compute (GPU, memory-optimized, compute-optimized) with sessions lasting up to 14 days New governance tools include Temporal policies for Amazon Bedrock推出GPT-5.6 Sol/Terra/Luna,支持百万token上下文窗口和内置Web Search功能,可直接检索公开网站内容并提供引用 AgentCore运行时实例支持最长14天会话,可在专用EC2实例(GPU/内存/计算优化)上运行长期Agent任务,已扩展至US West和Asia Pacific (Hyderabad) 新增跨Region推理能力,覆盖25+ AWS区域,支持Global profiles(大容量低价)和Geo profiles(地理边界控制) OpenAI Daybreak Red/Blue安全工具上线,分别支持防御性安全工作和授权进

58
Hot 热度
65
Quality 质量
60
Impact 影响力

Analysis 深度分析

TL;DR

  • Amazon Bedrock推出GPT-5.6 Sol/Terra/Luna,支持百万token上下文窗口和内置Web Search功能,可直接检索公开网站内容并提供引用
  • AgentCore运行时实例支持最长14天会话,可在专用EC2实例(GPU/内存/计算优化)上运行长期Agent任务,已扩展至US West和Asia Pacific (Hyderabad)
  • 新增跨Region推理能力,覆盖25+ AWS区域,支持Global profiles(大容量低价)和Geo profiles(地理边界控制)
  • OpenAI Daybreak Red/Blue安全工具上线,分别支持防御性安全工作和授权进攻性安全任务
  • AgentCore新增时间策略、速率限制和支付控制,实现Agent行为的精细化治理和基础设施级支出限制

为什么值得看

这篇文章展示了AWS在AI Agent基础设施领域的全面布局,从模型能力扩展到Agent运行时、安全控制和成本治理,为生产级Agent应用提供了完整的技术栈。对于正在构建企业级Agent的开发者而言,这些更新解决了长期运行、成本控制和安全治理等关键痛点。

技术解析

  • GPT-5.6上下文与搜索能力:Sol、Terra、Luna三个型号均支持百万token上下文窗口,配合prompt caching降低重复上下文的延迟和成本。Web Search功能无需集成第三方搜索服务,模型可直接检索公开网站内容并返回带引用的回答,适合实时定价、最新文档等场景。

  • 跨Region推理架构:支持在25+ AWS Region访问GPT-5.6系列,Global profiles提供最大容量和更低单价,Geo profiles确保推理处理在指定地理区域内完成,帮助企业在吞吐能力和数据合规之间灵活权衡。

  • AgentCore运行时与扩展:运行时实例支持在专用EC2计算资源上运行Agent,会话最长14天,涵盖GPU加速、内存优化和计算优化实例类型。区域扩展至US West (N. California)和Asia Pacific (Hyderabad),支持更贴近用户和系统的部署。

  • Agent治理与控制机制:时间策略(Temporal policies)基于Agent历史行为验证每个动作,强制执行序列、前置条件、审批关卡和数据新鲜度;速率限制按用户或组控制请求、token和并发连接;AgentCore支付支持基础设施级支出限制和端到端可观测性。

  • 成本可见性与安全工具:IAM主体成本分配可将推理支出归属到用户、团队、项目或成本中心;AWS Cost Anomaly Detection监控第三方基础模型支出并提供异常根因分析。Daybreak Blue支持漏洞发现、检测工程和事件响应,Daybreak Red支持漏洞研究、漏洞利用复现和缓解开发。

行业启示

  • Agent基础设施竞争加剧:云厂商正从单纯的模型托管向完整的Agent运行时、治理和安全栈延伸,形成差异化竞争壁垒。企业选择平台时应评估其对长期会话、成本控制和行为约束的原生支持能力。

  • 从模型能力到系统治理的范式转移:随着Agent承担更复杂的端到端工作流,关键挑战已从"模型能做什么"转向"如何安全、可控、可追溯地委托责任"。时间策略、支付限制和成本分配等治理工具将成为生产级Agent的标配。

  • 安全AI的合规化趋势:Daybreak Red/Blue的推出表明,授权进攻性安全测试正被纳入主流云平台的合规框架,企业可在零操作员访问基础设施和强身份验证下开展红队演练,降低安全测试的运营风险。

Disclaimer: The above content is generated by AI and is for reference only. 免责声明:以上内容由 AI 生成,仅供参考。

Agent Agent Open Source 开源 Deployment 部署 Product Launch 产品发布 LLM 大模型