亚马逊AWS官方博客
Text-only LLM SFT 训练数据预处理:从收集到数据打包的完整指南
本文将系统介绍 Text-only LLM SFT 训练数据预处理的完整流程,涵盖从数据收集到最终打包的每一个环节,并结合真实客户案例给出实操建议。这里需要说明的是,本文聚焦于纯文本场景,且不涉及代码生成和 SQL 相关的场景。从 2025 年的行业趋势来看,代码和 SQL 相关场景基本上都是基于开源模型权重或闭源模型来构建实现的,需要针对代码和SQL相关场景做post training 的客户相对要少很多。此外,SFT 和 RFT(Reinforcement Fine-Tuning)的训练数据预处理存在差异,本文只讨论 SFT 的部分。虽然 SFT 本身又分为全参数 SFT 和 PEFT(主要是 LoRA 及其变体),但数据集的预处理流程对两者是一致的。
将 Amazon Quick 日志投递至 Amazon S3:审计与长期留存指南
本文介绍如何通过 CloudWatch Logs V2 delivery,将 Amazon Quick 支持的日志直接持续投递到指定的 Amazon S3 Bucket。CloudWatch Logs 在此架构中仅作为日志投递的控制面。日志会直接写入 S3,无需创建 CloudWatch Log Group,也无需配置 Log Group Export。
使用 Amazon Athena 分析 Kiro 团队用量报表:动态模型列的数据建模实践
本文介绍了如何使用 Amazon Athena 对 Kiro 提供的 per-user activity 报表进行分析。
使用 Amazon Bedrock AgentCore 构建企业级 MCP 服务器:四种架构模式的实践指南
随着人工智能越来越深入地集成到企业工作流程中,企业对标准化、安全且可扩展的 AI 工具平台的需求日益增长。由 Anthropic 开发的模型上下文协议 (MCP) 为连接 AI 助手与外部工具和数据源提供了通用标准。当与 Amazon Bedrock 的 AgentCore 功能相结合时,组织可以构建兼具高性能与生产可用性的 AI 生态系统。
用 AI Agent 加速游戏 QA:构建基于 Amazon Bedrock 的 Agentic 自动化测试系统
本文展示如何结合 Amazon Bedrock Claude 和开源设备自动化框架,构建一个 Agentic 自动化测试系统,大幅缩短游戏版本发布前的黑盒测试时间,加快迭代周期,提升上市速度。
如何选择最适合游戏场景的 AI 模型?构建 Amazon Bedrock 多模态模型对比测试平台
本文面向正在评估 Amazon Bedrock 多模态模型的 AI 工程师 / 解决方案架构师,以及探索 AI 驱动游戏 QA 自动化的游戏开发团队。我们提供的对比测试方法论和工具,也是改进 AI 基础设施能力的重要一步——通过系统化模型评估积累量化基准数据,为更多业务场景落地 AI 提供可靠依据。
AWS 一周综述:雅典本地区域、AWS 上的 Claude Opus 5、适用于 .NET 的 Lambda 持久执行等(2026 年 7 月 27 日)
雅典本地区域、AWS 上的 Claude Opus 5、适用于 .NET 的 Lambda 持久执行等
动态 IP 场景下的 Site-to-Site VPN组网方案
在企业混合云组网中,AWS Site-to-Site VPN 是连接办公地点与 AWS 的常用方案。然而,当办公地点使用部分 ISP 接入时,公网 IP 为动态分配,按照以往的经验,Customer Gateway需要固定 IP, IP变化会导致隧道中断,无法自动恢复。 本文介绍一种解决方案,IP变化后隧道可自动恢复的配置方式,并阐述方案原理、架构设计及部署步骤。
Amazon Quick Desktop 企业 SSO 实战
本文介绍如何使用开源身份认证服务器 Keycloak 作为 IdP,通过 Amazon EC2 快速部署一套轻量级的 OIDC Provider,分别通过 IAM Federation 和 IAM Identity Center 两种模式为 Quick Desktop 配置企业级 SSO 登录。
使用 lm-evaluation-harness 评估 Amazon Bedrock 模型:以 HumanEval 为例
开发者在选择LLM时,需要在准确性、延迟和成本之间做出权衡。本文在 Amazon Bedrock 上对GPT-5.6 Sol、Claude Opus 4.8、Claude Sonnet 5运行 HumanEval 编程基准测试,三者均在 97-98% 区间。同时,我们展示了如何利用 Bedrock Prompt Caching 实现 84% 以上的输入 token 成本节省。
