AWS 기술 블로그
Category: Amazon Bedrock
A1Mobilsoft의 운영 문의 자동화 여정 (2): 세 에이전트 구현과 사람 vs AI 검증
본 블로그 시리즈는 A1Mobilsoft, Megazone, AWS 가 공동 작성 하였으며, 두 편으로 이루어져 있습니다. 각 편의 구성은 다음과 같습니다. 1편 (0~3장): 문제 정의와 3-에이전트 아키텍처 설계 2편 (4~7장, 현재 글): 세 에이전트 구현 우여곡절과 사람 vs AI 검증 2편: Bedrock AgentCore·Strands 기반 구현 디테일, 프롬프트 캐시, 그리고 14건 병렬 비교 결과 1편에서는 32개월간 846건이 쌓인 […]
A1Mobilsoft의 운영 문의 자동화 여정 (1): 문제 정의와 3-에이전트 아키텍처 설계
본 블로그 시리즈는 A1Mobilsoft, Megazone, AWS 가 공동 작성 하였으며, 두 편으로 이루어져 있습니다. 각 편의 구성은 다음과 같습니다. 1편 (0~3장, 현재 글): 문제 정의와 3-에이전트 아키텍처 설계 2편 (4~7장): 세 에이전트 구현 우여곡절과 사람 vs AI 검증 1편: 슬랙 #운영개발문의 채널의 고통에서 출발해, 왜 Knowledge·Code·DB 세 에이전트 구조로 갈랐는가 수 시간씩 늘어지던 운영 문의를 […]
2주 만에 Strands SDK와 Amazon Bedrock AgentCore로 구현한 어스얼라이언스의 CS 환불 자동응답 에이전트 시스템
이번 블로그는 AWS DEVCRAFT 2026 (2026.3.26 ~ 4.9, AWS 코리아 오피스) 해커톤 프로그램에 참여하여 진행한 프로젝트를 기반으로 작성되었습니다. DEVCRAFT는 AWS SA와 고객사 개발팀이 함께 실제 비즈니스 과제를 2주간 집중 개발하는 프로그램입니다. 어스얼라이언스 (US Alliance)는 크리에이터 기반 금융 콘텐츠·커뮤니티 플랫폼 ‘어스플러스(US PLUS)’를 운영하는 기업입니다. 본 블로그에서는 어스얼라이언스가 Amazon Bedrock AgentCore 기반으로 약 2주 만에 구축한 CS […]
개인 생산성에서 멈춘 Claude Code, 조직의 생산성으로 – 영상 10개로 완성하는 Claude Code on Amazon Bedrock 학습 플랜
AI 코딩 도구, 이제 다들 하나쯤 쓰고 계실 겁니다. 문제는 그 다음입니다. 도구를 손에 쥐는 것과, 그 도구를 조직의 실제 생산성으로 잇는 것은 전혀 다른 이야기입니다. 대부분의 Claude Code 콘텐츠는 개인 데스크톱 생산성에서 멈춥니다. “이렇게 하니 빨라지더라”까지는 보여 줍니다. 하지만 코드·프롬프트가 어떻게 흐르는지, 토큰은 얼마나 쓰는지, 감사·통제는 누가 책임지는지 — 정작 조직이 던지는 질문의 자리는 […]
1시간 대화로 만드는 Amazon Connect Customer AI Agent [AICC Builder 시리즈 #1]
Amazon Connect Customer AI Agent가 무엇으로 이루어지는지 이해하고, 코드 한 줄 없이 전화받는 PoC까지 완성하기 이 블로그는 아래 데모 영상 속 AICC Builder를 활용해 Amazon Connect Customer AI Agent를 빠르게 만드는 방법을 가이드합니다. 아래 녹음과 같이 고객 응대를 하는 우리 회사만의 AI Agent를 빠르게 구성하는 방안을 안내합니다. Amazon Connect Customer AI Agent가 배송 조회 해주는 […]
Claude Apps Gateway on AWS 자세히 알아보기
들어가며 최근 많은 엔터프라이즈 기업들은 Amazon Bedrock을 기반한 Claude Code 및 Claude Desktop의 도입을 적용하고 있습니다. Amazon Bedrock을 통해 Claude 모델을 호출하면, 사용자의 데이터를 모델 학습에 재활용하지 않으며, Private Network 기반으로 사용자들의 Claude 사용 환경을 구성 할 수 있습니다. 또한 기존 AWS 계정·IAM 권한 체계를 통해 인증과 비용을 통합 관리할 수 있으며, Guardrails로 콘텐츠 필터링을 […]
AWS 환경에서 프로덕션-레디 확산 언어 모델(DLM) 검증하기
확산 언어 모델(Diffusion Language Model, 이하 DLM)은 일반적인 자기회귀(Autoregressive, 이하 AR) 모델과 다른 방식으로 텍스트를 생성하는 언어 모델입니다. 최근 AR 모델과 동일한 사이즈의 DLM 모델들이 공개되고 있으며, 벤치마크 결과에서 AR보다 낮은 응답 지연(latency)을 보이며 주목을 받고 있습니다. 다만 AR과 완벽히 동일한 구조의 모델이 아니기 때문에 워크로드에서 모델을 변경하기 앞서 검증을 통해 기존 워크로드의 응답 품질에 […]
Amazon Bedrock 위에 사내 LLM Gateway 구축하기: Claude Code, Codex를 위한 인증·비용·거버넌스
“개발자 전원에게 Claude Code를 열어주고 싶습니다. 그런데 누가 얼마를 쓰는지, 어떤 모델에 접근하는지, 예산을 넘기면 어떻게 막을지를 모른 채로 열어도 될지 확신이 서지 않습니다.” 이 고민은 2026년 현재 거의 모든 기술 조직이 마주하는 현실입니다. 생성형 AI 코딩 도구는 더 이상 실험이 아니라 일상 도구가 되었고, Claude Code는 환경변수 하나(CLAUDE_CODE_USE_BEDROCK=1)만으로 Amazon Bedrock 위에서 곧바로 동작합니다. 그리고 […]
Amazon Bedrock 모델 promptfoo 로 성능 평가하기
들어가며 “프롬프트를 바꿨는데, 정말 더 나아진 걸까?” 생성형 AI 애플리케이션을 개발하는 엔지니어라면 누구나 한 번쯤 마주치는 질문입니다. 프롬프트 한 줄을 수정하거나 모델을 교체할 때마다 품질이 좋아졌는지 확신하기 어렵고, 여러 모델을 두고 어느 쪽이 서비스에 더 맞는지 판단하려면 같은 질문을 양쪽에 던져 결과를 일일이 눈으로 비교해야 합니다. 문제는 대규모 언어 모델(Large Language Model, 이하 LLM)이 비결정적(non-deterministic) […]
AWS Elemental Inference를 활용한 실시간 문맥 광고(Contextual Advertising) 솔루션
AWS Elemental Inference Smart Subtitle, Amazon Bedrock, SCTE-35를 결합하여 라이브 방송 콘텐츠의 문맥을 실시간으로 이해하고, 최적의 시점에 문맥 기반 광고를 배치하는 아키텍처를 구축합니다. 이 블로그에서는 라이브 콘텐츠의 음성을 실시간으로 자막화하고, 그 자막의 문맥을 AI가 분석하여 IAB(Interactive Advertising Bureau) 카테고리로 분류한 뒤, 표준 SCTE-35 오버레이 시그널(segmentation_type_id 0x38)을 통해 AWS Elemental MediaTailor와 연동하는 전체 파이프라인을 설명합니다. 소개 […]






