amazon-eks

6 개의 포스트

aws

AWS 주간 요약: Bedrock의 GPT 모델 가격 인하, Prometheus 지표를 위한 CloudWatch 관리형 수집기 및 기타 소식 (2026년 8월 3일) | Amazon Web Services (새 탭에서 열림)

AWS의 이번 주 업데이트는 AI 비용 절감, 관측성 관리 간소화, 멀티클라우드 연결성 강화, 데이터 레이크 기능 확장에 초점을 맞춘다. Amazon Bedrock의 GPT-5.6 모델 가격이 최대 80% 인하됐고, CloudWatch는 관리형 Prometheus 수집기를 제공해 별도 에이전트 운영 부담을 줄인다. 또한 Oracle Cloud와의 전용 연결, IAM Identity Center의 멀티 리전 복제, Apache Iceberg V3의 Variant 데이터 타입 지원도 정식 또는 신규 기능으로 소개됐다. ### Amazon Bedrock GPT-5.6 가격 인하 - 2026년 7월 30일부터 OpenAI GPT-5.6 모델의 온디맨드 추론 가격이 자동으로 인하됐다. - GPT-5.6 Luna: - 입력 토큰 100만 개당 **0.20달러** - 출력 토큰 100만 개당 **1.20달러** - 기존 대비 최대 **80% 인하** - GPT-5.6 Terra는 가격이 **20% 인하**됐다. - 사용자가 별도 설정을 변경하거나 신청할 필요 없이 자동 적용된다. ### CloudWatch 관리형 Prometheus 수집기 - Amazon CloudWatch가 AWS 인프라에서 Prometheus 메트릭을 수집하는 완전 관리형 수집기를 지원한다. - 다음 서비스의 워크로드를 별도 에이전트 관리 없이 모니터링할 수 있다. - Amazon EKS - Amazon EC2 - Amazon ECS - Amazon MSK - Amazon OpenSearch Service - 직접 Prometheus 스크레이핑 인프라를 배포하고 유지하던 조직은 운영 및 업그레이드 부담을 줄일 수 있다. ### AWS와 Oracle Cloud 간 멀티클라우드 연결 - AWS Interconnect와 Oracle Cloud Infrastructure(OCI) 간 연결 기능이 정식 출시됐다. - 퍼블릭 인터넷을 거치지 않고 AWS와 OCI 사이에 전용 프라이빗 연결을 구성할 수 있다. - 멀티클라우드 환경에서 다음 요구사항을 충족하는 데 유리하다. - 네트워크 보안 강화 - 안정적이고 확장 가능한 연결 - 클라우드 간 애플리케이션 연동 - 지연 시간과 네트워크 성능 관리 ### IAM Identity Center 멀티 리전 지원 확대 - IAM Identity Center 디렉터리를 기본 자격 증명 소스로 사용하는 경우에도 멀티 리전 복제가 가능해졌다. - 기본 리전에 장애가 발생하면 추가 리전에 복제된 디렉터리와 권한 정보를 활용해 사용자가 AWS 계정에 계속 접근할 수 있다. - 기존에는 외부 자격 증명 공급자와 연결된 인스턴스에만 제공되던 기능이었다. - 리전 장애에 대비한 인증 가용성과 재해 복구 설계를 강화할 수 있다. ### Apache Iceberg V3의 Variant 데이터 타입 지원 - Amazon S3 Tables가 Apache Iceberg V3에서 도입된 **Variant** 데이터 타입을 지원한다. - Variant는 고정된 스키마를 적용하기 어려운 반정형 데이터를 JSON 블롭보다 효율적으로 저장하고 처리할 수 있도록 설계됐다. - 적용 사례: - IoT 센서 데이터 - 애플리케이션 로그 - 스키마가 자주 바뀌는 이벤트 페이로드 - 데이터 레이크에서 스키마 유연성을 확보하면서도 네이티브 처리 성능을 활용할 수 있다. ### 추가로 소개된 AWS 소식 - AWS CLI를 여러 플랫폼에서 한 줄 명령으로 설치하고 업데이트하는 방법이 공개됐다. - Moonshot AI의 Kimi K3를 SageMaker HyperPod와 Amazon EKS에 배포하는 단계별 가이드가 제공됐다. - Amazon MSK Express 브로커에서 Apache Iceberg 및 Amazon S3 Tables로 Kafka 데이터를 스트리밍하는 방법이 소개됐다. - 해당 데이터 전달 방식은 최대 **초당 10GB** 처리량을 지원한다. ### 예정된 AWS 행사 - AWS Summits가 2026년 하반기에도 개최되며, 클라우드와 AI 관련 기술 세션 및 커뮤니티 교류 기회를 제공한다. - AWS Community Days는 커뮤니티 리더가 콘텐츠를 기획하고 운영하는 지역 행사다. - AWS Builder Center에서는 개발자용 콘텐츠, 솔루션 공유, 온·오프라인 행사 정보를 확인할 수 있다. 실무적으로는 Bedrock 사용 조직이라면 모델 비용 절감 효과를 즉시 검토하고, Prometheus 운영 부담이 큰 팀은 CloudWatch 관리형 수집기로의 전환을 고려할 만하다. 멀티클라우드나 리전 장애 대응이 중요한 환경에서는 AWS Interconnect와 IAM Identity Center 멀티 리전 기능을 재해 복구 설계에 반영하는 것이 유용하다.

aws

AWS 주간 요약: AWS에서 제공되는 Claude Sonnet 5, AI 에이전트를 위한 Amazon WorkSpaces, AWS 서비스 가용성 업데이트 등 (2026년 7월 6일) | Amazon Web Services (새 탭에서 열림)

AWS는 이번 주 Claude Sonnet 5, AI 에이전트용 Amazon WorkSpaces, 로그 분석 최적화 OpenSearch 등 AI·인프라 관련 기능을 대거 공개했다. 특히 CloudFormation Express, EKS 버전 롤백, ACM의 ACME 지원처럼 개발·운영 속도와 안정성을 높이는 기능도 강화됐다. 동시에 여러 AWS 서비스와 기능이 유지보수 단계, 일몰 또는 지원 종료로 전환되므로 사용 중인 서비스의 마이그레이션 계획을 점검해야 한다. ## 주요 출시 및 업데이트 ### Graviton5 기반 Amazon EC2 C9g/C9gd - AWS Graviton5 프로세서를 탑재한 컴퓨팅 최적화 인스턴스다. - Graviton4 기반 인스턴스보다 최대 25% 향상된 컴퓨팅 성능을 제공한다. - 캐시 용량이 5배 커졌으며, 클라우드 프로세서 중 가장 빠른 메모리 성능을 제공한다. - C9gd는 로컬 NVMe 스토리지를 지원해 고성능 임시 데이터 처리에 적합하다. ### AWS CloudFormation Express 모드 - 인프라 배포 결과를 수초 내에 확인할 수 있도록 배포 흐름을 단축한다. - AI 에이전트와 개발자가 배포 결과를 빠르게 확인하고 반복 작업을 수행할 수 있다. - 모든 상용 AWS 리전에서 추가 비용 없이 제공된다. ### Amazon EKS Kubernetes 버전 롤백 - Kubernetes 클러스터 업그레이드 후 최대 7일 동안 이전 버전으로 되돌릴 수 있다. - 업그레이드 실패 시 클러스터를 새로 구축하지 않아도 된다. - Kubernetes 버전 업그레이드를 되돌릴 수 있는 저위험 작업으로 만들어 운영 안정성을 높인다. ### AWS Certificate Manager의 ACME 지원 - 표준 ACME 프로토콜을 사용해 퍼블릭 TLS 인증서 발급과 갱신을 자동화할 수 있다. - 기존 ACME 기반 도구 및 자동화 파이프라인과 연동하기 쉬워졌다. - 인증서 만료로 인한 서비스 중단 위험을 줄일 수 있다. ## AI 및 개발 생산성 기능 ### AWS에서 제공되는 Claude Sonnet 5 - Anthropic의 최신 Sonnet 모델로, 코딩·에이전트 작업·일반 업무를 대상으로 한다. - 대규모 코드베이스를 탐색하고 도구를 정확하게 호출할 수 있다. - 장시간 이어지는 에이전트 작업에서 상태를 유지하도록 설계됐다. - Sonnet 계열의 가격대에서 높은 수준의 추론 성능을 제공하는 것이 특징이다. ### AI 에이전트용 Amazon WorkSpaces - AI 에이전트가 관리형 WorkSpaces 환경에서 데스크톱 애플리케이션에 안전하게 접근하고 조작할 수 있다. - 기존 애플리케이션을 현대화하거나 별도의 맞춤형 통합을 구현하지 않아도 된다. - 레거시 GUI 애플리케이션을 AI 자동화 workflow에 포함할 수 있는 기반을 제공한다. - 정식 출시(GA) 단계로 제공된다. ### Amazon SageMaker AI 추론 확장 속도 개선 - 컨테이너 이미지 캐싱을 지원해 생성형 AI 모델의 scale-out 시간을 줄인다. - 추론 확장 이벤트에서 엔드투엔드 확장 속도가 최대 2배 빨라질 수 있다. - 트래픽 급증 시 새 추론 인스턴스를 준비하는 시간을 단축한다. ## 데이터 분석 및 모니터링 개선 ### 로그 분석에 최적화된 Amazon OpenSearch Service - 로그 분석 workload를 위해 별도로 설계된 새로운 엔진을 제공한다. - AWS 내부 벤치마크 기준 최대 4배 향상된 가격 대비 성능을 목표로 한다. - 로그 집계와 정밀한 전문 검색을 하나의 시스템에서 함께 수행할 수 있다. - 검색 기능과 분석 기능을 별도 시스템으로 분리해야 하는 부담을 줄인다. ### CloudWatch 로그 쿼리 기반 알람 - 로그 쿼리 결과에 직접 임계값을 설정해 알람을 만들 수 있다. - 기존처럼 먼저 메트릭 필터나 사용자 지정 메트릭을 생성할 필요가 없다. - 로그 분석과 장애 알림 설정을 하나의 workflow로 처리할 수 있다. ## AWS 서비스 가용성 변경 AWS는 서비스 또는 기능의 제공 상태가 바뀔 때 대체 서비스와 마이그레이션 지침을 제공한다. 2026년 6월 30일 기준으로 다음과 같은 변경이 발표됐다. ### 신규 고객 접근이 제한되는 유지보수 단계 2026년 7월 30일부터 신규 고객이 사용할 수 없게 되는 서비스 및 기능은 다음과 같다. - Amazon Bedrock Agents → Amazon Bedrock Agents Classic - Amazon Cognito Sync - Amazon Kendra - Amazon Q Business - AWS Directory Service – Simple AD - AWS IoT Device Defender – Detect - 2026년 8월 31일부터 신규 고객 접근 제한 - AWS Mainframe Modernization – Self-Managed Experience - AWS Management Console – myApplications - AWS Resource Groups – Group Lifecycle Events - AWS Service Catalog – Application Registry - AWS Systems Manager – Application Manager - SageMaker AI의 A2I, Clarify, Debugger, GeoSpatial, Ground Truth, Mechanical Turk, Model Monitor, Role Manager, Studio Lab ### 서비스 일몰(Sunset) 대상 - Amazon WorkSpaces – PCoIP - Amazon WorkSpaces – Pool - AWS Managed Services Advanced - AWS re:Post Private - Amazon SageMaker AI – Profiler ### 지원 종료 대상 2026년 6월 30일부로 다음 서비스의 지원이 종료됐다. - Amazon Chime SDK – Carrier Voice Focus - Amazon SageMaker AI – Ground Truth Plus ## 예정된 AWS 행사 - AWS Summits: - 2026년 하반기 각 지역에서 열리는 무료 클라우드·AI 행사다. - 최신 기술을 학습하고 커뮤니티와 교류할 수 있다. - AWS Community Days: - 커뮤니티가 직접 기획하고 운영하는 행사다. - 브라질에서는 AWS Community Day Belo Horizonte가 2026년 8월 22일 개최될 예정이다. - AWS Builder Center: - 개발자와 빌더가 솔루션을 공유하고 관련 콘텐츠 및 행사 정보를 확인할 수 있는 커뮤니티 공간이다. 사용 중인 AWS 서비스가 유지보수, 일몰 또는 지원 종료 대상인지 먼저 확인하고, 대체 서비스와 마이그레이션 일정을 미리 수립하는 것이 좋다. 신규 AI·인프라 프로젝트에서는 Claude Sonnet 5, CloudFormation Express, EKS 롤백, 로그 기반 CloudWatch 알람 등을 활용하면 개발 속도와 운영 안정성을 함께 높일 수 있다.

aws

Kubernetes 버전 롤백으로 Amazon EKS 클러스터를 안심하고 업그레이드하기 | Amazon Web Services (새 탭에서 열림)

Amazon EKS가 Kubernetes 클러스터 업그레이드 후 7일 이내에 이전 마이너 버전으로 되돌릴 수 있는 버전 롤백 기능을 출시했습니다. 이는 업그레이드 실패 시 클러스터를 재구축하지 않고, 실제 운영에서 검증된 이전 버전으로 복구할 수 있게 해줍니다. 이를 통해 업그레이드에 대한 부담을 줄이고 보안 패치와 최신 버전 도입을 더욱 적극적으로 추진할 수 있습니다. ### 기존 Kubernetes 업그레이드의 한계 - 오픈소스 Kubernetes는 전통적으로 컨트롤 플레인 버전 롤백을 지원하지 않았습니다. - 업그레이드 후 문제가 발생하면 클러스터를 재구축하거나 장기간의 복구 작업을 진행해야 했습니다. - 조직들은 다음과 같은 보완책을 마련해야 했습니다. - 긴 사전 검증 및 bake 기간 - 단계적 업그레이드 그룹(stagger groups) - 자동 승인 절차 - 수개월에 걸친 업그레이드 일정 - 그 결과 보안 패치가 포함된 최신 Kubernetes 버전으로의 업그레이드를 미루고, 지원 종료나 연장 지원 기간에 임박하는 문제가 발생했습니다. ### Amazon EKS 버전 롤백 기능 - 업그레이드 후 **7일 이내**에 이전 Kubernetes 마이너 버전으로 되돌릴 수 있습니다. - 예를 들어 Kubernetes 1.34에서 1.35로 업그레이드한 뒤 문제가 발견되면 1.34로 복구할 수 있습니다. - 에뮬레이션된 버전이나 임시 상태가 아니라, 실제 운영에서 사용했던 검증된 이전 버전으로 복원합니다. - 한 번에 한 마이너 버전만 롤백할 수 있으며, 이는 EKS의 점진적 업그레이드 정책과 동일합니다. - 자체 관리 노드를 사용하는 클러스터와 AWS 관리형 노드를 사용하는 클러스터 모두 컨트롤 플레인 롤백을 지원합니다. ### 롤백 준비 상태 점검 - EKS는 클러스터 인사이트를 통해 롤백 가능 여부를 자동으로 평가합니다. - 다음과 같은 문제를 사전에 확인할 수 있습니다. - 노드와 컨트롤 플레인 간 버전 호환성 - 애드온 의존성 - 롤백을 방해할 수 있는 클러스터 구성 - 점검 결과를 확인한 뒤 롤백을 시작할 수 있습니다. - 긴급하게 진행해야 하는 경우 `--force` 옵션으로 준비 상태 검사를 우회할 수 있습니다. ### EKS Auto Mode의 노드 롤백 - EKS Auto Mode에서는 컨트롤 플레인과 관리형 노드를 함께 롤백해야 합니다. - 노드 롤백은 Pod Disruption Budget(PDB)을 준수하므로, 설정에 따라 완료까지 시간이 걸릴 수 있습니다. - 롤백이 지나치게 오래 걸리거나 전략을 바꾸고 싶을 때 사용할 수 있도록 취소 API가 제공됩니다. - 기본적으로 EKS는 롤백 중 PDB를 무시하지 않습니다. - 롤백을 빠르게 진행하려면 사용자가 직접 PDB를 수정하거나 제거해야 합니다. - 노드 롤백 기능은 EKS Auto Mode 클러스터에 제공됩니다. ### 롤백 과정과 운영 영향 - EKS 콘솔의 클러스터 설정 화면에서 롤백 가능 여부와 남은 롤백 기간을 확인할 수 있습니다. - 롤백 시작 전에 클러스터 인사이트를 검토해 노드 상태와 잠재적인 문제를 확인합니다. - 사례에서는 컨트롤 플레인 롤백에 약 20분이 걸렸으며, 이는 일반적인 업그레이드와 비슷한 수준입니다. - 롤백 중에도 클러스터는 계속 동작했습니다. - Auto Mode 노드는 PDB 설정에 따라 워크로드 중단을 최소화하면서 순차적으로 롤백됩니다. ### 제공 범위와 비용 - 상용 Amazon EKS가 제공되는 모든 AWS 리전에서 사용할 수 있습니다. - 추가 비용은 없으며, 기존 EKS 및 컴퓨팅 리소스 요금만 부과됩니다. - 표준 지원 또는 연장 지원 대상 Kubernetes 버전을 실행하는 클러스터가 지원됩니다. - 컨트롤 플레인 롤백은 모든 EKS 클러스터에서 사용할 수 있고, 노드 롤백은 EKS Auto Mode에서 지원됩니다. 운영 환경에서는 업그레이드 전에 롤백 가능 기간과 클러스터 인사이트를 확인하고, PDB와 애드온 호환성을 점검하는 것이 좋습니다. 특히 Auto Mode 사용자는 롤백 시간에 영향을 주는 PDB 설정과 취소 API 사용 방법을 미리 검토하면 안전한 복구 계획을 세울 수 있습니다.

aws

생성형 AI 기반 SRE 복원력 여정을 위한 차세대 AWS Resilience Hub 소개 | Amazon Web Services (새 탭에서 열림)

AWS Resilience Hub 차세대 버전은 복원력 정책 설정부터 의존성 탐색, 생성형 AI 기반 장애 모드 분석, 조직 전체 보고까지 하나의 흐름으로 통합한다. 이를 통해 SRE와 개발팀은 애플리케이션별 복원력 목표를 일관되게 정의하고, 실제 장애 대응 수준을 평가하며, 규정 준수 여부를 대규모로 입증할 수 있다. AWS Organizations와 새로운 시스템·서비스 모델을 활용해 여러 계정과 애플리케이션의 복원력 상태를 중앙에서 관리하는 것이 핵심이다. ## 모듈형 복원력 정책 - 단일하고 경직된 정책 유형 대신 필요한 요구사항을 조합해 정책을 구성한다. - 설정 가능한 주요 항목은 다음과 같다. - 서비스 수준 목표(SLO) - 다중 가용 영역(Multi-AZ) 구성 - 다중 리전 재해 복구 - 복구 시간 목표(RTO) - 복구 시점 목표(RPO) - 백업에서 데이터를 복원하는 데 필요한 데이터 복구 시간 - 예를 들어 금융 애플리케이션용 정책에 다음 조건을 정의할 수 있다. - 가용성 SLO 99.95% - 다중 리전 재해 복구 RTO 15분 - RPO 5분 - RTO·RPO에 부합하는 재해 복구 방식 ## 비즈니스 관점의 애플리케이션 모델 - 새로운 모델은 기술 리소스가 아니라 비즈니스 애플리케이션과 사용자 경로를 중심으로 복원력을 표현한다. - 구성 요소는 다음과 같다. - **시스템(System):** 하나의 비즈니스 애플리케이션 - **사용자 여정(User journey):** 중요한 사용자 흐름과 비즈니스 경로 - **서비스(Service):** AWS 리소스, 코드, 관측성 구성으로 이루어진 배포 단위 또는 마이크로서비스 - Resilience Hub는 리소스 간 연결, 데이터 흐름, 포함 관계, 권한 관계를 자동으로 탐색해 토폴로지로 표시한다. - 서비스 토폴로지는 그래프, 테이블, JSON 형식으로 확인할 수 있다. ## 의존성 자동 탐색 - 서비스가 의존하는 AWS 서비스, 내부 엔드포인트, 외부 서드파티 엔드포인트를 자동으로 식별한다. - VPC 쿼리 로그의 DNS 질의를 분석해 설정 문서에 드러나지 않은 의존성도 찾는다. - 특히 다음과 같은 숨은 위험을 발견하는 데 유용하다. - 예상하지 못한 리전 간 호출 - 중요한 외부 서드파티 서비스 의존성 - 애플리케이션 구성에 누락된 내부 엔드포인트 - 서비스 생성 시 의존성 탐색을 활성화하며, 서비스 상세 페이지에서 언제든 비활성화할 수 있다. ## 생성형 AI 기반 장애 모드 분석 - 서비스가 정의된 복원력 정책, AWS Well-Architected 모범 사례, AWS Resilience Analysis Framework를 얼마나 충족하는지 분석한다. - 분석 과정에서 잠재적인 장애 모드를 식별하고 개선 권고사항을 제시한다. - 각 결과에는 다음 정보가 포함된다. - 어떤 장애 상황인지 - 해당 장애가 아키텍처에 중요한 이유 - 문제를 해결하는 방법 - 관련된 복원력 정책 요구사항 - 사용자는 **Failure mode guidance**에서 분석 에이전트를 위한 assertion을 추가하거나 수정할 수 있다. - 권고사항은 적용 후 **해결됨(Mark as resolved)**으로 표시하거나, 환경에 맞지 않으면 **무관함(Mark as irrelevant)**으로 처리할 수 있다. ## 서비스 생성과 평가 절차 - 먼저 Resilience Hub가 AWS 리소스를 읽을 수 있도록 invoker IAM 역할을 설정한다. - AWS Organizations를 사용하지 않는 경우에는 계정 간 역할을 구성할 수 있고, Organizations 환경에서는 서비스 연결 역할(SLR)을 활용할 수 있다. - 콘솔에서 다음 순서로 진행한다. 1. 재사용할 복원력 정책 생성 2. 비즈니스 애플리케이션을 나타내는 시스템 생성 3. 시스템에 서비스 추가 4. 서비스의 리소스 위치와 리전 지정 5. 복원력 정책과 IAM 역할 연결 6. 장애 모드 평가 실행 7. 결과와 권고사항 검토 및 조치 - 서비스 리소스는 리소스 태그, CloudFormation 스택, Terraform 상태 파일, Amazon EKS 클러스터·네임스페이스 등을 통해 지정할 수 있다. - 평가 중 Resilience Hub는 invoker 역할을 사용해 리소스를 읽고, 부모·자식 관계와 리소스 연결을 파악해 전체 토폴로지를 구성한다. ## AWS Organizations 기반 중앙 관리 - 위임된 관리자 계정에서 조직 전체의 복원력 상태를 평가할 수 있다. - 각 AWS 계정에 개별적으로 로그인하지 않고도 여러 애플리케이션의 복원력 수준과 개선 진행 상황을 관리할 수 있다. - 수백 개 애플리케이션에서 서로 다른 복원력 기준과 도구를 사용하는 문제를 줄이고, 조직 차원의 표준화와 규정 준수를 지원한다. ## 기존 고객을 위한 마이그레이션 - 기존 Resilience Hub 애플리케이션과 정책을 새 모델로 전환할 수 있는 마이그레이션 API를 제공한다. - 기존 평가 정책은 새로운 복원력 정책으로 변환된다. - 기존의 여러 관련 애플리케이션은 하나의 시스템과 여러 서비스 구조로 매핑할 수 있다. ## 제공 범위와 요금 - 차세대 AWS Resilience Hub는 Resilience Hub가 제공되는 AWS 상용 리전에서 정식 출시되었다. - 새로운 서비스 기반 요금 모델을 적용한다. - 서비스별 월 2회의 장애 모드 평가가 포함되며, 의존성 평가 기능은 선택적으로 사용할 수 있다. - 무료로 사용해 볼 수 있으며, 상세 요금은 AWS Resilience Hub 요금 페이지에서 확인해야 한다. 실무적으로는 먼저 핵심 비즈니스 서비스에 SLO·RTO·RPO를 정책으로 정의한 뒤, 의존성 탐색과 AI 장애 모드 평가를 실행하는 방식이 적절하다. 이후 조직 전체로 범위를 확대해 숨은 의존성과 반복되는 장애 패턴을 파악하고, 권고사항을 정기적인 복원력 개선 작업으로 연결하는 것이 효과적이다.

aws

AWS 주간 요약: OpenAI 파트너십, AWS Elemental Inference, Strands Labs 등 (2026년 3월 2일) | 아마존 웹 서비스 (새 탭에서 열림)

AWS와 OpenAI의 대규모 전략적 파트너십 체결을 중심으로, 2026년 AWS는 기업들이 생성형 AI 실험 단계를 넘어 실제 비즈니스 가치를 창출할 수 있도록 지원하는 AI-DLC(AI-Driven Lifecycle) 프레임워크와 에이전트 중심의 기술 생태계를 강화하고 있습니다. 이번 파트너십을 통해 Amazon Bedrock에 OpenAI 모델 기반의 상태 유지 런타임 환경이 도입되며, AWS 전용 가속기인 Trainium 칩의 대규모 공급과 함께 보안, 미디어 처리, 인프라 관리 전반에 걸친 지능형 자동화 서비스들이 대거 출시되었습니다. **Amazon과 OpenAI의 전략적 파트너십 및 기술 통합** * **대규모 투자 및 독점 공급:** Amazon은 OpenAI에 총 500억 달러를 투자하며, AWS는 OpenAI Frontier 모델의 독점적 제3자 클라우드 배포처로서 기업용 에이전트 구축 및 관리를 지원합니다. * **Stateful Runtime Environment:** Amazon Bedrock 내에 OpenAI 모델을 기반으로 한 '상태 유지 런타임'을 구축하여, 개발자가 컨텍스트를 유지하고 다양한 소프트웨어 도구 및 데이터 소스에 걸쳐 작업을 수행할 수 있도록 합니다. * **커스텀 실리콘 협력:** OpenAI는 향후 8년 동안 AWS의 차세대 AI 칩인 Trainium3 및 Trainium4를 포함하여 약 2기가와트(GW) 규모의 연산 용량을 사용하기로 합의했습니다. **생성형 AI 에이전트 및 개발 생산성 강화** * **Amazon Bedrock Projects API:** OpenAI 호환 API를 사용하여 생성형 AI 워크로드를 애플리케이션 단위로 격리하고, 액세스 제어 및 비용 추적, 관측성을 개선할 수 있습니다. * **Strands Labs 신설:** 에이전트 중심의 AI 프로젝트를 실험하기 위한 별도의 조직을 구성하고 Robots, AI Functions 등 실험적 프로젝트를 오픈소스로 공개했습니다. * **Amazon Location Service LLM Context:** 위치 기반 기능을 구현할 때 AI 에이전트(Claude Code 등)가 활용할 수 있는 최적화된 컨텍스트를 제공하여 개발 속도와 정확도를 높였습니다. **미디어 처리 및 보안 운영의 자동화** * **AWS Elemental Inference:** AI를 활용해 라이브 및 주문형 비디오를 틱톡, 인스타그램 릴스용 세로 형식으로 자동 크롭하며, 6~10초의 짧은 지연 시간 내에 하이라이트 클립을 추출합니다. * **AWS Security Hub Extended:** CrowdStrike, Okta 등 주요 보안 파트너 솔루션을 AWS 통합 빌링과 사전 협의된 가격으로 손쉽게 배포 및 통합 운영할 수 있는 풀스택 보안 서비스를 제공합니다. * **AWS AppConfig & New Relic 통합:** 기능 플래그(Feature Flag) 배포 시 New Relic의 워크플로 자동화와 연동하여 이상 감지 시 즉각적인 지능형 롤백을 수행, 장애 대응 시간을 초 단위로 단축합니다. **성공적인 AI 도입을 위한 실무적 제언** 단순한 AI 기술 실험을 넘어 실제 운영 환경에 적용하려는 기업은 AWS가 제시하는 **AI-DLC(AI-Driven Lifecycle) 프레임워크**를 적극 활용할 것을 권장합니다. 특히 에이전트 기반 시스템 구축 시 발생할 수 있는 환각 현상을 줄이기 위해 단순 RAG 방식과 GraphRAG 방식을 비교 분석하고, 새롭게 오픈소스화된 EKS Node Monitoring Agent 등을 통해 인프라 가시성을 확보하는 것이 중요합니다.

aws

AWS 주간 요약: Amazon EC2 M8azn 인스턴스, Amazon Bedrock의 새로운 오픈 가중치 모델 등 (2026년 2월 16일) | 아마존 웹 서비스 (새 탭에서 열림)

AWS는 최근 고성능 컴퓨팅을 위한 Amazon EC2 M8azn 인스턴스 출시와 더불어 Amazon Bedrock에 6개의 새로운 오픈 가중치(Open weights) 모델을 추가하며 인프라와 AI 역량을 동시에 강화했습니다. 이번 업데이트는 클라우드 업계 최고 수준인 5GHz의 CPU 주파수를 제공하여 고성능 요구 워크로드를 지원하는 한편, 개발자들이 다양한 오픈 소스 모델을 OpenAI API 규격과 호환되는 환경에서 더욱 유연하게 사용할 수 있도록 돕는 데 초점을 맞추고 있습니다. 이를 통해 기업들은 실시간 금융 분석부터 복잡한 추론 및 코딩 에이전트 구축까지 더욱 폭넓은 기술 선택지를 갖게 되었습니다. ### Amazon EC2 M8azn 인스턴스 정식 출시 * **압도적인 클라우드 성능:** 5세대 AMD EPYC 프로세서를 탑재하여 클라우드 사상 최고 수치인 최대 5GHz의 CPU 주파수를 제공합니다. * **이전 세대(M5zn) 대비 대폭 개선:** 컴퓨팅 성능은 최대 2배, 메모리 대역폭은 4.3배 향상되었으며, L3 캐시는 10배 더 커져 데이터 처리 효율이 극대화되었습니다. * **네트워크 및 스토리지 강화:** Nitro 시스템 6세대 카드를 기반으로 네트워크 처리량은 2배, Amazon EBS 처리량은 3배까지 향상되었습니다. * **주요 활용 분야:** 높은 주파수와 저지연 성능이 필수적인 실시간 금융 분석, 고성능 컴퓨팅(HPC), 고주파 매매(HFT), 게임 서버 및 시뮬레이션 모델링에 최적화되어 있습니다. ### Amazon Bedrock의 AI 모델 라인업 및 보안 기능 확장 * **6종의 신규 오픈 가중치 모델 추가:** DeepSeek V3.2, MiniMax M2.1, GLM 4.7/Flash, Kimi K2.5, Qwen3 Coder Next를 이제 Bedrock에서 사용할 수 있습니다. * **용도별 최적화:** 복잡한 추론과 에이전트 지능에 특화된 모델부터 긴 출력 윈도우를 지원하는 자율 코딩 모델, 그리고 운영 비용 효율성을 높인 모델까지 다양한 선택지를 제공합니다. * **Project Mantle 기반 연동:** 새로운 분산 추론 엔진인 Project Mantle을 통해 OpenAI API 규격과 즉시 호환되며, 서버레스 추론 환경에서 높은 수준의 쿼터 관리와 서비스 품질 제어를 지원합니다. * **AWS PrivateLink 지원 확대:** `bedrock-runtime`뿐만 아니라 `bedrock-mantle` 엔드포인트에 대해서도 PrivateLink를 지원하여, 데이터가 공용 인터넷을 거치지 않고 보안이 강화된 전용 네트워크를 통해 통신할 수 있습니다. ### 운영 편의성 및 비용 최적화를 위한 서비스 업데이트 * **Amazon EKS Auto Mode 로깅 강화:** CloudWatch Vended Logs를 통해 컴퓨팅 자동 확장, 스토리지, 네트워킹 등 관리형 쿠버네티스 기능의 로그를 더 저렴한 가격으로 수집하고 관리할 수 있습니다. * **OpenSearch Serverless 컬렉션 그룹:** 여러 컬렉션 간에 OpenSearch 컴퓨팅 유닛(OCU)을 공유할 수 있게 되어 전체적인 비용을 절감할 수 있으며, 지연 시간에 민감한 앱을 위해 최소 OCU 할당량을 지정할 수 있는 기능이 추가되었습니다. * **Amazon RDS 스냅샷 복원 개선:** 스냅샷을 복원하는 시점에 백업 유지 기간과 백업 창 설정을 즉시 수정할 수 있게 되었습니다. 기존에는 복원 완료 후 설정을 변경해야 했던 번거로움이 사라져 워크플로우가 간소화되었습니다. 고성능 단일 코어 성능이 필요한 조직은 M8azn 인스턴스 도입을 검토하여 실시간 처리 역량을 강화할 수 있습니다. 또한, AI 모델 선택의 폭이 넓어진 만큼 특정 작업(코딩, 추론 등)에 최적화된 오픈 가중치 모델을 Amazon Bedrock에서 테스트하여 성능과 비용의 균형을 맞춘 효율적인 AI 애플리케이션 개발 전략을 세우는 것을 추천합니다.