nvidia-blackwell

3 개의 포스트

aws4분 읽기큐레이션 요약

AWS 주간 요약: 뉴욕 서밋 결산, 하노이 로컬 존, Bedrock의 Grok 4.3, 가격 인하 등 (2026년 6월 22일) | Amazon Web Services

AWS는 뉴욕 서밋에서 장기적으로 가치를 축적하는 AI 에이전트를 중심으로 업무, 보안, 개발, 고객용 애플리케이션 전반의 기능을 확장했다. 동시에 하노이 Local Zone, Grok 4.3, S3 annotations, ECS 오토 스케일링 개선 등 인프라와 생성형 AI 관련 기능도 공개했다. S3 벡터 검색, GameLift 네트워크 대역폭, AWS Marketplace 서비스 등록 수수료 인하를 통해 비용 절감도 추진했다. ## 뉴욕 AWS 서밋: 장기적으로 가치를 만드는 에이전트 - **업무용 에이전트** - Amazon Quick에서 데스크톱 앱을 통해 다단계 자율 에이전트를 생성하고 실행할 수 있다. - 이메일, Slack, 캘린더, 작업을 하나의 우선순위 기반 피드로 통합한다. - 사용자가 설정한 개인화 규칙에 따라 업무를 정리한다. - **보안용 에이전트** - AWS Continuum은 코드 취약점 전 생명주기를 분석·검증·조치하는 AI 기반 보안 서비스다. - AWS Security Agent에 위협 모델링, 주요 Git 플랫폼용 PR 코드 스캔 및 수정 기능이 추가됐다. - Kiro, Claude Code 플러그인, MCP를 통한 IDE 통합도 지원한다. - **개발 및 현대화 에이전트** - Kiro는 네이티브 iOS 앱을 제공한다. - AWS DevOps Agent는 배포 전에 코드 변경 사항을 평가하는 릴리스 관리 기능을 추가했다. - AWS Transform은 기술 부채를 지속적으로 줄이는 자동 현대화를 지원한다. - **고객이 만드는 에이전트** - Amazon Bedrock AgentCore에 인프라·오케스트레이션용 GA 하네스가 추가됐다. - Web Search, Managed Knowledge Base, Guardrails 정책 통합을 제공한다. - AWS Context 서비스는 조직 데이터 간 관계를 매핑해 에이전트의 맥락 이해를 돕는다. ## 하노이 Local Zone과 데이터 주권 - 베트남 하노이에 `ap-southeast-1-han-1a` Local Zone이 추가됐다. - Amazon S3와 Amazon EBS Local Snapshots를 지원한다. - 데이터를 현지에 저장하고 백업할 수 있어 데이터 레지던시 요구사항을 충족하는 데 유리하다. - AWS Global View의 Regions and Zones 탭 또는 `ModifyAvailabilityZoneGroup` API로 활성화할 수 있다. ## AWS Blocks와 개발 환경 단순화 - AWS Blocks는 애플리케이션 개발자를 위한 오픈 소스 TypeScript 프레임워크다. - AWS 계정 없이도 Postgres, 인증, 실시간 메시징을 포함한 로컬 실행 환경을 제공한다. - 배포 시 동일한 코드를 변경 없이 AWS 프로덕션 서비스에서 실행할 수 있다. - 필요할 때 AWS CDK로 전환해 클라우드 리소스를 직접 구성할 수 있다. ## Bedrock, S3, 에이전트 기능 확장 - **Grok 4.3** - xAI의 Grok 4.3을 Amazon Bedrock에서 사용할 수 있다. - 추론, 에이전트 워크플로, 엔터프라이즈 애플리케이션을 지원한다. - 도구 호출, 구조화된 출력, 응답 스트리밍을 제공한다. - **S3 annotations** - S3 객체에 최대 1GB의 풍부하고 변경 가능한 컨텍스트를 직접 연결할 수 있다. - 해당 컨텍스트는 조회 가능하며, AI 에이전트가 데이터를 탐색·이해·처리하는 데 활용된다. - 별도의 메타데이터 시스템을 유지하지 않고도 대규모 AI 및 자동화 워크플로를 구성할 수 있다. - **Strands Agents** - 오픈 소스 에이전트 개발 도구인 Strands에 컨텍스트 관리 기능이 강화됐다. - Strands Shell은 격리된 실행 환경을 제공한다. - Strands Evals에는 장애 주입 테스트와 레드팀 테스트 기능이 추가됐다. ## 성능과 운영 기능 개선 - **ECS 서비스 오토 스케일링** - 20초 단위 고해상도 지표와 지표 게시 최적화를 지원한다. - 테스트에서 스케일 아웃 트리거 시간이 363초에서 86초로 76% 단축됐다. - 확장 및 신규 태스크 프로비저닝까지의 전체 시간은 386초에서 109초로 72% 줄었다. - **EC2 G7** - NVIDIA RTX PRO 4500 Blackwell Server Edition GPU와 6세대 Intel Xeon 프로세서를 탑재한다. - G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 향상됐다. - **Management Console Private Access** - 인터넷 연결 없이 VPC에서 AWS Management Console에 접근할 수 있다. - 에어갭 환경에서도 엄격한 네트워크 보안 정책을 유지하며 인프라를 관리할 수 있다. ## 보안 및 마켓플레이스 - Palo Alto Networks Advanced DNS Security를 Route 53 Resolver DNS Firewall에 직접 적용할 수 있다. - 별도 방화벽을 배포하거나 VPC 구성을 변경하지 않고 DNS 위협 방어 기능을 사용할 수 있다. - AWS Marketplace Storefront가 정식 출시되어 파트너가 자체 브랜드 카탈로그를 웹사이트나 애플리케이션에 구축할 수 있다. - 고객은 AWS Marketplace를 통해 파트너 솔루션을 검색하고 구매할 수 있다. ## 가격 인하 - **Amazon S3 Vectors** - 대규모 벡터 인덱스의 유사도 검색 쿼리 요금을 최대 80% 인하했다. - 기존 애플리케이션 변경 없이 자동 적용된다. - AI, RAG, 시맨틱 검색 비용 절감에 직접적인 효과가 있다. - **Amazon GameLift Servers** - 6세대 이상 인스턴스의 AWS 내 네트워크 송수신 대역폭을 무료화했다. - On-Demand와 Spot 모두 적용되며, 사용자는 인스턴스 시간만 지불한다. - **AWS Marketplace 전문 서비스** - 등록 수수료를 기존 2.5%에서 0.5%로 낮췄다. - 컨설팅 업체, 시스템 통합 사업자, 관리형 서비스 제공업체의 거래 비용을 줄인다. 이번 발표의 방향은 AI 에이전트를 실제 업무와 운영에 통합하는 동시에, 데이터 주권·보안·성능·비용 문제를 함께 개선하는 것이다. 에이전트 기반 애플리케이션을 구축하려는 팀은 Bedrock AgentCore와 S3 annotations를 검토하고, 대규모 검색·게임·서비스 운영 환경은 이번 가격 및 성능 개선의 적용 여부를 확인하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

NVIDIA RTX PRO 4500 Blackwell 서버 에디션 GPU로 가속되는 Amazon EC2 G7 인스턴스 발표 | Amazon Web Services

Amazon EC2 G7은 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU와 6세대 Intel Xeon 프로세서를 결합한 GPU 인스턴스다. G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 향상됐으며, 네트워크·스토리지·영상 처리 성능도 크게 개선됐다. AI 추론, 그래픽 렌더링, 영상 변환, VDI, 공간 컴퓨팅, 데이터 분석 등에 적합하다. ## NVIDIA Blackwell GPU 기반 성능 향상 - AWS 최초로 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU를 지원한다. - GPU당 32GB 메모리를 제공하며, 인스턴스당 최대 8개 GPU와 총 256GB GPU 메모리를 구성할 수 있다. - G6 대비 GPU 메모리 용량은 1.33배, 메모리 대역폭은 2.45배 향상됐다. - 5세대 Tensor Core와 4세대 RT Core를 탑재해 AI 추론과 실시간 그래픽 처리를 가속한다. - G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 높다. ## 네트워크와 로컬 스토리지 개선 - EFA(Elastic Fabric Adapter)를 지원하는 최대 700Gbps 네트워크 대역폭을 제공한다. - G6 대비 네트워크 처리량이 7배 증가해 다중 GPU·다중 노드 AI 및 분석 작업에 유리하다. - 최대 7.6TB의 로컬 NVMe SSD를 사용할 수 있다. - 대규모 모델과 데이터셋을 컴퓨팅 자원 가까이에 저장해 데이터 전송 지연과 처리 오버헤드를 줄인다. - 다중 GPU 환경에서는 NVIDIA GPUDirect P2P를, GPU와 네트워크·스토리지 간 통신에는 GPUDirect RDMA와 EFA를 지원한다. ## 영상 인코딩·디코딩 성능 - 9세대 NVENC와 6세대 NVDEC 엔진을 탑재했다. - 고해상도 영상 작업에 필요한 4:2:2 인코딩과 디코딩을 지원한다. - 동시 처리 가능한 영상 스트림 수가 G6 대비 1.5배 증가했다. - 영상 트랜스코딩, 스트리밍, 미디어 분석과 같은 작업에 적합하다. ## 인스턴스 구성 - 총 7개 크기로 제공된다. - 최대 사양: - NVIDIA RTX PRO 4500 GPU 8개 - GPU 메모리 256GB - vCPU 192개 - 시스템 메모리 768GiB - 네트워크 대역폭 700Gbps - 로컬 NVMe SSD 7.6TB - 12xlarge, 24xlarge, 48xlarge 크기는 Dedicated Instances도 지원한다. ## 지원 소프트웨어와 운영 환경 - AWS Deep Learning AMI와 NVIDIA Workstation AMI를 통해 사전 구성된 GPU 드라이버를 사용할 수 있다. - Amazon EKS에서 사용하려면 NVIDIA 드라이버 R595와 EKS 자동화 기능을 이용해 AMI를 구성해야 한다. - Amazon Linux, Ubuntu, RHEL, Windows Server를 지원한다. - DirectX, Vulkan, OpenGL 등 주요 그래픽 라이브러리와 호환된다. - Amazon EMR on EKS에서 GPU 가속 데이터 분석에도 활용할 수 있다. ## 제공 지역과 구매 방식 - 발표 시점에는 미국 동부 오하이오와 미국 서부 오리건 리전에서 사용할 수 있다. - 향후 리전 확대 여부는 AWS Capabilities by Region 페이지에서 확인할 수 있다. - On-Demand, Savings Plans, Spot Instances 방식으로 구매 가능하다. - 자세한 요금은 Amazon EC2 요금 페이지에서 확인해야 한다. G7은 GPU 메모리와 네트워크 대역폭이 중요한 AI 추론, 대규모 그래픽 처리, 영상 처리 및 분산 분석 작업에 특히 적합하다. 기존 G6에서 GPU·네트워크 병목을 겪고 있다면, 사용 리전과 실제 워크로드별 비용 대비 성능을 비교한 뒤 G7으로 이전하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws원문

NVIDIA RTX PRO 60 (새 탭에서 열림)

Amazon은 NVIDIA RTX PRO 6000 Blackwell 서버 에디션 GPU를 탑재한 새로운 EC2 G7e 인스턴스의 정식 출시를 발표했습니다. 이 인스턴스는 생성형 AI 추론 워크로드에서 뛰어난 비용 효율성을 제공하며, 이전 세대인 G6e 대비 최대 2.3배 향상된 추론 성능을 자랑합니다. 공간 컴퓨팅 및 과학적 컴퓨팅과 같이 높은 그래픽 성능이 요구되는 작업에 최적화된 하이엔드 솔루션입니다. ### NVIDIA Blackwell GPU 기반의 성능 혁신 * **메모리 용량 및 대역폭:** NVIDIA RTX PRO 6000 Blackwell GPU를 통해 G6e 대비 2배의 GPU 메모리(개당 96GB)와 1.85배의 메모리 대역폭을 제공합니다. * **대규모 모델 처리:** 향상된 메모리 사양 덕분에 단일 GPU 환경에서도 FP8 정밀도로 최대 700억 개(70B) 파라미터 규모의 중간급 모델을 실행할 수 있습니다. * **컴퓨팅 파워:** 최신 Intel Emerald Rapids 프로세서를 탑재하여 강력한 CPU 성능과 GPU 성능의 조화를 이룹니다. ### 멀티 GPU 효율성 및 상호 연결 기술 * **NVIDIA GPUDirect P2P 지원:** 단일 GPU 메모리를 초과하는 대규모 모델을 위해 PCIe 인터커넥트를 통한 GPU 간 직접 통신을 지원하여 지연 시간을 최소화합니다. * **대역폭 향상:** G6e에 탑재된 L40s GPU 대비 GPU 간 대역폭이 최대 4배 증가하여, 멀티 GPU 워크로드의 처리 효율이 비약적으로 상승했습니다. * **확장성:** 단일 노드에서 최대 8개의 GPU를 사용하여 총 768GB의 GPU 메모리를 확보할 수 있어, 거대 언어 모델(LLM) 추론에 유리합니다. ### 네트워킹 및 스토리지 가속화 * **고속 네트워크:** G6e 대비 4배 더 넓은 최대 1,600Gbps의 네트워크 대역폭을 제공하여 소규모 멀티 노드 워크로드에 적합합니다. * **지연 시간 감소:** Elastic Fabric Adapter(EFA)를 통한 GPUDirect RDMA를 지원하여 원격 GPU 간 통신 시 병목 현상을 줄였습니다. * **데이터 로딩 최적화:** Amazon FSx for Lustre와 GPUDirectStorage를 결합하여 최대 1.2Tbps의 처리량을 지원하므로, 대용량 모델 데이터를 매우 빠르게 로드할 수 있습니다. ### 상세 인스턴스 사양 * **인스턴스 구성:** 최소 `g7e.2xlarge`(1 GPU, 8 vCPU)부터 최대 `g7e.48xlarge`(8 GPU, 192 vCPU)까지 총 6가지 크기를 제공합니다. * **시스템 자원:** 최대 2,048GiB의 시스템 메모리와 15.2TB의 로컬 NVMe SSD 스토리지를 선택할 수 있어 데이터 집약적인 작업에 대응합니다. 생성형 AI 모델의 크기가 커짐에 따라 고용량 GPU 메모리와 빠른 상호 연결 성능이 필수적인 환경에서 G7e 인스턴스는 최적의 선택지입니다. 특히 기존 G6e 인스턴스 사용자가 성능 한계를 느끼거나, 70B급 모델을 보다 효율적으로 서빙하고자 하는 개발 팀에게 이 인스턴스로의 전환을 적극 추천합니다. 현재 미국 동부(버지니아 북부) 및 미국 서부(오레곤) 리전에서 바로 사용할 수 있습니다.