AWS 베드록에 그록 4.6 추가…50만 토큰·4단계 추론 지원

아마존웹서비스(AWS)가 xAI의 최신 인공지능 모델 ‘그록 4.6’을 아마존 베드록에 추가했다. 기업 개발자는 기존 AWS 환경에서 장문 분석과 코딩, 에이전트 작업에 특화된 모델을 선택해 애플리케이션에 연결할 수 있게 됐다.

아마존 시애틀 본사 캠퍼스와 스피어스 외관
아마존 시애틀 본사 캠퍼스와 스피어스. 사진=Buiobuione / Wikimedia Commons (CC BY-SA 4.0, 변경 없음)

50만 토큰 문맥과 4단계 추론

AWS 공식 모델 카드에 따르면 그록 4.6은 최대 50만 토큰의 문맥 창을 제공한다. 추론 강도는 낮음·중간·높음·최고 등 4단계로 조정할 수 있어 응답 속도와 복잡한 문제 해결 사이에서 용도별 선택이 가능하다.

입력은 텍스트와 이미지를 지원하고 결과는 텍스트로 반환한다. 응답 스트리밍과 도구 호출, 구조화 출력, 프롬프트 캐싱도 지원 범위에 포함됐다. 모델 식별자는 xai.grok-4.6이다.

데이터센터 내부의 서버 랙
데이터센터 서버 랙. 사진=Carl Lender / Wikimedia Commons (CC BY 2.0, 변경 없음)

베드록 런타임과 맨틀 경로 제공

접속 경로는 기존 베드록 런타임과 베드록 맨틀로 나뉜다. 런타임에서는 미국권 또는 글로벌 교차 리전 추론 식별자를 사용하고, 맨틀은 미국 오리건 리전에서 제공된다. 이용 가능한 지역과 기능이 경로마다 달라 배포 전에 확인이 필요하다.

표준 요금제의 글로벌 교차 리전 가격은 100만 토큰당 입력 2달러, 출력 6달러다. 리전 내 또는 권역 교차 리전은 입력 2.20달러, 출력 6.60달러로 안내됐다. 캐시 읽기 비용도 글로벌 0.50달러, 리전·권역 0.55달러로 구분된다.

기업용 모델 선택 폭 확대

이번 추가로 베드록 이용 기업은 AWS의 권한 관리와 운영 환경 안에서 xAI 모델을 선택할 수 있게 됐다. 특히 긴 문서나 대규모 코드 저장소를 한 번에 다루는 업무, 여러 단계를 이어가는 에이전트 작업에서 50만 토큰 문맥 창을 활용할 여지가 커졌다.

다만 실제 도입 시에는 데이터 거주 요건과 호출 경로, 서비스 지역을 함께 점검해야 한다. 같은 모델이라도 리전 선택에 따라 가격과 가용 기능이 달라질 수 있기 때문이다.

댓글 남기기

error: Content is protected !!

광고 차단 알림

광고 클릭 제한을 초과하여 광고가 차단되었습니다.

단시간에 반복적인 광고 클릭은 시스템에 의해 감지되며, IP가 수집되어 사이트 관리자가 확인 가능합니다.