simoori.AI·IT 소식에서 신호만 골라 훑는 곳
피드로

AWS, 토큰 비용 28% 낮춘 AI 에이전트 실행환경 '스트랜즈 하네스' 공개

AWS가 오픈소스 에이전트 실행환경 스트랜즈 하네스를 공개해 토큰 비용을 크게 줄였다.

AI타임스 · 23일 오후 · 분야 오픈소스 · 분야 에이전트 · 사건종류 출시

signal 포인트

핵심

  1. 스트랜즈 하네스는 모델과 도구, 메모리를 조립형으로 제공해 에이전트 구축 과정을 단순화했다.
  2. 내부 테스트에서 클로드와 GPT 모델 대비 6개 벤치마크 전반에서 토큰 비용을 평균 28퍼센트 절감했다.
  3. 도구 실행 결과 요약과 프롬프트 캐싱을 통해 처리 시간과 비용을 함께 줄였다고 설명했다.
요약 표
항목결과
전체 벤치마크토큰 비용 평균 28퍼센트 절감
페이블 5 대비 클로드 코드비용 77퍼센트 낮음
터미널벤치 2.1클로드 코드 대비 점수 우위
라이선스아파치 2.0

요약은 자동으로 만들어집니다. 사실 확인이 필요하면 원문을 읽어주세요.

원문 보기 (한국어)

아래는 출처에서 가져온 원문입니다.

(사진=AWS)

(사진=AWS)

아마존웹서비스(AWS)는 에이전트를 손쉽게 구축·운영할 수 있는 오픈소스 실행환경 '스트랜즈 하네스'를 공개했다고 23일 밝혔다.

스트랜즈 하네스는 AI 에이전트 실행에 필요한 구성요소를 조립해 제공하는 방식으로 모델·도구·메모리 등을 개별적으로 연결해야 했던 기존 구축 과정을 단순화했다.

로컬 PC에서 즉시 실행하거나 클라우드 환경에 배포할 수 있으며, 자유로운 수정이 가능한 '아파치 2.0' 라이선스로 제공된다.

내부 테스트에 따르면 스트랜즈 하네스는 앤트로픽 클로드·오픈AI GPT 모델 대비 6개 벤치마크 전반에서 토큰 비용을 평균 28% 절감하면서도 정확도는 동등하거나 더 높은 수준을 유지한 것으로 나타났다.

특히 '페이블 5' 대상 테스트에서는 '클로드 코드' 대비 비용이 77% 낮았고, '터미널벤치 2.1' 점수는 더 높게 나타났다.

이는 도구 실행 결과가 1500토큰을 넘거나 기억 정보량이 85%를 초과하면 자동으로 요약·축약하고, 반복 요청은 '프롬프트 캐싱'으로 저장해 재사용함으로써 처리 시간과 비용을 함께 줄였기 때문이라는 설명이다.

지원 모델은 아마존 베드록을 포함해 앤트로픽·오픈AI·구글의 최신 모델, '올라마(Ollama)' 기반 로컬 모델까지 연동된다.

기본 에이전트에는 명령어 실행, 파일 편집, 웹 검색 도구가 탑재되며, 세션 ID로 이전 대화를 이어가는 장기 기억 기능과 복잡한 작업을 보조 에이전트에 위임하는 기능, 다단계 작업을 체크리스트로 관리하는 기능 등을 지원한다.

함께 제공되는 '스트랜즈 CLI'를 이용하면 자연어만으로 에이전트 시제품 구축이 가능하며, 타입스크립트나 파이썬 코드로 내려받아 원하는 도구로 이어서 개발하는 방식을 지원한다.

김해원 기자 hwkim@aitimes.com

원문의 저작권은 출처에 있습니다.출처에서 원문 보기 새 창에서 열림