에버퓨어, LLM 첫 토큰 생성 최대 20배 단축…AI데이터 병목푼다

구자윤 기자
2026.10.01 13:46
에버퓨어 CI/사진 제공=에버퓨어

에버퓨어(구 퓨어스토리지)가 기업용 AI(인공지능)의 데이터 접근과 추론 속도를 높이는 기능을 선보인다. 기업 내부에 흩어진 데이터를 AI 에이전트가 안전하게 활용하도록 연결하고 LLM(거대언어모델)의 첫 토큰 생성시간을 최대 20배 단축하는 것이 핵심이다.

에버퓨어는 기업 데이터 관리와 AI 운영을 위한 새로운 플랫폼 기능을 10월부터 제공한다고 1일 밝혔다. 지난 6월 공개한 '데이터 프라이머시(Data Primacy·데이터 우선주의)' 전략을 실제 제품 기능으로 확대한 것이다. AI 시대 기업 시스템을 애플리케이션이 아닌 데이터 중심으로 설계해야 한다는 개념이다.

이번 업데이트에서는 '에버퓨어 데이터 인텔리전스'를 통해 에버퓨어 플랫폼뿐 아니라 퍼블릭 클라우드와 SaaS(서비스형 소프트웨어), 다른 업체의 스토리지에 흩어진 데이터를 검색·분류하고 맥락 정보를 제공한다.

MCP(모델 컨텍스트 프로토콜)도 기본 지원한다. AI 에이전트나 보안 도구가 자연어로 실시간 데이터 카탈로그를 조회해 필요한 데이터와 민감도 등을 파악할 수 있다. AI 에이전트마다 별도의 맞춤형 API(응용프로그램 인터페이스)를 개발해야 하는 부담을 줄이는 데 초점을 맞췄다.

AI 추론 속도도 높인다. 플래시블레이드와 '퓨어 KVA(Key-Value Accelerator)'를 이용해 LLM 추론에 필요한 컨텍스트를 GPU(그래픽처리장치) 메모리에 직접 사전 배치한다. 에버퓨어는 이를 통해 첫 토큰 생성시간(TTFT)을 최대 20배 단축하고 GPU 유휴 시간을 줄일 수 있다고 설명했다.

보안과 비용 관리 기능도 강화했다. 파일 내용을 직접 읽지 않고 접근 권한과 미사용 기간을 파악해 AI 에이전트에 데이터를 개방하기 전 노출 위험을 점검한다. 데이터 압축 기술 '딥리듀스'와 오픈 웨이트 모델 기반 레퍼런스 아키텍처를 통해 스토리지와 외부 AI 서비스의 API 토큰 비용도 줄일 수 있도록 했다.

프라카시 다르지 에버퓨어 데이터 및 디지털 경험 총괄은 "엔터프라이즈 AI가 한계에 부딪히는 이유는 모델 성능이 부족해서가 아니라 데이터가 실시간 자율형 에이전트를 지원할 준비가 돼 있지 않기 때문"이라며 "기업이 AI를 실험 단계에서 실제 운영 환경으로 확장할 수 있는 기반을 제공할 것"이라고 말했다.

<저작권자 © ‘돈이 보이는 리얼타임 뉴스’ 머니투데이. 무단전재 및 재배포, AI학습 이용 금지>