[아이뉴스24 안세준 기자] "모바일 AI는 인식 중심 AI에서 생성형 AI를 거쳐 에이전틱 AI로 발전하고 있다."
비네쉬 수쿠마 퀄컴 제품 관리 부사장은 24일(현지시간) 미국 하와이 마우이에서 열린 스냅드래곤 서밋 2026에서 이같이 밝혔다. 스마트폰 AI가 콘텐츠를 만드는 수준을 넘어 사용자의 상황을 이해하고 여러 작업을 직접 수행하는 단계로 진화하고 있다는 설명이다.
![24일(현지시간) 미국 마우이에서 열린 스냅드래곤 서밋 2026 현장에서 비네쉬 수쿠마 퀄컴 인공지능(AI) 제품 관리 부사장이 무대 위에 올라 AI 플랫폼 부문에 대해 발표하고 있다. [사진=공동취재단]](https://image.inews24.com/v1/fb2ebc2acfe765.jpg)
수쿠마 부사장은 "약 10년 전에는 이미지 분할, 탐지, 분류 등 인식 중심 AI가 핵심이었다. 이후 텍스트·이미지·영상 등을 생성하는 생성형 AI로 발전했다"고 말했다. 이어 "생성형 AI는 클라우드에서만 가능하다는 인식이 있었지만, 퀄컴은 스냅드래곤에서 이를 온디바이스로 구현해왔다"고 덧붙였다.
최근에는 AI가 하나의 요청에 답하는 데서 그치지 않고 여러 작업을 연속적으로 처리하는 방향으로 발전하고 있다. 수쿠마 부사장은 "음성을 주요 인터페이스로 활용하고 단일 작업이 아닌 여러 복합 작업을 연속적으로 수행하는 에이전트 플로(Agent Flow)로 진화하고 있다"고 했다.
퀄컴은 이를 위해 스냅드래곤 8 엘리트 6세대에서 CPU와 GPU, 헥사곤 NPU, 센싱 허브가 역할을 분담하도록 했다.
수쿠마 부사장은 "오라이온 CPU는 에이전트의 계획과 추론, 조율을 담당하는 오케스트레이션 계층"이라고 설명했다. 오라이온 플렉스캐시는 에이전트 메모리와 계획 데이터, 워크플로 컨텍스트를 컴퓨팅 자원 가까이에 유지해 지연시간을 줄이고 반응성을 높인다.
GPU에는 '아드레노 뉴럴 퓨전'을 적용했다. 그는 "뉴럴 프로세싱과 AI 슈퍼 레졸루션, 프레임 생성을 하나의 그래픽 파이프라인으로 통합했다"고 언급했다. 이를 위해 그래픽 파이프라인 내부에서 AI 모델을 처리하는 아드레노 매트릭스 코어도 도입했다.
헥사곤 NPU도 에이전틱 AI에 맞춰 강화했다. 12개 스칼라 코어와 8개 벡터 코어, 향상된 매트릭스 코어를 갖췄으며 새로운 엘리먼트와이즈 가속기도 추가했다. 최대 32K 컨텍스트와 온디바이스 MoE 모델을 지원한다.
외부 메모리 접근을 줄여 AI 처리 지연시간을 낮추기 위한 설계도 진행했다. 수쿠마 부사장은 "헥사곤 공유 메모리를 50% 확대해 컨텍스트와 KV 캐시, 추론 상태 등을 NPU 내부에 더 오래 유지할 수 있도록 했다"고 말했다.
/마우이(미국)=안세준 기자([email protected])
--comment--
첫 번째 댓글을 작성해 보세요.
댓글 바로가기