컴퓨팅 플랫폼 전반의 최적화, 2,200만 명 이상의 개발자와 이들의 에이전트를 AI 소프트웨어와 연결
Arm이 개발자와 에이전트가 Arm 컴퓨팅 플랫폼 전반에서 AI 소프트웨어를 탐색, 최적화 및 배포할 수 있는 공통 방식을 제공하는 Arm AI 포털을 공개했다. 이 포털을 이용하면 개발자는 성능 및 정확도 데이터가 포함된 사전 최적화 모델을 탐색하고, 지연 시간과 메모리 사용량 및 크기를 비교하며 코드 예제와 배포 워크플로우를 확인할 수 있다.
Arm AI 포털은 향후 개발자가 자체 개발한 모델이나 독점 모델을 가져와 Arm 기반 환경에서 성능을 분석하고 최적화할 수 있는 툴도 제공할 예정이다. 에이전트-레디 AI 리소스는 정식 출시 전 얼리 액세스를 통해 이용할 수 있다.

AI 포털은 Arm 기반 컴퓨팅 환경 전반에서 언어, 음성, 비전 및 신경망 그래픽을 지원한다. 출시 시점에는 알리바바의 큐원(Qwen), 구글의 젬마(Gemma), 울트라리틱스의 욜로(YOLO) 등 사전 최적화된 모델을 제공한다. 해당 모델은 ExecuTorch, LiteRT, ONNX-RT 등의 런타임을 활용하며, 알리바바, 라즈베리 파이, 울트라리틱스 등 에코시스템 파트너의 지원을 기반으로 한다.
AI 포털은 개발자와 에이전트가 기존 개발 환경에서 최적화된 AI 모델과 리소스를 바로 활용할 수 있도록 설계됐다. Arm에 최적화된 모델은 허깅페이스를 통해 제공되며, 코딩 에이전트는 MCP를 통해 AI 포털의 리소스에 접근할 수 있다.
큐원3-TTS(Qwen3-TTS )는 비보 X300 스마트폰에서 단일 스레드 실행과 혼합 양자화를 적용해 4배 이상의 속도 향상을 달성했다. 이 과정에서 Q8_0 토커와 코드 예측기를 사용했으며, SME2(Scalable Matrix Extension 2)를 통해 성능을 가속화했다.
울트라리틱스 YOLO26n은 비보 X300 스마트폰(SME2 적용, FP32 대비 FP16을 사용한 단일 스레드 실행)과 라즈베리 파이 5(NEON 적용, FP32 대비 FP16 및 INT8 혼합 양자화 적용)에서 모두 40% 이상의 성능 향상을 달성했다.
목표 플랫폼에 최적화된 모델 찾아
AI 포털은 클라우드부터 엣지, 피지컬 AI까지 Arm 컴퓨팅 플랫폼 전반을 아우른다. 또한 개발자가 로보틱스를 위한 비전 모델부터 스마트폰용 생성형 AI, 클라우드 CPU에서 실행되는 작업별 대규모 언어 모델(LLM)에 이르기까지 목표 플랫폼에 최적화된 모델을 찾을 수 있도록 지원한다.
AI 포털은 SVE, SME, 신경망 가속기 등의 Arm 기술과 최적화된 소프트웨어를 연결한다. Arm CSS for Mobile 2가 대표적인 사례로, 개발자는 SME2로 가속화된 모델과 신경망 가속기를 탑재한 GPU를 Arm AI 포털에서 이용할 수 있다.
Arm은 수십 년간 소프트웨어 에코시스템에 투자해왔다. AI 포털은 이러한 투자를 AI 시대로 확장해, 2,200만 명 이상의 개발자와 에이전트가 대상 하드웨어에 최적화된 소프트웨어를 손쉽게 찾고 활용할 수 있도록 지원한다.
<저작권자(c)스마트앤컴퍼니. 무단전재-재배포금지>















