반도체 설계 분야의 강자 Arm이 자사 칩 기반의 다양한 기기에서 인공지능(AI) 애플리케이션을 개발하는 이들을 위해 'Arm AI 포털'을 공식 출시했습니다. 스마트폰, 로봇, 클라우드 서버 등 Arm 아키텍처를 사용하는 수많은 장치에서 AI 앱을 효율적으로 구축할 수 있도록, 미리 최적화된 AI 모델과 상세한 성능 데이터, 그리고 실제 적용 가능한 코드 예제를 한곳에 모아 제공하는 것이 핵심입니다.
이 포털은 AI 모델을 찾고, 대상 기기에서 성능을 측정하며, 최적화하는 데 소요되던 개발자들의 막대한 시간과 노력을 절감해 줄 것으로 기대됩니다. 개발자들은 Arm 칩에 맞춰 조정된 모델의 성능과 정확도, 응답 속도, 메모리 사용량, 모델 크기 등을 쉽게 비교할 수 있습니다. 초기에는 알리바바의 음성 합성 모델 '큐원3-TTS', 구글의 대규모 언어모델(LLM) '젬마(Gemma)', 울트라리틱스의 사물 인식 모델 '욜로(YOLO)' 등 언어, 음성, 영상 인식 분야의 주요 모델들을 지원하며, 이 모델들은 AI 모델 공유 플랫폼인 허깅페이스(Hugging Face)에서도 다운로드 가능합니다. 특히, Arm은 AI 코딩 도구도 포털을 활용할 수 있도록 설계하여, AI 코딩 에이전트가 표준 연결 방식(MCP)으로 포털의 데이터를 직접 활용할 수 있게 할 예정입니다.
Arm AI 포털에 공개된 최적화 모델들은 실제 성능 개선 효과를 보였습니다. 예를 들어, 알리바바의 '큐원3-TTS' 모델은 비보(Vivo) 스마트폰에서 4배 이상 빨라졌고, '욜로' 모델은 비보 스마트폰과 소형 컴퓨터 라즈베리 파이 5(Raspberry Pi 5)에서 모두 40% 이상 성능이 향상되었습니다. 이는 개발자들이 Arm 기반 하드웨어의 잠재력을 최대한 활용하여 더 빠르고 효율적인 AI 앱을 만들 수 있게 됨을 의미합니다. 이처럼 Arm은 하드웨어 설계뿐만 아니라 소프트웨어 생태계 지원을 강화함으로써, AI 시대의 다양한 엣지 디바이스(Edge Device)에서 자사 칩의 영향력을 더욱 확대하려는 전략을 펼치고 있습니다.
