2026년 3월 1일, 일요일
식민지역사박물관
aw 2026

메타의 Llama 3.2 LLM 통해 모든 곳에서 AI 추론 가속화 및 확장 시도하는 Arm

Arm의 머신러닝 기술 부사장 겸 펠로우 이안 브랫(Ian Bratt)은 최근 Arm 블로그 글(링크)을 통해 Arm CPU에서 Meta의 새로운 Llama 3.2 버전 실행 시 클라우드에서 엣지까지의 성능 대폭 향상되었고, 메타와의 협력을 통해 성과를 이어가고 있다고 밝혔다

Arm CPU에서 Meta의 새로운 Llama 3.2 버전 실행 시 클라우드에서 엣지까지의 성능 대폭 향상

Arm이 메타(Meta)가 새롭게 발표한 버전의 라마(Llama) 3.2 LLM 통해 모든 곳에서 AI 추론을 가속화하고 확장하고 있는 것으로 나타났다.

Arm의 머신러닝 기술 부사장 겸 펠로우 이안 브랫(Ian Bratt)은 최근 Arm 블로그 글(링크)을 통해 Arm CPU에서 Meta의 새로운 Llama 3.2 버전 실행 시 클라우드에서 엣지까지의 성능 대폭 향상되었으며, Meta와 Arm간의 협업으로 개인화된 온디바이스 추천이나 일상 작업 자동화 등의 사용 사례에서 더 빠른 혁신이 가능했다고 밝혔다.

그는 “AI가 지속적으로 빠르게 진화함에 따라 새로운 버전의 대규모 언어 모델(LLM)이 정기적으로 등장하고 있다. AI의 잠재력과 기회를 최대한 활용하기 위해서는 클라우드부터 엣지에 이르기까지의 모든 곳에서 실행되는 LLM이 필요하지만, 이로 인해 상당한 컴퓨팅 및 에너지 수요가 발생하고 있다.”고 설명했다.

그리고, 오픈 소스 LLM에 대해 다음과 같이 분석했다.

“에코시스템은 이 문제를 해결하기 위해 힘을 모으고 있으며, 광범위한 AI 추론 워크로드를 대규모로 지원하고 사용자에게 새롭고 가속화된 AI 경험을 더 빠르게 제공하기 위해 보다 새롭고 효율적인 오픈 소스 LLM을 출시하고 있다.”

Arm은 Meta와의 협력을 통해 Arm CPU에서 최신 Llama 3.2 LLM을 지원하여 이러한 과제를 해결하기 위한 오픈 소스 혁신과 Arm 컴퓨팅 플랫폼의 강력한 조합을 보여주고 있다며 메타(Meta)와의 협력에 대한 성과를 강조했다.

이어서 그는 “Arm의 지속적인 투자와 이와 같은 새로운 LLM과의 협력은 에코시스템이 Arm CPU에서 AI를 실행하는 이점을 자동으로 확인할 수 있음을 의미하며, 이를 통해 개발자들이 AI 추론 워크로드를 타깃할 때 선택할 수 있는 플랫폼이 되었다”고 밝혔다.

그에 따르면, Llama 3.2 1B 및 3B와 같이 기본적인 텍스트 기반 생성형 AI 워크로드를 지원하는 소규모의 LLM의 가용성은 대규모 AI 추론을 구현하는데 매우 중요하다.

메타의 Llama 3.2 LLM 통해 모든 곳에서 AI 추론 가속화 및 확장 시도하는 Arm
Llama Stack: a streamlined developer experience (image. meta)

Arm CPU에 최적화된 커널을 통해 Arm 기반의 모바일 디바이스에서 최신 Llama 3.2 3B LLM을 실행하면 처리 속도가 5배, 토큰 생성 속도가 3배 향상되어 생성 단계에서 초당 19.92개의 토큰을 처리할 수 있다. 이는 디바이스에서 AI 워크로드를 처리할 때 지연 시간이 줄어들고 전반적인 사용자 경험이 훨씬 빨라진다는 것을 의미한다.

또한, 엣지에서 더 많은 AI를 처리할수록 클라우드를 오가는 데이터의 전력이 절약되어 에너지 및 비용 절감으로 이어진다.

특히 그는 오픈 소스를 통한 혁신과 협업의 성과를 강조했다.

Llama 3.2와 같은 최신 LLM을 공개적으로 사용할 수 있도록 하는 것은 매우 중요하다고 강조했다.

그는 “오픈 소스 혁신은 놀라울 정도로 빠르게 진행되고 있다.”며, 이전 버전에서 오픈 소스 커뮤니티는 24시간 이내에 최신 LLM을 Arm에서 실행할 수 있었다고 설명했다.

Arm은 Arm Kleidi를 통해 소프트웨어 커뮤니티를 더욱 강화하고 있으며, 전체 AI 기술 스택이 이 최적화된 CPU 성능을 활용할 수 있도록 지원한다. Kleidi는 애플리케이션 개발자가 별도의 통합 없이 모든 AI 프레임워크에서 Arm Cortex 및 Neoverse CPU의 AI 기능 및 성능을 활용할 수 있도록 지원한다.

또한 “최근 Kleidi와 PyTorch의 통합과 현재 진행 중인 ExecuTorch와의 통합으로, Arm은 클라우드에서 엣지에 이르기까지 개발자가 Arm CPU에서 원활한 AI 성능 이점을 누릴 수 있도록 지원하고 있다”고 설명했다. Kleidi와 PyTorch의 통합으로 Llama 3 LLM을 실행할 때 Arm 기반 AWS Graviton 프로세서에서 첫 토큰 생성 시간이 2.5배 향상되었다고도 밝혔다.

Arm은 새로운 LLM과 오픈 소스 커뮤니티 및 Arm의 컴퓨팅 플랫폼을 통해 2025년까지 1,000억 개 이상의 Arm 기반 디바이스가 AI를 지원할 수 있도록 AI의 미래를 구축하고 있는 것이다.

뉴스레터 구독하기

아이씨엔매거진은 AIoT, IIoT 및 Digital Twin을 통한 제조업 디지털전환 애널리틱스를 제공합니다.
테크리포트: 스마트제조, 전력전자, 모빌리티, 로보틱스, 스마트농업

SourceARM
AW2026 expo
ACHEMA 2027
오승모 기자
오승모 기자http://icnweb.kr
기술로 이야기를 만드는 "테크 스토리텔러". 아이씨엔 미래기술센터 수석연구위원이며, 아이씨엔매거진 편집장을 맡고 있습니다. 디지털 전환을 위한 데이터에 기반한 혁신 기술들을 국내 엔지니어들에게 쉽게 전파하는데 노력하는 중입니다.
fastech EtherCAT
as-interface

Related Articles

World Events

Stay Connected

440FansLike
407FollowersFollow
224FollowersFollow
120FollowersFollow
372FollowersFollow
152SubscribersSubscribe
spot_img
spot_img
spot_img
automotion
InterBattery
Power Electronics Mag

Latest Articles

Related Articles

PENGUIN Solutions
NVIDIA GTC AI Conference
AW2026 expo

Related Articles

fastech EtherCAT
as-interface
에이디링크, 글로벌 규격 인증 통합 IAP·EVP 플랫폼 출시

에이디링크, 글로벌 규격 인증 통합 IAP·EVP 플랫폼 출시

0
글로벌 산업용 컴퓨터 기업 에이디링크가 전 세계 어디서든 별도의 복잡한 승인 절차 없이 바로 사용할 수 있는 신형 컴퓨터 시리즈를 출시했다. 성능은 높이면서도 각국의 안전 인증을 미리 받아두어 해외로 기계를 수출하는 기업들의 고민을 해결해 준다
마우저, NXP i.MX 91 프로세서 공급으로 IoT·엣지 애플리케이션 확대 지원

마우저, NXP i.MX 91 프로세서 공급으로 IoT·엣지 애플리케이션 확대 지원

0
NXP 반도체의 에너지 효율적인 i.MX 91 시스템온칩(SoC)은 진화하는 프로토콜과 새로운 표준에 대응할 수 있는 뛰어난 성능과 보안 기능을 갖춘 경제적인 솔루션이다
슈나이더 일렉트릭, ‘현장 지능형 통합 인프라’ 공개

슈나이더 일렉트릭, ‘현장 지능형 통합 인프라’ 공개

0
글로벌 기업 슈나이더 일렉트릭이 공장의 기계 제어와 전기 관리를 하나의 똑똑한 시스템으로 합친 통합 인프라를 공개한다. 이를 통해 에너지를 절약하고 탄소 배출을 줄이며, 갑작스러운 정전에도 AI 설비가 안전하게 돌아가도록 돕는다
“운전대 잡은 AI, 시스템 온 칩으로 구현” ST, AI 탑재 자동차용 MCU ‘스텔라 P3E’ 전격 공개

“운전대 잡은 AI, 시스템 온 칩으로 구현” ST, AI 탑재 자동차용...

0
글로벌 반도체 기업 ST가 인공지능 칩을 내장한 자동차용 컴퓨터를 세계 최초로 출시하여, 클라우드 연결 없이도 차량 스스로 실시간 판단을 내리고 소프트웨어 업데이트만으로 기능을 업그레이드하는 똑똑한 미래차 시대를 앞당긴다
“엔지니어링 리드타임 혁신” 에머슨, 제약 레시피 자동화 솔루션 출시

“엔지니어링 리드타임 혁신” 에머슨, 제약 레시피 자동화 솔루션 출시

0
글로벌 기업 에머슨이 복잡한 코딩 없이도 종이 일기장 같은 제약 공정 기록을 디지털로 즉시 바꿔주는 기술을 출시하여, 신약이 환자에게 전달되는 시간을 수개월에서 단 며칠로 줄인다
클라우드 넘어 ‘현장’으로… 마우저, 엣지 컴퓨팅 리소스 허브 강화

클라우드 넘어 ‘현장’으로… 마우저, 엣지 컴퓨팅 리소스 허브 강화

0
글로벌 부품 유통사 마우저가 데이터 발생 현장에서 즉각 정보를 처리하는 엣지 컴퓨팅 기술 정보를 총망라하여 제공함으로써, 더 빠르고 안전하며 똑똑한 인공지능 기기 개발을 돕는다
- Our Youtube Channel -Engineers Youtube Channel

Latest Articles