마이크로소프트가 검색 환경 혁신을 위해 데이터센터에 Altera Arria® 10 FPGA(field programmable gate array)를 채택함으로써 신경망 알고리즘의 혁신을 달성하고 있는 것으로 나타났다.
알테라(Altera)에 따르면, 마이크로소프트는 Altera Arria® 10 FPGA(field programmable gate array)를 채택함으로써 CNN(convolutional neural network) 알고리즘을 기반으로 한 데이터 센터 가속화로 비약적으로 향상된 와트당 성능을 달성하고 있다. CNN 알고리즘은 이미지 분류, 이미지 인식, 자연 언어 프로세싱에 널리 사용되고 있는 알고리즘이다.

알테라는 “Microsoft의 연구진은 클라우드 기술을 향상시키기 위한 연구를 하고 있는데, Arria 10 개발자 키트와 Arria 10 FPGA 엔지니어링 샘플을 이용함으로써 와트당 40GFLOPS에 이르는 성능을 달성하게 되었다. 이것은 데이터 센터 성능으로서 업계에서 가장 뛰어난 수준이다.”고 밝히고, 또한 “GPGPU를 이용했을 때와 비교해서 이와 같은 FPGA 성능은 CNN 플랫폼으로 전력대 성능비가 3배 이상 더 우수한 것이다. 오픈 소프트웨어 개발 언어인 OpenCL이나 또는 VHDL을 이용해서 Arria 10 FPGA와 이의 IEEE754 하드 부동소수점 DSP(digital signal processing) 블록을 코딩함으로써 이와 같은 성능을 달성하게 되었다.”고 전했다.
마이크로소프트 리서치(Microsoft Research)의 클라이언트 및 클라우드 앱 이사인 Doug Burger는 “우리 연구진은 Arria 10 엔지니어링 샘플을 이용함으로써 CNN 성능과 전력 효율에 있어서 비약적인 향상을 이룰 수 있었다. 이 실리콘에 통합하고 있는 DSP 블록의 정밀 하드 부동소수점 연산이 이와 같은 도약적인 성능 결과를 달성할 수 있었던 한 요인이다”고 말했다. Microsoft의 블로그(http://bit.ly/1MMMzvG)로 들어가면, Burger 이사가 인프라 차원에서 데이터 센터가 직면하고 있는 과제들에 대해서 살펴보고 어떻게 기존의 CPU를 재프로그램가능 FPGA로 교체함으로써 Microsoft가 이와 같은 과제들을 해결할 수 있게 되었는지에 대한 설명을 볼 수 있다.
알테라의 연산 및 스토리지 사업부 이사인 Michael Strickland는 “FPGA는 유연한 데이터 패스를 활용함으로써 컨벌브(convolve)와 풀링(pooling)을 매우 효율적으로 할 수 있으므로 아키텍처 차원에서 신경망 알고리즘에 이용하기에 유리하다. 그럼으로써 많은 OpenCL 커널들이 외부 메모리로 나갈 필요 없이 상호 간에 직접적으로 데이터를 전달할 수 있다. Arria 10은 또 곱셈과 덧셈 둘 다에 대해서 하드 부동소수점을 지원한다는 점이 또 다른 아키텍처적 이점이다. 그럼으로써 이 하드 부동소수점은 기존 FPGA 제품보다 더 많은 여유 로직을 활용할 수 있게 하고 더 빠른 클록 속도를 가능하게 한다”고 말했다.
마이크로소프트는 올 하반기에 완공 예정인 Bing 데이터 센터 서버에 이용하고자 혁신적인 Catapult 보드로 검색을 가속화하기 위해서 알테라의 Stratix V FPGA를 채택한 것으로 알려졌다.
한편, 중국 최대 온라인 검색 엔진 회사인 바이두(Baidu)도 이미 알테라 FPGA를 통해 CNN 알고리즘을 활용중이다. 지난해 9월 알테라는 중국 바이두가 딥 러닝(deep learning) 애플리케이션에 FPGA와 CNN(convolutional neural network) 알고리즘을 이용하는 것에 관해서 협력하고 있다고 밝혔다. 딥 러닝은 더욱 더 정확하고 신속한 온라인 검색이 가능하도록 중요한 역할을 할 것으로 기대되는 기술이다.
아이씨엔 오승모 기자 oseam@icnweb.co.kr
마이크로소프트, 알테라 FPGA로 데이터센터 알고리즘을 혁신하다
뉴스레터 구독하기
아이씨엔매거진은 AIoT, IIoT 및 피지컬 AI, 디지털트윈을 통한 제조업 디지털전환 애널리틱스를 제공합니다.
테크리포트: 자율제조, 전력전자, 모빌리티, 로보틱스, 스마트농업
독일·미국이 짜놓은 판을 깨라… 공장 통신 표준 ‘TSN·SPE’ 영토 전쟁
본 칼럼은 AI 팩토리 및 초고속 자율주행 통신 환경 구축을 위한 TSN의 시간 동기화 아키텍처와 SPE의 필드 레벨 IP 연동 메커니즘을 조명하고, IEC/IEEE 국제 표준화 기구 내 한국 기술의 주도권 확보 방안을 논의한다.
벡터, 충전 케이블 한계 100m로 늘린 DC 통신 컨트롤러 ‘vSECC.InPlug’ 공개
벡터가 DC 충전 커넥터 내부에 통신 모듈을 탑재하여 충전기 케이블 길이를 100m까지 늘려주는 'vSECC.InPlug'와 버스 차고지 통합 관리 시스템 'vCharM.DMS'를 발표했다.
ABB, AI 데이터센터용 통합 직류 솔루션 ‘인피니투스’ 출시
ABB가 급증하는 AI 데이터센터 전력 수요에 대응하기 위해 전력 공급원에서 랙까지 연결되는 최초의 통합 직류(DC) 솔루션 ‘인피니투스’를 출시하고 800V DC 고효율 전력망 구축에 나섰다.
에티나, 엔비디아 젯슨 토르 기반 플래그십 에지 AI 시스템 ‘AIE-KT78·AIE-KT68’ 출시
에지 AI 전문 기업 에티나가 엔비디아의 최신 차세대 인공지능 칩을 탑재해 협동로봇과 휴머노이드 로봇이 주변 환경을 스스로 인식하고 즉각 움직일 수 있도록 돕는 초고성능 로봇용 제어 반도체 시스템을 선보였다.
인피니언, 300A 피크 전류 구현한 AI 가속기용 초고밀도 전력 반도체 출시
인피니언이 손톱보다 작은 단일 칩으로 최대 300A의 전류를 안전하게 공급하고 최신 액체 냉각 시스템과 연동하여 AI 데이터센터의 전력 부족과 과열 문제를 해결하는 초고밀도 전력 반도체 신제품을 선보였다.
노르딕 세미컨덕터, 초소형·초저전력 멀티 프로토콜 SoC ‘nRF54LC10A’ 출시
노르딕 세미컨덕터가 초소형 1.9x2.3mm 크기에 블루투스, 스레드, 매터 통신과 첨단 보안 기능을 통합한 저전력 반도체 nRF54LC10A를 출시하여 소형 IoT 기기 개발을 간소화했다.
래티스 반도체, 양자 내성 암호 탑재 FPGA ‘Mach-N2’ 및 AI 설계...
래티스가 양자 컴퓨터 해킹 공격을 방어하는 차세대 보안 칩과 함께 복잡한 회로를 자연어로 입력하면 AI가 자동으로 설계해 개발 기간을 획기적으로 줄여주는 기술을 발표했다










![[칼럼] IT/OT 융합 환경의 사이버 복원력 확보를 위한 OT 보안 아키텍처 및 AI 위협 탐지 기술 분석 [칼럼] IT/OT 융합 환경의 사이버 복원력 확보를 위한 OT 보안 아키텍처 및 AI 위협 탐지 기술 분석](https://icnweb.kr/wp-content/uploads/2023/02/rockwell-automation-mobileAna_900.jpg)


![[진단] 테솔로 IPO가 던지는 의미… 피지컬 AI 시대, 로봇핸드가 새로운 AI 반도체가 된다 [진단] 테솔로 IPO가 던지는 의미… 피지컬 AI 시대, 로봇핸드가 새로운 AI 반도체가 된다](https://icnweb.kr/wp-content/uploads/2026/06/DG-5F-S-tesollo-robot-hand-1024x683.jpg)










![[이슈] 스마트 공장 통신 표준 완성… IEC/IEEE 60802 TSN 통합 표준 발표 [이슈] 스마트 공장 통신 표준 완성… IEC/IEEE 60802 TSN 통합 표준 발표](https://icnweb.kr/wp-content/uploads/2026/09/TSN_60802_standard_AI-900web.jpg)




![[그래프] 국회의원 선거 결과 정당별 의석수 (19대-22대) 대한민국 국회의원 선거 결과(정당별 의석 수)](https://icnweb.kr/wp-content/uploads/2025/04/main-image-vote-flo-web-2-324x160.jpg)







