Gyrfalcon이 성능/와트 효율성에 최적화된 GAINBOARD 2803S 추론 가속기를 출시했습니다.
Gyrfalcon Technology Inc. (GTI)는 2018년 11월 29일 2세대 서버 솔루션인 GAINBOARDTM 2803S Inference Accelerator Server를 발표했습니다. 이 시스템은 기존 데이터 센터에 업그레이드로 설치되어 병렬로 실행되는 대량의 데이터 모델에 대한 AI 가속을 신속하게 배포할 수 있습니다. 110W에서 1,084 TOPS를 제공하는 GAINBOARDTM 2803S는 데이터 센터를 위한 성능 대비 전력 소비의 업계 최고 비율과 낮은 총소유 비용을 제공합니다.
빠르게 작동하도록 설계되었지만 상당한 전력을 소비하는 범용 GPU와 달리, GTI의 서버 솔루션은 데이터 센터 환경의 제약 조건 내에서 AI 데이터를 처리하기 위해 처음부터 구축되었습니다. GTI의 사장인 Frank Lin은 다음과 같이 말했습니다: "많은 데이터 센터 운영자들은 다른 공급업체로부터 제품을 기다려야 한다고 불평했으며, 이제 그들은 성능 향상과 훨씬 낮은 전력 소비로 필요한 솔루션을 빠르게 얻을 수 있습니다." 그는 또한 솔루션이 데이터 센터 운영자들의 주요 관심사를 해결한다고 강조했습니다: "데이터 센터에서 최우선 비즈니스 관심사는 비용을 낮게 유지하면서 경쟁사보다 더 높은 서비스를 제공할 수 있는 능력입니다. 우리의 GAINBOARDTM 2803S Inference Accelerator Server는 경쟁 솔루션보다 장비 비용이 낮고, 월별 에너지 비용이 낮으며, 냉각 장비 요구 사항을 줄입니다. 이는 다른 AI 솔루션으로 데이터 센터 공급업체가 경험한 단점 없이 AI 가속을 달성하는 완벽한 솔루션입니다."
각 GAINBOARDTM 2803S Inference Accelerator Server는 듀얼 Xeon 프로세서 및 4개의 PCIe 카드에 수용된 64개의 개별 Lightspeeur® 2803S 칩으로 구성되며, 각 카드는 4개의 Xilinx FPGA로 지원되는 16개의 칩을 포함합니다. 그 핵심에는 GTI의 독점 Matrix Processing Engine (MPE) 및 AI Processing in Memory (APiM) 아키텍처가 있으며, 이는 convolutional neural networks (CNN)를 사용하여 AI를 가속화합니다. 단일 Lightspeeur® 2803S 칩은 단 0.7W에서 16.8 TOPS를 제공하며 2밀리초 이하의 레이턴시를 지니고 있으며, ResNet, MobileNet, ShiftNet 및 VGG 신경망을 지원하여 추론 및 훈련을 수행합니다.
이 설계는 AI 모델을 병렬로 처리할 수 있으며 cascade 모드에서 작동하여 대규모의 복잡한 모델을 호스트 프로세서 개입 없이 개별 칩 전체에 분산할 수 있으며, 높은 성능과 낮은 에너지 소비를 유지합니다. GAINBOARDTM 2803S Inference Accelerator Server는 2019년 1분기 초부터 이용 가능하며, advanced edge 및 데이터 센터 애플리케이션을 위한 2801S multichip board를 사용하는 서버 구성 및 Lightspeeur® 2801S 및 2803S Neural Accelerators를 포함한 기존 GTI 솔루션 라인업에 추가됩니다. 제품은 이미 Fujitsu, LG 및 Samsung을 포함한 전자 회사에 상업적으로 공급되고 있으며, 현재 적격 고객에게 이용 가능합니다.