퓨리오사AI RNGD 핵심 요약
퓨리오사AI FuriosaAI는 대한민국을 대표하는 AI 반도체 팹리스 유니콘입니다. 1세대 비전 특화 NPU 워보이 WARBOY에 이어 출시된 2세대 레니게이드 RNGD는 고가의 HBM3 대신 고효율 LPDDR5X 메모리를 탑재하여 엔비디아 GPU 대비 3배 이상의 압도적인 전력 대 추론 효율과 총소유비용 TCO 절감을 달성했습니다.
HBM 병목을 극복한 퓨리오사AI 2세대 칩셋 RNGD 레니게이드
현재 글로벌 생성형 AI 시장은 엔비디아의 고비용 고발열 GPU 독점과 극심한 고대역폭 메모리 HBM 공급 부족에 시달리고 있습니다. FuriosaAI 퓨리오사AI의 레니게이드 RNGD는 이러한 데이터센터의 전력 소모와 비용 위기를 해결하기 위해 설계된 차세대 고성능 NPU입니다.
독자 개발한 텐서 축약 엔진 TCE 아키텍처와 48GB의 LPDDR5X 메모리를 통합하여 거대 언어 모델 LLM과 멀티모달 비전 트랜스포머 추론에서 와트당 최고 성능을 구현합니다.
FuriosaAI RNGD vs Nvidia L40S vs H100 데이터센터 스펙 비교표
| 비교 항목 | FuriosaAI RNGD | Nvidia L40S GPU | Nvidia H100 Tensor Core |
|---|---|---|---|
| 핵심 타깃 분야 | LLM 및 비전 고효율 추론 전용 | 그래픽 및 AI 추론 복합 | 대규모 초거대 모델 사전 학습 |
| 탑재 메모리 규격 | 48GB LPDDR5X 초저전력 메모리 | 48GB GDDR6 메모리 | 80GB HBM3 초고대역 메모리 |
| 소비 전력 TDP | 150와트 극저전력 설계 | 350와트 고발열 | 700와트 초고발열 |
| MLPerf 추론 성능비 | 동급 전력 대비 2배에서 3배 우수 | 기준점 성능 | 최대 성능 |
| 컴파일러 및 소프트웨어 | Furiosa SDK 및 PyTorch 완벽 호환 | CUDA 소프트웨어 생태계 | CUDA 소프트웨어 생태계 |
| 도입 가격 및 가성비 TCO | 엔비디아 대비 약 50% 비용 절감 | 고비용 | 극도의 고비용 수급 불안정 |
데이터센터 도입 관점에서의 RNGD 3대 핵심 경쟁력
1. 150W 저전력 설계로 냉각 인프라 비용 극소화
기존 데이터센터 서버 랙의 전력 한계 내에서 엔비디아 GPU 대비 2배 이상의 칩셋을 집적할 수 있어 상면 공간 비용과 에어컨 냉각 전력비를 절반 이하로 줄일 수 있습니다.
2. 파이토치 PyTorch 원클릭 드롭인 호환성
Furiosa SDK는 허깅페이스 HuggingFace 오픈소스 모델과 PyTorch 코드를 별도의 복잡한 포팅 작업 없이 원클릭으로 컴파일하여 최적화된 NPU 기계어로 변환합니다.
3. 안정적인 글로벌 파운드리 공급망
TSMC의 첨단 공정과 검증된 LPDDR5X 패키징을 채택하여 HBM 수급난의 영향을 받지 않고 엔터프라이즈 고객에게 안정적인 대량 납품이 가능합니다.
자주 묻는 질문 FAQ
Q. Llama 3.3이나 DeepSeek 같은 대형 LLM도 원활하게 구동되나요?
네, RNGD 칩셋은 멀티 카드 클러스터 구성을 지원하여 70B 이상의 대규모 모델도 지연 없이 고속으로 서빙할 수 있습니다.
Q. 엔비디아 쿠다 CUDA 코드와의 호환성은 어떤가요?
소프트웨어 스택이 파이토치 및 ONNX 런타임 표준을 완벽히 지원하므로 개발자는 CUDA 전용 코드를 수정할 필요 없이 표준 AI 프레임워크로 즉시 배포할 수 있습니다.
Q. 국내외 클라우드 서비스 제공사 도입 현황은 어떤가요?
국내 주요 통신사 데이터센터 및 글로벌 AI 클라우드 파트너들과 PoC 검증을 완료하고 상용 데이터센터 인프라에 공급을 확대하고 있습니다.
