리벨리온즈

리벨리온즈

Rebellions

LLM 연산 효율을 극대화한 고성능·저전력 NPU 기반의 AI 가속기 솔루션

무료 + 유료PyTorchTensorFlowvLLMLLM 기반멀티모달
웹사이트 방문하기rebellions.ai
아이닥와(과) 비교하기리벨리온즈 대안 모아보기

소개

리벨리온즈(Rebellions)는 대규모 AI 추론을 효율적으로 운영하기 위한 데이터센터용 AI 가속기와 시스템을 개발하는 기업입니다. 단일 칩을 크게 확장하는 방식과 여러 칩을 연결해 처리량을 늘리는 방식을 함께 고려한 칩렛 설계를 적용해, 모듈형 구조에서도 단일 칩에 가까운 효율과 일관된 성능을 목표로 합니다. 칩렛 간에는 높은 대역폭의 인터커넥트를 사용해 연산 자원과 메모리를 확장하며, 대규모 언어 모델의 프리필과 디코딩처럼 서로 다른 처리 특성을 하나의 인프라에서 다룰 수 있도록 설계되었습니다. 혼합 정밀도 연산은 작업에 따라 FP8·FP16·FP32 등 정밀도를 조절해 연산량과 메모리 사용을 줄이고, 스마트 프리패칭은 추론 과정에서 필요한 데이터를 미리 준비해 지연을 낮추는 방식입니다. 이 구조는 Llama 4와 DeepSeek-R1 같은 대형 Mixture of Experts 모델을 포함한 최신 LLM을 하이퍼스케일 환경에서 서비스하는 데 초점을 둡니다. 따라서 일반 소비자용 AI 앱이나 범용 PC용 부품보다는 클라우드 사업자, 하이퍼스케일 데이터센터, 기업·정부의 대규모 온프레미스 AI 운영 조직에 적합합니다. 학습과 추론을 모두 겨냥한 범용 GPU와 달리, 리벨리온즈는 처음부터 실제 서비스 추론의 전력 효율과 시스템 확장성을 우선한 점이 차별점입니다. 제품 도입 가격은 공개되어 있지 않습니다.

활용 워크플로우

입력

Hugging Face/PyTorch 기반 LLM 모델 가중치ONNX 및 TensorFlow 기반의 사전 학습된 그래프분산 추론을 위한 하이퍼스케일 데이터 센터 트래픽KV Cache 최적화가 필요한 대규모 컨텍스트 데이터

리벨리온즈

Rebel-SDK(컴파일러)를 통한 하드웨어 친화적 그래프 변환Chiplet 기반 아키텍처 내 연산 유닛별 작업 로드밸런싱고대역폭 인터커넥트를 활용한 칩 간 초고속 데이터 통신Smart Prefetch 기술 기반의 메모리 대역폭 병목 현상 제거혼합 정밀도(Mixed Precision) 및 MoE 동적 라우팅 가속

출력

와트당 토큰 처리량(TPS/Watt)이 최적화된 추론 결과Llama4/DeepSeek-R1급 초거대 모델의 저지연 응답실시간 전력 소비 및 연산 효율 모니터링 데이터KT Cloud 및 삼성 파운드리 연계형 가속화 비트스트림

Hyper-Scale Scaling

수평적 확장을 통해 Llama 400B 이상의 모델을 다중 칩 클러스터에서 단일 노드처럼 구동

MoE Efficiency Path

DeepSeek-R1과 같은 전문가 혼합(MoE) 모델 구동 시 활성 파라미터만 선별 가속하여 전력 소모 극소화

Edge-to-Cloud Integration

온프레미스 데이터 센터와 퍼블릭 클라우드 간의 하드웨어 추상화 계층(HAL)을 통한 원활한 배포

핵심 차별점: 칩렛(Chiplet) 설계 기반의 모듈형 아키텍처로 거대 파라미터 모델을 경쟁사 대비 3배 이상의 전력 효율로 처리하는 AI 가속기

주요 기능

  • HBM3E 탑재 칩렛 아키텍처 기반 차세대 칩 'REBEL(Rebel100)'
  • 엔비디아 대비 최대 50% 전력 소모 절감(전성비 우위)
  • Llama4·DeepSeek-R1 등 최신 MoE 모델 지원
  • vLLM·PyTorch Native 지원으로 친숙한 개발 환경 제공
  • MLPerf 벤치마크 검증 글로벌 수준 추론 성능
  • RebelRack·RebelPOD 랙 스케일 AI 인프라 플랫폼

장점 & 단점

웹검색을 통해 수집된 사용자 피드백 정보입니다

장점

  • 글로벌 벤치마크 MLPerf에서 엔비디아 T4 및 퀄컴 제품 대비 언어(BERT)와 비전(ResNet) 부문 모두 우수한 처리 속도를 기록하며 기술력을 입증했습니다. 엔비디아 GPU 대비 전력 소모를 약 5분의 1 수준으로 줄여 데이터센터 운영비용(TCO) 절감에 효과적입니다. 또한 국내 통신사(SKT, KT) 및 삼성전자와의 긴밀한 파트너십을 통해 실제 상용 서비스(에이닷 등)에 도입된 검증된 이력을 보유하고 있습니다.
  • 300+ 모델을 지원하여 AI 서비스를 바로 구현할 수 있습니다.
  • 리벨리온은 대규모 AI 시대에 필요한 에너지 효율성과 확장성을 갖춘 AI 전용 가속기를 개발하고 있습니다. LLM부터 멀티모달 AI까지, 리벨리온의 칩렛, 인터커넥트, 소프트웨어 스택은 하이퍼스케일 환경에서의 빠르고 확장 가능하며 전력 효율적인 배포를 위해 설계되었습니다.
  • AI 추론에 특화된 칩 개발
  • Arm, 삼성벤처투자 등 주요 기업과의 파트너십

단점

  • 엔비디아의 CUDA 생태계에 익숙한 개발자들에게는 전용 SDK와 컴파일러를 사용해야 하는 점이 진입장벽이 될 수 있습니다. 주로 추론 작업에 특화되어 있어 대규모 파운데이션 모델의 '학습' 단계에서는 엔비디아 H100 등 고성능 GPU 대비 범용성이 떨어집니다. 또한 글로벌 시장에서는 인텔 가우디(Gaudi)나 AMD 인스팅트(Instinct)와 같은 거대 기업의 대안 제품들과도 치열하게 경쟁해야 하는 상황입니다.
  • Nvidia와 같은 거대 기업과의 경쟁
  • AI 칩 시장의 빠른 변화 속도

가격 정보

무료 + 유료시작 가격: 가격 문의

AI 반도체(NPU) 및 하드웨어 솔루션을 제공하는 기업으로, 정찰제 가격 대신 비즈니스 요구사항에 따른 맞춤형 견적(Contact Sales)을 제공합니다. 대규모 데이터 센터나 연구소 등 도입 규모에 따라 가격이 결정되며, 소프트웨어 개발 키트(SDK)와 기술 지원이 포함될 수 있습니다. 일반 사용자를 위한 무료 플랜은 없으나 파트너십을 통한 기술 검토가 가능합니다.

정보 확인일: · 가격은 공식 페이지에서 재확인하세요

활용 사례

  • 국가 주도 소버린 AI 인프라 구축
  • 금융·의료 전용 대규모 프라이빗 LLM 운영
  • 하이퍼스케일 데이터센터 AI 가속기 공급
  • 통신사(SKT 에이닷 등) AI 서비스 추론 인프라

대상 사용자

하이퍼스케일 데이터센터클라우드 서비스 제공자(CSP)국가 AI 인프라 사업자

태그

비디오 생성개발자 도구클라우드

검증 근거

회사·가격·기능 정보는 아래 원문과 최근 검증 기록을 기준으로 표시합니다. 서로 다른 출처가 충돌하면 공식 원문과 최신 검증값을 우선합니다.

최근 검증 2026. 09. 02.검증 출처 4개

최근 소식

확인된 변경 내역

사용자 리뷰

리뷰를 불러오는 중...

대안 도구

이 도구 대신 사용할 수 있는 대안