온프레미스 AI 어플라이언스 분석
Seongah Kim·
온프레미스 AI 어플라이언스 기업 분석
데이터 유출 우려와 규제(EU AI Act, 전자금융감독규정 등)로 인해 클라우드 AI를 도입하지 못하는 금융, 국방, 공공 부문을 타깃으로 '하드웨어+소프트웨어 통합 패키지(Appliance)'를 제공하는 글로벌 주요 기업들의 분석 보고서이다.
1. 글로벌 주요 기업별 상세 분석
① Wavenetic (웨이브네틱스)
- 웹사이트: wavenetic.com
- 본사: 슬로베니아 류블랴나 (Slovenia)
- 체급: 직원 2명의 극초기 스타트업 (2024년 매출 약 2.7억 원, 전년비 +74.48%)
- 패키지 구성:
- 장비: 자체 설계 소형/저소음 서버 'WaveNode' (사무실 책상 밑이나 변전소 배치 가능)
- 모델: 오픈소스 기반 온프레미스 모델
- 솔루션: 문서 기반 RAG 도구 'WaveOps', EV 충전 관리 플랫폼 'NEXUS'
- 시장 어필 방식: "클라우드를 믿지 못하는 규제 산업을 위한 AI 가전제품". 슬로베니아 국영 전력망(ELES) 납품 레퍼런스를 바탕으로 완전한 망분리(Air-gapped) 환경에서의 보안성을 강조한다.
② SambaNova Systems (삼바노바 시스템즈)
- 웹사이트: sambanova.ai
- 본사: 미국 캘리포니아 (USA)
- 체급: 누적 투자 유치액 수억 달러 규모의 글로벌 메가 스타트업 (SoftBank, Temasek, Intel 등 투자)
- 패키지 구성:
- 장비: 자체 설계 AI 전용 반도체 RDU(Reconfigurable Dataflow Unit) 탑재 랙 시스템
- 모델: 자체 최적화한 초거대 오픈소스 모델 (BF16 정밀도 유지)
- 솔루션: 엔터프라이즈용 풀스택 AI 플랫폼 'SambaNova Suite'
- 시장 어필 방식: "The Fastest AI Inference. Period." (가장 빠른 AI 추론. 그게 전부다.) 엔비디아 GPU의 메모리 병목을 해결하여 대형 모델 구동 시 최대 10배 빠른 속도와 5배 높은 에너지 효율을 제공하는 'AI 시대의 IBM' 전략을 취한다.
③ Lamini (라미니)
- 웹사이트: lamini.ai (현재 SSL 인증서 만료 및 관리 방치로 접속 불가)
- 본사: 미국 캘리포니아 (USA)
- 체급: 사실상 영업 종료 및 인재 인수(Acqui-hire) 상태 (2025년 중순 공동 창업자 및 핵심 엔지니어 팀 전체가 AMD로 이직하며 사실상 공중분해됨)
- 패키지 구성:
- 장비: AMD GPU 및 ROCm 인프라 기반 최적화 하드웨어 'Lamini Appliance'
- 모델: 고객 맞춤형 미세조정(Fine-tuning)이 가능한 오픈웨이트 모델
- 솔루션: 엔터프라이즈 전용 프라이빗 LLM 빌더 및 배포 플랫폼
- 시장 어필 방식: "Enterprise AI on your terms." (당신의 방식대로 구현하는 기업용 AI). 단 10줄의 코드로 사내 데이터를 안전하게 학습시키고 배포할 수 있는 극도의 개발자 편의성과 데이터 유출 제로(Zero Data Leakage)를 보장했으나, 하드웨어 파트너인 AMD에 흡수되면서 독자 비즈니스는 마감했다.
④ BtMData (비티엠데이터)
- 웹사이트: btmdata.com
- 본사: 유럽 (Europe)
- 체급: 유럽 내 친환경 데이터센터 인프라 및 소버린 GPU 클라우드 구축 전문 기업
- 패키지 구성:
- 장비: 4U 규격 랙 어플라이언스 'Edge Pod Mini' (NVIDIA Blackwell GPU 탑재)
- 모델: Llama 3.1, Mistral Large, DeepSeek-R1 등 소버린 오픈소스 모델 프리로드
- 솔루션: vLLM 추론 엔진, RAG 파이프라인, SSO 및 사용자 UI 통합 패키지
- 시장 어필 방식: "유럽 AI 법안(EU AI Act) 및 GDPR을 완벽히 준수하는 소버린 인프라". 모든 AI 답변에 암호화 서명(Intel TDX, NVIDIA Confidential Computing)을 적용하여 위변조가 불가능한 감사 로그(Audit Log)를 제공함으로써 금융권 감사에 특화된 포지셔닝을 취한다.
⑤ FuriosaAI (퓨리오사AI)
- 웹사이트: furiosa.ai
- 본사: 대한민국 서울 (Korea)
- 체급: 한국의 대표적인 AI 반도체 유니콘 (최근 국가 성장금융 등으로부터 대규모 투자 확보)
- 패키지 구성:
- 장비: 자체 설계 2세대 AI NPU 'RNGD(랑게)' 탑재 서버
- 모델: LG유플러스의 거대 언어모델 'EXAONE 4.0'
- 솔루션: 엘지유플러스의 기업용 AI 플랫폼 'ixi-Enterprise' 통합 패키지
- 시장 어필 방식: "Sustainable AI Compute." (지속 가능한 AI 컴퓨트). 엔비디아 GPU 대비 압도적인 '와트당 성능(Performance-per-watt)'을 무기로 삼으며, 국산 칩과 국산 모델을 결합한 완벽한 '국산 소버린 AI' 패키지를 공공 및 금융권에 제안한다.
⑥ Infercom (인퍼컴)
- 웹사이트: infercom.ai
- 본사: 룩셈부르크 (Luxembourg)
- 체급: 유럽 내 소버린 AI 인프라 및 추론 서비스 제공 신흥 강자
- 패키지 구성:
- 장비: SambaNova RDU 기반 전용 하드웨어 (고객사 데이터센터 내 90일 이내 구축)
- 모델: MiniMax, gpt-oss-120b, Gemma 3 등 유럽 내 호스팅 모델
- 솔루션: OpenAI 호환 API, 제로 데이터 보존(Zero Data Retention) 보안 솔루션
- 시장 어필 방식: "미국 CLOUD Act 노출이 전혀 없는 진정한 유럽 데이터 주권". 미국계 클라우드 기업의 유럽 자회사를 쓰더라도 피할 수 없는 미국 정부의 데이터 압수 권한(CLOUD Act)을 원천 차단하는 유럽 사법권 관할 인프라임을 강조한다.
⑦ Open Hippo (오픈 히포)
- 웹사이트: openhippo.ai
- 본사: 독일 아우크스부르크 (Germany)
- 체급: 독일 친환경 데이터센터(LEW GDC) 파트너십 기반의 소버린 AI 솔루션 기업
- 패키지 구성:
- 장비: NVIDIA Blackwell GPU 기반 고성능 서버 'Hippo Server'
- 모델: 특정 모델에 종속되지 않는 오픈웨이트 모델 (Llama, Mistral 등 자유 교체)
- 솔루션: 프라이빗 채팅 UI 'Hippo Chat', vLLM 및 LiteLLM 기반의 'Hippo API' 대시보드
- 시장 어필 방식: "Your data never leaves your network." (당신의 데이터는 절대 네트워크를 떠나지 않습니다). 계약 체결 후 단 4주 만에 하드웨어 조달부터 소프트웨어 배포, 사내망 연동까지 끝내는 **'4주 완성 초고속 턴키 구축'**과 의료/금융 데이터의 완벽한 로컬 통제를 내세운다.
2. 한눈에 보는 비교 매트릭스
기업명 | 하드웨어 기반 | 핵심 소프트웨어 솔루션 | 주요 타깃 및 소버린 내러티브 | 구축 속도 및 확장성 |
|---|---|---|---|---|
Wavenetic | 자체 소형 서버 (WaveNode) | WaveOps (RAG), NEXUS (EV) | 슬로베니아 공공/에너지 (망분리 보안) | 느림 (2인 기업의 수작업 구축) |
SambaNova | 자체 RDU 칩 랙 | SambaNova Suite (풀스택) | 글로벌 대형 금융, 국방 (초고속 추론) | 보통 (대형 인프라 구축 중심) |
Lamini | AMD GPU (ROCm) | 프라이빗 LLM 튜닝 플랫폼 | 포춘 500, 대기업 개발팀 (쉬운 미세조정) | 빠름 (소프트웨어 자동화 수준 높음) |
BtMData | NVIDIA Blackwell 랙 | vLLM, LiteLLM, RAG, SSO | 유럽 금융, 로펌 (EU AI Act 감사 로그) | 보통 (12주 이내 구축) |
FuriosaAI | 자체 RNGD NPU | LGU+ ixi-Enterprise, EXAONE | 한국 공공, 금융 (국산 소버린 AI) | 보통 (통신사 연계 패키지) |
Infercom | SambaNova RDU | OpenAI 호환 API, Zero-Retention | 유럽 금융, 정부 (미국 CLOUD Act 차단) | 보통 (90일 이내 온프레미스 구축) |
Open Hippo | NVIDIA Blackwell 서버 | Hippo Chat, Hippo API (LiteLLM) | 독일 의료, 금융 (데이터 사내망 통제) | 매우 빠름 (4주 완성 턴키) |
3. 아키텍트 관점의 시장 인사이트 및 벤치마킹 포인트
- 하드웨어의 이원화 전략
- 자체 칩 진영 (SambaNova, FuriosaAI): 엔비디아 GPU 수급 대란을 우회하고 TCO(총소유비용)를 낮추기 위해 자체 실리콘 기술력을 무기로 삼는다. 기술 장벽은 높으나 대규모 자본이 필수적이다.
- 범용 칩 진영 (Lamini, BtMData, Open Hippo): 검증된 엔비디아나 AMD 하드웨어를 빠르게 조달하되, 그 위에 얹는 소프트웨어 스택(vLLM, LiteLLM, RAG, UI)의 통합 편의성으로 승부한다. 초기 시장 진입 속도가 압도적으로 빠르다.
- 규제와 감사(Audit)가 곧 세일즈 포인트
- 금융권과 공공기관이 온프레미스를 찾는 진짜 이유는 단순히 '보안이 좋아서'가 아니라 **'규제 기관의 감사를 통과해야 해서'**이다.
- BtMData처럼 하드웨어 수준에서 암호화 서명을 적용해 **위변조 불가능한 AI 답변 감사 로그(Audit Log)**를 제공하는 기능은 금융권 세일즈에서 가장 강력한 킬러 피처(Killer Feature)가 된다.
- '4주 완성'과 같은 명확한 타임라인 제시
- 대기업들은 AI 인프라를 구축할 때 기획부터 배포까지 수개월이 걸리는 병목에 지쳐있다. Open Hippo처럼 **"4주 만에 전원 꽂아 쓰게 해준다"**는 명확한 타임라인 제시는 고객의 의사결정 속도를 극적으로 단축시킨다.