
오케스트로 그룹이 AI 반도체 기업 퓨리오사AI와 손잡고 국산 신경망처리장치(NPU) 기반 인공지능(AI) 인프라 상용화와 생태계 확장에 본격 나선다.
AI 인프라 시장은 엔비디아 그래픽처리장치(GPU)와 쿠다(CUDA) 생태계 중심으로 고착화돼 있어, 우수한 전력 효율과 성능을 가진 NPU를 도입하려 해도 소프트웨어 호환성이나 운영 편의성 부족으로 현장의 진입 장벽이 높았다. 양사는 이번 협력을 통해 현업에서 NPU 운용 시 겪던 기술적 한계를 허물고, 실제 서비스 환경에 최적화한 국산 NPU 기반 AI 인프라의 길을 연다는 목표다.
오케스트로 그룹과 퓨리오사AI는 지난 18일 서울 강남구 퓨리오사AI 본사에서 'NPU 기반 AI 인프라 및 플랫폼 기술·사업 협력'을 위한 업무협약(MOU)을 체결했다고 21일 밝혔다.
양사는 올해 초부터 퓨리오사AI의 2세대 NPU '레니게이드(RNGD)'와 오케스트로 AI 인프라 소프트웨어 간 기술 협력을 이어왔다. 퓨리오사AI NXT RNGD 서버를 오케스트로 AI 인프라 환경에 구축해 호환성과 주요 기능을 검증했고, RNGD 기반 거대언어모델(LLM)을 실제 서비스 환경에서 안정적으로 배포·서빙·운영하기 위한 기술을 단계적으로 구현했다.
그 성과로 오케스트로는 기존 GPU 중심으로 제공해 온 AI 추론 운영 플랫폼 '콘체르토 A.I.(CONCERTO A.I.)'의 지원 범위를 퓨리오사AI RNGD까지 확장했다. 콘체르토 A.I.는 AI 모델의 배포와 서빙, 컴퓨팅 자원 관리, 서비스 모니터링 등을 통합 지원하는 플랫폼이다. 고객이 NPU 기반 LLM 서빙 환경을 직접 구축해야 하는 부담을 대폭 줄였다.
특히 단순한 NPU 모델 구동을 넘어, 실제 서비스 운영에 필수적인 지능형 라우팅과 토폴로지 기반 스케줄링 기능도 지원한다. 요청 특성과 가속기 자원을 고려해 최적의 추론 경로를 구성하며, GPU와 NPU 등 이종 AI 가속기를 워크로드 특성에 맞춰 유연하게 활용할 수 있도록 돕는다.
이번 MOU는 양사가 쌓아온 기술 검증 성과를 실제 고객 사업으로 연결하기 위한 변곡점이다. 양사는 다양한 AI 모델과 워크로드를 대상으로 RNGD 기반 인프라의 성능과 안정성을 지속 검증하고, 고객 대상 벤치마크테스트(BMT)와 실증을 거쳐 구축·운영 모델을 구체화할 계획이다. 공공·금융·기업 고객의 프라이빗 AI 및 소버린 AI 구축 수요를 공동 공략해 산업별 실질 레퍼런스를 확보한다는 전략이다.
중장기적으로는 모델과 추론 런타임, AI 가속기를 아우르는 통합 운영·모니터링 기술을 고도화해 이기종 AI 인프라 환경으로 협력을 넓힌다. 오케스트로는 서버 가상화 '콘트라베이스', 클라우드 네이티브 관리 '비올라', 멀티·하이브리드 클라우드 '오케스트로 CMP', 데브옵스 '트럼본' 등 자체 풀스택 소프트웨어 역량과 결합해 인프라 구축부터 통합 관리까지 아우르는 영토를 확장한다.
백준호 퓨리오사AI 대표는 “오케스트로의 소프트웨어 스택과 RNGD를 결합해 대규모 AI 데이터센터와 토큰 팩토리를 최적으로 운영할 수 있는 풀스택 솔루션을 구현하고, 공공·금융·기업 고객의 실제 서비스 환경에서 상용 구축을 지속 확대해 나가겠다”고 포부를 밝혔다.
김민준 오케스트로 그룹 의장은 “이번 협약을 계기로 기술 검증을 고객 실증과 사업화로 연결하고, 양사의 기술 경쟁력을 결합해 공공·금융·기업 시장에서 새로운 AI 인프라 레퍼런스를 만들어 나갈 것”이라고 강조했다.
최호 기자 snoop@etnews.com