박성현, 초거대 AI를 ‘칩’ 아닌 ‘운영’으로 증명하다 관련 AI 생성 자료 이미지AI로 생성한 자료 이미지이며 실제 제품·인물·현장과 무관합니다.

리벨리온의 박성현 대표는 7월 23일 SK텔레콤의 500B급 독자 AI 모델 ‘A.X K1’을 자사 국산 NPU 기반 ‘리벨서버’ 단일 환경에서 구동하고, 다수 요청을 처리하는 에이전트 서비스 데모를 선보였다고 밝혔다. AI 반도체 스타트업 대표의 이번 행보는 더 빠른 칩을 내놓는 경쟁을 넘어, 대형 모델을 실제 서비스 비용과 전력 조건 안에서 운영할 수 있느냐는 질문에 답하려는 시도다.

박 대표가 이끄는 리벨리온은 NPU 설계 회사로 출발했지만, 최근 의사결정의 방향은 하드웨어 단품 판매보다 서버·최적화 소프트웨어·추론 운영을 묶는 쪽에 가깝다. 6월에는 AI 추론 최적화 기업 스퀴즈비츠 인수를 발표했고, 이번에는 대형 언어모델을 서버 한 대에서 서비스 형태로 돌리는 사례를 제시했다. 고객 입장에서 중요한 것은 칩의 연산 성능만이 아니라 모델 배포, 동시 사용자 처리, 전력비와 데이터센터 공간까지 포함한 총운영비이기 때문이다.

‘국산 모델+국산 인프라’의 상용화 시험

A.X K1은 5,190억 개 매개변수 규모의 전문가혼합형(MoE) 모델로 공개된 바 있다. 리벨리온은 이 모델이 추론할 때 필요한 연산을 자사 서버와 소프트웨어로 조율해 효율을 높였다고 설명한다. SK텔레콤도 7월 말 후속 모델 A.X K2를 공개하며 제조·국방·바이오와 스타트업 등 산업 현장으로 독자 AI 모델 활용을 넓히겠다는 계획을 제시했다.

이 흐름에서 박 대표의 역할은 국산 AI 생태계의 한 축인 모델 개발사와 다른 축인 인프라 공급사를 연결하는 데 있다. 대형 모델의 성능 경쟁은 이미 학습 단계뿐 아니라 추론 단계로 옮겨갔다. 기업이 AI 에이전트를 도입할 때 매번 대규모 GPU를 확보하기 어려운 만큼, 특정 업무에 맞는 서버 구성과 안정적 운영 역량은 조달·도입 판단의 핵심 조건이 될 수 있다.

독자가 봐야 할 것은 ‘데모’ 다음

  • 단일 서버 구동이 실제 고객 환경의 동시 접속·장시간 운영에서도 재현되는지
  • 전력 사용량, 처리량, 비용 절감 폭을 외부가 비교 가능한 방식으로 공개하는지
  • 리벨100 등 차세대 제품의 고객 공급과 소프트웨어 통합이 일정대로 이어지는지

이번 발표는 상용 AI 인프라의 가능성을 보여주는 기업 실증이다. 다만 성능과 비용 효과는 회사 발표 단계인 만큼, 박성현 대표의 전략은 향후 고객 도입과 독립적인 운영 지표를 통해 검증받아야 한다. AI 반도체의 승부는 ‘국산 칩을 만들었는가’보다 ‘현장 서비스가 계속 돌아가는가’에 달려 있다.

대표이미지는 AI로 생성한 자료 이미지이며 실제 제품·인물·현장과 무관합니다.

답글 남기기

FRONT에서 더 알아보기

지금 구독하여 계속 읽고 전체 아카이브에 액세스하세요.

계속 읽기