레노버, “학습(Training) 대신 추론(Inference)”을 정조준한 차세대 AI 서버 라인업 발표
AI 서버 시장의 메인 헤드라인이 초거대 AI 모델의 ‘학습(Training)’에서 실제 산업 현장의 ‘추론(Inference)’ 워크로드로 급격히 이동하고 있습니다.
레노버(Lenovo)는 이러한 시장 흐름에 발맞추어 하이브리드 AI 지원 아키텍처인 ‘Hybrid AI Advantage’ 전략과 함께, 엣지부터 엔터프라이즈 데이터센터까지 아우르는 추론 전용 씽크시스템(ThinkSystem) 및 씽크엣지(ThinkEdge) 라인업을 전면에 내세웠습니다.

1. 레노버의 AI 추론 특화 서버 라인업 분석
이번 라인업은 단순히 기존 서버에 GPU를 추가 장착한 것이 아니라, LLM 배포, 고밀도 AI 통합, 산업 엣지(Edge) 추론이라는 세 가지 핵심 워크로드별로 최적화된 하드웨어 폼팩터를 제시합니다.
[Lenovo 차세대 AI 추론 서버 라인업]1. ThinkSystem SR675i V3 • Target: 대형언어모델(LLM) 배포, 의료·제조·금융 특화 시뮬레이션 • Specs: AMD EPYC™ 프로세서 + NVIDIA RTX™ Blackwell GPU + PCIe Gen5 아키텍처2. ThinkSystem SR650i V4 • Target: 기존 데이터센터 인프라에 손쉽게 통합 가능한 고밀도 AI 추론 • Specs: 차세대 프로세서 + NVIDIA RTX PRO Blackwell 서버 에디션 GPU + 초고속 NVMe3. ThinkEdge SE455i V3 • Target: 소매, 통신, 스마트 팩토리 등 현장형 저지연(Low-Latency) 엣지 AI • Specs: -5℃ ~ 55℃ 극단적 환경 견디는 콤팩트 폼팩터 + 팬리스/강화 냉각
💧 Neptune™ 액체냉각과 풀스택 서비스 패키지
모든 라인업에는 레노버의 특허받은 온칩 직접 수냉식 기술인 ‘레노버 넵튠(Lenovo Neptune™)’ 기술 옵션이 적용되어 지속적인 고부하 추론 작업 시 전력 효율과 발열을 혁신적으로 줄여줍니다.
또한, 하드웨어 단품 판매를 넘어 다음과 같은 풀스택 서비스형(As-a-Service) 패키지를 함께 제공합니다:
- TruScale: 초기 CAPEX(설비투자) 부담을 줄이는 구독형 종량제 결제 모델
- AI Advisory Services: AI 팩토리 구축 및 워크로드 통합을 돕는 전문가 컨설팅
- Premier Support Plus: 데이터센터 미션 크리티컬 운영 및 장애 대응 지원
2. 왜 지금 “추론(Inference) 시장”인가?
글로벌 시장조사기관 퓨처럼그룹(Futurum Group) 등의 전망에 따르면, 글로벌 AI 추론 인프라 시장은 2024년 약 50억 달러 규모에서 2030년 488억 달러 규모로 연평균 46.3%의 폭발적인 성장을 기록할 것으로 예상됩니다.
┌────────────────────────────────────────────────────────┐│ AI 컴퓨팅 시장의 축 이동: 학습(Training) ➔ 추론(Inference) │├────────────────────────────────────────────────────────┤│ • 학습 시장: 대규모 클러스터 필요, 엔비디아 독점적 구조 ││ • 추론 시장: 다양한 폼팩터/비용효율성 중시, 절대강자 미정 │└────────────────────────────────────────────────────────┘
학습용 초거대 GPU 클러스터 시장은 고가의 독점적 인프라가 주를 이루지만, 기업 현장에서의 실질적인 수익과 가치는 ‘추론’에서 발생합니다. 레노버 같은 서버 OEM 입장에서는 추론 시장의 다양한 폼팩터 및 비용 효율성 니즈를 공략하는 것이 거대한 차별화 기회가 됩니다.
3. 한국 IT 인프라 담당자를 위한 시사점
국내 인프라 기획자 및 x86 서버 조달 담당자 입장에서 레노버의 이번 라인업은 매우 현실적인 메시지를 던집니다.
- 정부 AI 컴퓨팅 지원 사업 방향과의 일치: 최근 진행되는 국내 ‘국가AI컴퓨팅센터’ 및 ‘정부 GPU·NPU 이용자 지원 사업’ 역시 대규모 학습보다는 중소규모 기업들의 실질적 AI 서비스(추론) 배포를 우선 지원하는 흐름을 보이고 있습니다.
- x86 서버 조달 전략의 변화: 더 이상 범용 2U x86 서버에 GPU 카드를 장착하는 방식만으로는 전력 밀도, 발열, 오케스트레이션 효율을 감당하기 어렵습니다. 추론 워크로드의 특성에 맞춘 전용 액체냉각 폼팩터(SR650i/SR675i) 및 엣지 전용 서버(SE455i)의 도입 검토가 필요합니다.
- CAPEX에서 OPEX(TruScale)로의 전환: AI 파이프라인의 변동성에 유연하게 대응하기 위해, 초기 고가의 서버 매입(CAPEX) 대신 구독형 종량제(TruScale) 방식을 채택하여 재무 리스크를 극소화하는 전략이 유효합니다.
참고 출처: 레노버 신규 추론 서버 기술 사양 및 Hybrid AI Advantage 전략은 Network World, Data Center Knowledge 및 레노버 코리아 공식 기술 문서(Lenovo Press)를 근거로 작성되었습니다. 시장 전망치는 Futurum Group의 AI 인프라 보고서 인용 자료를 바탕으로 재구성되었습니다.