1조개 이상 파라미터 거대 모델 '네모트론4'

자체 칩 개발 흐름에 대응해 현 구도 방어전략

中 오픈소스 AI 급부상에 위기감, 견제 목적도

美 기술·안보 지키는 대표기업이란 효과도 노려

젠슨 황(왼쪽) 엔비디아 CEO와 오픈AI 샘 올트먼 CEO. 연합뉴스 자료사진
젠슨 황(왼쪽) 엔비디아 CEO와 오픈AI 샘 올트먼 CEO. 연합뉴스 자료사진

인공지능(AI) 반도체 시장을 장악하고 있는 엔비디아가 이번에는 세계 최정상급 오픈소스 AI 모델 개발에 뛰어들었다.

AI 모델 경쟁을 하려는 게 아니라 오픈소스 AI 확산을 통해 자사 그래픽처리장치(GPU) 수요를 확대하고 빅테크의 '탈(脫)엔비디아' 움직임을 방어하는 동시에 중국의 급부상하는 오픈소스 AI에 맞서겠다는 다목적 전략으로 풀이된다.

미국 IT 전문매체 디인포메이션은 11일(현지시간) 엔비디아가 매개변수 1조개 이상 규모의 초대형 오픈소스 AI 모델 '네모트론4'(Nemotron 4)를 개발하고 있다고 보도했다. 지난 6월 공개한 '네모트론3 울트라'보다 약 두 배 큰 규모로, 세계 최고 수준의 오픈소스 모델들과 정면으로 경쟁할 수 있는 성능을 목표로 하는 것으로 알려졌다.

엔비디아는 이날 별도로 대형 모델을 '증류'해 만든 매개변수 300억개 규모의 경량 모델 '네모트론3.5 라이트닝'도 공개했다. 이는 거대 모델뿐 아니라 상대적으로 적은 연산 자원으로 구동할 수 있는 AI 모델까지 포괄해 오픈 AI 생태계를 확대하려는 움직임으로 해석된다.

현재 규모만 놓고 보면 중국 모델과의 격차는 여전히 크다. 문샷의 키미 K3는 2조8000억개, 알리바바의 큐원3.8-맥스는 2조4000억개, 딥시크 V4-프로는 1조6000억개의 매개변수를 가진 것으로 알려졌다. 네모트론3 울트라 역시 관련 벤치마크에서 미국 오픈소스 모델 가운데 2위에 머물렀고 전체 순위에서는 상위 40위권 밖이었다.

엔비디아는 모델 규모를 키우는 방식 대신 압축 기술을 통해 상대적으로 작은 모델의 성능을 높이는 전략을 채택하고 있다. 네모트론4의 사전학습 데이터와 아키텍처 일부는 확정됐지만 최종 학습은 아직 끝나지 않았으며, 정확한 사양과 출시 시점도 정해지지 않은 것으로 전해졌다. 이르면 올가을 늦게 완성될 전망이다.

개발 인력도 이전보다 크게 늘어날 것으로 보인다. 앞선 대형 모델 관련 연구 논문에는 570명이 참여했는데 네모트론4에는 이보다 많은 인력이 투입될 것으로 알려졌다.

엔비디아가 막대한 자원을 들여 오픈소스 AI 개발에 나선 가장 직접적인 이유는 AI 모델의 확산이 결국 GPU 수요 확대로 이어진다는 판단에서다.

고성능 모델을 누구나 활용할 수 있게 되면 기업과 연구기관은 이를 자체 데이터에 맞게 파인튜닝하거나 추론 서비스를 구축하기 위해 더 많은 컴퓨팅 자원을 필요로 한다. 엔비디아 입장에서는 모델 자체를 판매하지 않더라도 AI 사용자가 늘어날수록 GPU와 데이터센터 수요가 증가하는 구조다.

실제로 엔비디아는 자체 AI 모델 학습에 필요한 컴퓨팅 자원도 크게 늘렸다. 자사 칩을 구매하는 클라우드 사업자로부터 AI 서버를 다시 임차하는 방식으로 클라우드 서비스에 대한 다년간 약정 규모를 2031년 초까지 280억달러로 확대했다. 1년 전보다 약 3배 증가한 규모다.

이 전략에는 빅테크 고객들의 자체 AI 반도체 개발에 대한 방어적 성격도 깔려 있다. 오픈AI를 비롯해 주요 AI 기업과 빅테크들은 엔비디아 GPU 의존도를 낮추기 위해 자체 AI 반도체 개발에 나서고 있다. 엔비디아가 강력한 오픈소스 모델을 확산시키면 빅테크에 집중됐던 AI 컴퓨팅 수요를 수많은 기업과 개발자, 정부기관으로 분산시키면서 자사 GPU의 고객 기반을 더욱 넓힐 수 있다.

엔비디아의 최대 고객 중 하나인 오픈AI와 경쟁할 가능성이 있다는 점은 역설적이다. 엔비디아는 오픈AI에 300억달러를 투자한 상태다.

리플렉션AI·커서·씽킹머신스랩·미스트랄·프라임인텔렉트·코그니션 등 AI 기업들과도 협력하고 있다. 이들이 참여하는 '네모트론 연합'을 통해 학습 데이터와 아이디어를 제공받고 있다.

중국 오픈소스 AI의 빠른 성장 역시 엔비디아가 모델 개발에 속도를 내는 배경이다. 딥시크와 알리바바의 큐원 등 중국 모델이 거대 모델 경쟁에서 미국을 빠르게 추격하면서 미국 내에서는 오픈소스 AI 주도권을 중국에 내줄 수 있다는 위기감이 커지고 있다.

젠슨 황 엔비디아 최고경영자(CEO)가 오픈 AI 모델을 적극 옹호해온 것도 같은 맥락이다.

황 CEO는 오픈 모델이 안전과 사이버보안, 과학적 진보, 국가안보를 증진할 수 있다는 입장을 강조해왔다. 세계 최고 수준의 미국산 오픈 모델을 엔비디아가 주도한다면 기술 경쟁력뿐 아니라 미국의 AI·안보 주도권을 지키는 대표 기업이라는 효과도 얻을 수 있다.

결국 네모트론4 개발은 엔비디아가 GPU라는 하드웨어에만 머물지 않겠다는 신호로 볼 수 있다. 엔비디아는 GPU 위에서 작동하는 소프트웨어 플랫폼 쿠다(CUDA)와 AI 개발 프레임워크 니모(NeMo)를 이미 구축했다. 여기에 세계적 수준의 오픈 AI 모델까지 확보하면 GPU→쿠다→니모→AI 모델로 이어지는 풀스택 생태계가 완성된다.

이는 AI 모델을 무료 또는 개방형으로 확산시키면서 그 모델을 학습·추론·실행하는 데 필요한 컴퓨팅과 소프트웨어 영역에서 엔비디아의 영향력을 더욱 키우는 전략이다. AI 모델이 어느 기업의 것이든 결국 엔비디아의 GPU에서 돌아가게 만드는 '생태계 락인' 효과를 노리는 셈이다.

다만 엔비디아가 막대한 자금을 투입해 오픈소스 AI 시장까지 직접 장악하려는 전략이 언제까지 지속될 수 있을지는 미지수다. 회계연도 기준 엔비디아의 클라우드 서비스 약정 규모는 70억달러로 오픈AI나 앤스로픽의 지출에는 미치지 못한다. 그럼에도 엔비디아가 미국과 중국을 통틀어 상당수 오픈소스 AI 개발사보다 많은 자원을 투입하고 있다는 점은 AI 경쟁의 중심축이 '좋은 모델'에서 모델·컴퓨팅·칩·소프트웨어를 모두 장악하는 생태계 경쟁으로 이동하고 있음을 보여준다.

이규화 대기자 david@dt.co.kr



[저작권자 ⓒ디지털타임스, 무단 전재-재배포, AI 학습 및 활용 금지]
이규화

기사 추천

  • 추천해요 0
  • 좋아요 0
  • 감동이에요 0
  • 화나요 0
  • 슬퍼요 0