Posted
Filed under 매일테크

안녕하세요! 오늘은 AI 기술 트렌드 중에서 정말 반가운 소식을 하나 들고 왔어요. 최근 AI 모델들이 텍스트를 넘어 이미지나 영상까지 이해하는 '멀티모달' 기능으로 진화하면서, 그만큼 모델의 크기도 엄청나게 커지고 있잖아요? 이 때문에 고사양 하드웨어가 필수라는 인식이 강했는데, 이를 해결해 줄 아주 흥미로운 연구 결과가 나왔습니다.

멀티모달 AI를 가볍게 만드는 '전문가 프루닝' 기술

이번에 세계적인 AI 학술대회인 'NeurIPS 2026'에서 주목받은 기술은 바로 노타의 '모달리티 인지 전문가 프루닝' 연구예요. 쉽게 설명하자면, AI 모델 안에는 다양한 정보를 처리하는 '전문가 모듈'들이 있는데, 이 중에서 성능에 큰 지장을 주지 않는 모듈을 똑똑하게 골라내어 제거하는 기술이죠. 특히 언어와 이미지 이해 능력을 모두 고려하며 최적화했기 때문에 효율이 엄청나요.

실제로 테스트 결과를 보니, 약 310억 파라미터 규모의 모델에서 전문가 모듈을 50%나 제거했음에도 원본 성능의 91%를 유지했다고 해요. 더 놀라운 건 GPU 메모리 사용량이 58GB에서 31GB로 약 47%나 줄어들었다는 점입니다. 덕분에 40GB 메모리를 가진 GPU 한 장만으로도 모델을 구동할 수 있는 수준이 되었어요.

앞으로의 변화가 기대되는 이유

개인적으로 이번 소식을 보며 가장 인상 깊었던 점은, 하드웨어의 한계를 소프트웨어 기술로 극복했다는 점이에요. 최신 AI 모델을 쓰기 위해 무조건 비싼 GPU를 추가로 구매하는 대신, 기존의 AI 인프라를 훨씬 효율적으로 활용할 수 있게 되었으니까요. 이는 기업 입장에서 비용 절감은 물론, 남는 자원을 다른 서비스에 배분할 수 있는 엄청난 이점이 될 것 같아요.

앞으로 멀티모달 AI 시장이 더 커질 텐데, 이러한 최적화 기술이 자사의 플랫폼인 '넷츠프레소'를 통해 어떻게 더 발전해 나갈지 정말 기대됩니다. 기술이 더 가벼워지고 똑똑해지는 만큼, 우리 일상 속 AI 활용 범위도 훨씬 넓어질 것 같네요!

본 포스팅은 매일테크에서 발행되었습니다.

2026/10/01 12:14 2026/10/01 12:14