AI 컴퓨팅 인프라
첨단융합학부는 생성형 AI와 차세대 인공지능 연구를 지원하기 위해 총 40대의 GPU(H100 20대, H200 8대, RTX PRO 6000 12대)를 갖춘 공용 AI 컴퓨팅 인프라를 구축하였습니다.
구축된 시스템은 약 3.2TB의 GPU 메모리(VRAM)와 약 7.4TB의 DDR5 ECC 시스템 메모리, 고성능 Intel Xeon 및 AMD EPYC 프로세서를 기반으로 대규모 언어모델(LLM), 멀티모달 AI, 컴퓨터 비전, 의료 AI, 반도체 AI 등 다양한 연구를 수행할 수 있는 환경을 제공합니다.
또한 15개 서버 랙과 400kW 규모의 전력 공급 설비, 항온항습 및 냉방 시스템을 갖춘 전용 서버실을 구축하여 고성능 GPU를 안정적으로 운영할 수 있는 기반을 마련하였습니다.
특히 쿠버네티스(Kubernetes) 기반의 GPU 관리 플랫폼을 첨단융합학부 소속 교수와 학생들이 직접 설계·개발하여 구축하였습니다. 사용자는 웹 기반 환경에서 GPU 자원을 효율적으로 활용할 수 있으며, 학부 자체 기술 역량을 바탕으로 지속적인 기능 개선과 운영이 이루어질 예정입니다.
첨단융합학부는 총 10대의 노드를 아래와 같이 보유하고 있습니다
H100 94GB NVL
노드 타입 1번
Dual Intel® Xeon® 6515P 프로세서와 1TB DDR5 ECC 메모리, NVIDIA H100 NVL 94GB GPU 4기를 탑재한 AI 서버입니다.
총 376GB의 GPU 메모리(VRAM)와 약 39TB의 저장공간을 제공하여 대규모 AI 모델 학습, 데이터 분석 및 고성능 컴퓨팅 연구에 활용됩니다.
H100 서버 (총 5대)
H200 141GB NVL
노드 타입 2번
Dual Intel® Xeon® 6515P 프로세서와 1TB DDR5 ECC 메모리, NVIDIA H200 NVL 141GB GPU 4기를 탑재한 AI 서버입니다.
총 564GB의 GPU 메모리(VRAM)와 약 39TB의 저장공간을 갖추고 있으며, 초거대 AI 모델 학습·추론 및 메모리 집약적인 연구를 지원합니다.
H200 서버 (총 2대)
PRO 6000 96GB SE
노드 타입 3번
AMD EPYC™ 5세대 128코어 프로세서와 NVIDIA RTX PRO 6000 Server Edition 96GB GPU 4기를 탑재한 고성능 GPU 서버입니다.
총 384GB의 GPU 메모리(VRAM)와 PCIe Gen5 NVMe SSD를 기반으로 AI 연구는 물론 그래픽, 시뮬레이션, 반도체 설계 등 GPU 가속이 필요한 다양한 연구 분야에 활용됩니다.
