捤獥 汤捯 구 매 규 격 서
(Commodity Description)
氠瑢
물품분류번호
(Korean Government Commodity Classification Code)
품명 및 규격
(Description)
수량
(Quantity)
단위
(Unit)
4321150102
HPC 클러스터 확장용 GPU 노드
1
Set
I. 용도(End-user's Use)
- 화합물질의 복잡한 반응 경로를 예측하는 AI/머신러닝 모델, 특히 심층 학습 모델의 개발과 학습 과정은 막대한 병렬 연산 수행에 활용
- 대규모 연산을 가속화하여, 방대한 화학 데이터로부터 반응 특성을 효율적으로 학습하고 예측 모델의 정확성과 신뢰도를 높이는 데결정적인 역할 수행
- 신속하고 정확한 반응 예측 기술을 확보하고, 이를 기반으로 하는 통합 플랫폼의 핵심 기능을 구현하는 데 사용
II. 장비의 구성(Configurations of Goods)
※ 아래 제시한 규격의 동등 제품 이상으로 납품 허용(동등 이상 제품 여부에 대해서는 발주기관이 계약의 목적, 특성, 대체물품의 성능 등을 종합적으로 고려하여 판단)
1. 주장비(Main body): Intel 6세대 기반 5U 8 GPU 혹은 10 GPU 서버
2. 부속장비(accessories) ࠘ Ā ྠ Ā
- Barebone: AI/HPC용 랙마운트 GPU 서버 플랫폼, 듀얼 CPU 지원, 더블와이드 GPU 4EA 이상 장착 가능, 엔터프라이즈급 전원·냉각 구조, NVMe 스토리지 확장 지원, 원격 관리 기능 지원의 성능 또는 그 이상
- CPU: 86서버용 6세대 2.70GHz, 72Cores, 432MB Cache * 2EA 이상
- MEMORY: 64GB 6400MHz DDR5 ECC/RDIMM * 4EA 이상
- 저장장치: 960GB NVMe M.2 또는 U.2 PCIe4 x4 * 1EA 이상
7.68TB NVMe PCIe4x4 U.2 PCIe4 x4 * 1EA 이상
- GPU: Blackwell 아키텍쳐 기본 96GB ECC GDDR7 Server Edition Double-Width * 4EA 이상
- 서버 원격 매니지먼트 툴
III. 성능 및 규격(Performance & Specification)
※ 아래 제시한 규격의 동등 제품 이상으로 납품 허용(동등 이상 제품 여부에 대해서는 발주기관이 계약의 목적, 특성, 대체물품의 성능 등을 종합적으로 고려하여 판단)
1. 듀얼소켓 6세대 인텔 제온 프로세서 P-Cores, 500W TDP 지원
2. 24DIMM 슬롯
- Up to (1DPC) 6TB 지원 6400MT/s ECC DDR5 RDIMM
- Up to (1DPC) 6TB 지원 8800MT/s ECC DDR5 MRDIMM
3. 드라이브베이
- 24x 2.5“ 전면 핫-스왑 NVMe 지원이나 동등 이상
- 2x M.2 NVMe Slot (M-Key) 지원이나 동등 이상
4. 확장슬롯
13x PCIe 5.0 x16 FHFL 슬롯, 2 M.2 PCIe 5.0 x4 NVMe 슬롯 (B+M-Key)
5. 파워서플라이
6x 2700W 티타늄레벨 (96%) 전원 이중화 (4+2 동작)
6. 2 RJ45 10GbE with Intel X710-AT2
7. GPU 지원 8개의 Double-Width, full length GPUs 또는 10개의 Single-width GPUs
8. CPU-GPU 인터커넥트 : PCIe 5.0 x16 Switch Dual-Root
9. GPU-GPU 인터커넥트 : Nvidia NVLink Bridge (옵션)
10. 8개의 핫-스왑 11.5K RPM 냉각팬
11. 2000W (2+2) 티타늄레벨 (96%+) 이중화 파워서플라이
Ⅳ. 기타 조건(Remarks)
1. 납기조건: 계약상대자는 제조사 또는 기술지원사와 정품공급 및 기술지원 확약서를 체결하여 계약 후 10일 이내에 수요기관에 제출하여야 한다.
2. 하자보증보건: 장비의 보증기간은 2년으로 한다.
3. 설치조건: 수요부서에서 지정한 장소에 장비를 설치하고 기본 작동 확인(시운전)을 수행하여야 하며, 현장의 전력상황을 고려하여 설치작업을 진행한다.
4. 기타조건: 규격서상 기술지원 요건 충족
ㅇ 기술지원
- 기존 클러스터 시스템과 연동 및 증설이 주목적이므로 납품 전 현장실사를 하지 않아 발생하는 문제의 책임은 계약업체에 있다.
- GPU의 경우 기존시스템과 완벽하게 호환이 되어야한다.
- 모든 제품은 제조사 정품이어야하며, 동급 이상으로 납품되어야 한다.
- 기존에 운영중인 Job Manager 및 사용자관리 환경등을 확인하고 동일한 환경에서 운영할 수 있도록 기술지원이 되어야 한다.
- 기존에 운용중인 Job Manager 스크립트의 변경을 지원해 주어야 하며, Queue의 분할 등 설정변경이 필요할 경우 지원해 주어야 한다.
- 연구에 필요한 S/W, 라이브러리등의 업데이트 및 보유중인 하드웨어의 추가 및 기존에 운용중인 GPU클러스터의 하드웨어 재구성을 요청할 경우 언제든지 지원해야 한다.
- 전력, 상면 및 이기종 GPU 클러스터의 통합등의 이유로 서버의 이전이 필요한 경우 지원하여야 하며 전력, 네트워크 등은 현장실사를 통하여 담당자와 확인해야 한다. 현장실사를 하지 않아 발생한 모든 문제는 계약업체에서 책임을 진다.
- 설치 중 기존 클러스터에 문제가 발생했을 경우, 복구를 책임져야 하며, 이로 인한 연구지연에 대한 모든 책임은 계약업체에 있다.
- 보증기간 중에는 위 조건이 언제라도 유지되어야 한다.