14.2. VDI에서 Pod(JupyterHub) 접근하기
연구환경의 데이터 분석은 VDI에서 웹브라우저를 이용해 Pod의 Jupyter Hub로 접속한 후 Notebook 또는 terminal을 통해 수행할 수 있습니다. 본 장에서는 VDI부터 Jupyter Hub까지 접속 방법을 설명합니다.
14.2.1 시스템 구성 한눈에 보기
연구자는 연구환경에서 로컬PC 역할을 대신하는 VDI에서 실제 분석을 수행하는 서버 역할을 하는 Pod(JupyterHub) 에 접근하여 작업 거점으로 사용하며, Pod에서 같은 네트워크 안의 Slurm, Spark 클러스터에 접근합니다. 세 시스템에는 동일한 공유 스토리지가 마운트되어 있어, 데이터·스크립트·결과물을 별도 복사 없이 공유합니다.
핵심 포인트
- Slurm과 Spark는 서로 독립된 별도 클러스터입니다. Spark는 Slurm 위에서 기동되지 않으며, 각각 직접 접근합니다.
- Slurm과 Spark는 사용자 포털에서 과제 신청시 추가로 신청하고 승인된 경우에만 제공됩니다.
- Spark는 Hail 전용입니다. 일반 Spark 배치 용도로 사용하지 않습니다.
- 세 시스템이 같은 스토리지를 공유하므로, 경로만 맞추면 어디서 만든 파일이든 다른 시스템에서 그대로 접근할 수 있습니다.
14.2.2 Pod(JupyterHub) 접근하기
VDI를 접속하면 Ubuntu 기반의 데스크톱 환경(GNOME)이 나타납니다.
📸 화면
<VDI 데이크톱 바탕화면 웹브라우저(파이어폭스) 위치>
좌측 상단의 웹브라우저(파이어폭스) 아이콘을 클릭하면 웹 브라우저가 실행 됩니다. 웹브라우저 상단의 주소 입력창에 연구포털 접근 URL을 입력합니다.
- 연구포털 URL : rms.biobigdata.kr
📸 화면
<파이어폭스의 주소 입력창에 연구포털 URL 입력>
연구포털은 사용자 포털과 동일한 계정을 사용합니다. 본인의 계정을 입력하여 로그인을 합니다.
📸 화면
<연구포털 로그인 화면>
로그인 후 My Page의 Project Information에서 Project ID를 확인한 후, 상단 메뉴의 RESEARCH INFRA의 RESEARCH INFRA 메뉴를 선택합니다.
📸 화면
<연구포털 My Page 화면>
RESEARCH INFRA 메뉴에서 할당 받은 연구 자원 목록이 나타납니다. 할당 받은 Virtual computing Enviroment(VCE) 내역 우측의 Application 항목(Jupyter 아이콘)을 클릭합니다.
📸 화면
<RESEARCH INFRA - VCE 목록 화면>
Jupyterhub 로그인 화면에서 지정된 계정을 입력합니다. ID는 본인의 포털 사이트 ID와 My Page에서 확인한 Project ID를 조합하여 결정되며, Password는 본인의 포털 사이트 ID에 특정 문자열이 조합되어 결정됩니다.
- ID
- 규칙 : [본인의 포털 사이트 ID] + _ + [Project ID(소문자와 숫자 조합)]
- 예시
- 본인의 포털 사이트 ID : gdhong
- Project ID : R202606050470
- Jupyterhub ID : gdhong_r202606050470
- Password
- 규칙 : [본인의 포털 사이트 ID] + "1234!"
- 예시
- 본인의 포털 사이트 ID : gdhong
- Jupyterhub Password : gdhong1234!
📸 화면
<Jupyterhub 로그인 화면>
로그인이 완료되면 Notebook, Condole, 기타(Terminal, 텍스트 에디터 외) 등을 실행할 수 있는 Launcher 화면이 나타나며 필요한 도구를 실행하여 사용합니다.
📸 화면
<Jupyterhub Launcher 화면>