AI 서비스 및 데이터 분석 서비스 구축
| 서버 종류 | 구성 방안 | 비고 |
|---|---|---|
| A 서버 | AI WebUI + Ollama | AI 서비스 (일반 모델 Load : Gpt-Oss 등) / MedGemma (의료 분야 구축 모델) |
| B 서버 | JupyterHub | 데이터 분석 서비스 |
| C 서버 | AI WebUI + Ollama | AI 서비스 (개발 모델 Load : devstral-2, llama4, Gemma4 등 멀티모달 포함) |
모든 서버는 Ubuntu 22.04 LTS 이상 운영체제를 기반으로 하며, 하드웨어 제어를 위해 NVIDIA Driver와 CUDA Toolkit이 설치됩니다. 그 위에 NVIDIA Container Toolkit을 배치하여 Docker 컨테이너가 GPU 하드웨어에 직접 접근하는 파이프라인을 구성합니다.
A·C 서버 : Ollama + AI WebUI / B 서버 : JupyterHub
Docker 컨테이너가 GPU 하드웨어에 직접 접근하도록 연결
H200의 기능을 온전히 활용하기 위한 커널 레벨 드라이버
AI 프레임워크와의 호환성이 가장 높은 운영체제
models: - name: Devstral-2 apiBase: http://<C_Server_IP>:11434 provider: ollama
curl http://localhost:11434/api/chat -d '{ "model": "exaone3.5:7.8b", "messages": [{"role":"user", "content":"코드 리뷰해줘"}], "stream": false }'
curl http://localhost:11434/api/generate -d '{ "prompt": "Python DataFrame 예제", "model": "devstral-2:123b" }' Response: 'response','done', 'eval_duration'
Ryzen 9 · DDR5 64GB · RTX 5090 32GB
JupyterHub · Python/R · LLM WebUI · Local LLM
USB 제어 · 포트락 · 캡처방지 · 복원
| 구분 | 구성 방안 | 비고 |
|---|---|---|
| AI 서비스 | AI WebUI + Ollama | AI 서비스 (일반 모델 Load : medgemma 등) |
| 데이터 분석 | JupyterHub | 데이터 분석 서비스 (JupyterHub – NVIDIA NGC Container 기반) |