모델 파인튜닝, 추론 서버, 워크플로 자동화 — gcube 위에서 직접 돌려보고 남긴 GPU 클라우드 실습 기록입니다. 벤치마크와 코드는 전부 재현 가능합니다.
gcube 공식 문서를 BGE-M3로 임베딩하고 Chroma에 인덱싱해, vLLM으로 서빙한 Qwen2.5-7B와 연결했습니다. RTX 5090 한 장, 외부 API 없이 전 과정을 노트북에서 재현합니다.
gcube RTX 5090에서 Tri-7B sLLM을 자체 호스팅하고 vLLM + n8n으로 회의록 → 액션아이템 자동화 파이프라인을 구축합니다. Jupyter 노트북 기반 실습, 파인튜닝까지 포함.
gcube 서버에 n8n을 올려 PDF 요약, AI 뉴스 브리핑, 회의록 자동화 등 직장인의 반복 업무를 자동화하는 워크플로우 3가지를 단계별로 구성합니다.
외부 AI API 소비를 넘어 Private AI Runtime 운영으로. 5대 병목과 7-Layer 스택으로 기업 AI 실행권을 되찾는 방법.
gcube의 RTX 5090 환경에서 Unsloth로 Llama 3.1 8B를 한국어 데이터셋으로 파인튜닝한 실습 기록.