AI Expert실은 자사 AI 플랫폼인 Helpnow AI Foundry를 기반으로 기술 구현부터 고객사 온프레미스·클라우드 환경 구축, AI Agent 적용까지 전 과정을 주도하는 핵심 서비스 팀이에요. 금융·공공 등 다양한 산업군 고객의 최전선에서 AI Transformation(AX)을 신속하게 이끌어내며, 업계 최고 수준의 AI 인프라 및 플랫폼 기술력을 함께 쌓아가고 있어요.
vLLM 기반 추론 서버 구축과 성능 튜닝(TP/DP, KV Cache 등) 및 최신 GPU 인프라(H100/H200/B200) 환경을 직접 다루며 기술적 깊이를 더할 수 있어요.
- 엔터프라이즈급 대규모 온프레미스 & K8s 멀티 클라우드 구축 리딩
금융권 망분리(에어갭) 환경부터 AWS 클라우드까지 다양한 복합 인프라 아키텍처를 직접 설계하고, Kubernetes 기반 플랫폼 클러스터 구축을 주도해 볼 수 있어요.
- 초고속 성장하는 AI Agent & RAGOps 생태계 선도
자사 AI 플랫폼을 통해 실제 고도화된 RAG 파이프라인과 Vector DB(Milvus)를 운용하며, AI 엔지니어링의 처음과 끝을 모두 경험할 수 있어요.
LLM/SLM 서빙 & 튜닝
vLLM 기반 추론 서버 구축·운영 및 성능 튜닝(TP/DP, KV cache, quantization, prefix caching)
고객 워크로드에 최적화된 SLM 모델 선정 및 최적화
HelpNow AI Foundry 구축·설치
K8s(kubeadm/RKE2/EKS) 기반 플랫폼 클러스터 설계·구축
고객사 온프레미스/클라우드 환경 배포 및 HA(고가용성) 구성
RAGOps 파이프라인 운영
문서 수집·파싱·청킹·임베딩·벡터검색 파이프라인 운영 및 성능 개선
Vector DB(Milvus) 관리 및 최적화
온프레미스 & 클라우드 인프라 운용
금융권 망분리 에어갭(Air-gapped) 환경 설치 수행
AWS 기반 인프라 설계·운영, 레지스트리(Harbor) 및 배포 자동화(ArgoCD) 구축
아키텍처 설계 & 기술 리딩
인프라 아키텍처 의사결정 주도 및 기술 표준 수립
주니어 엔지니어 멘토링 수행
[ 필수 자격 ]
관련 분야(백엔드/인프라/SRE/MLOps 등) 7년 이상의 실무 경력이 있으신 분
Kubernetes 프로덕션 환경 구축 및 운영 경험(설계 및 트러블슈팅 포함)이 있으신 분
SLM/LLM 모델에 대한 전반적인 이해(아키텍처, 파라미터 규모별 특성, 서빙 요구사항 등)가 깊으신 분
Docker 컨테이너 및 CI/CD 파이프라인 구축 실무 경험이 있으신 분
Linux 시스템 및 네트워크 구조에 대한 깊은 이해도를 갖추신 분
Python을 활용한 실무 개발 역량을 보유하신 분
AWS 클라우드 서비스에 대한 이해 및 실무 경험이 있으신 분
[ 우대 사항 ]
vLLM, SGLang 등 LLM 추론 엔진 튜닝 및 최적화 경험이 있으신 분
GPU 인프라(H100/H200/B200) 및 CUDA 스택에 대한 이해가 높으신 분
온프레미스 구축 및 금융권 망분리 프로젝트 경험이 있으신 분
RAG 및 Vector DB(Milvus, Qdrant 등) 운영 경험이 있으신 분
Terraform/IaC 및 모니터링(Prometheus/Grafana) 운영 경험을 보유하신 분
AWS/GCP/Azure 관련 클라우드 자격증을 보유하신 분
서류전형 → 인터뷰 → 처우 협의 → 최종 합격 → 채용검진 → 입사
※ 통상 인터뷰는 1회 진행하고 있으나, 경우에 따라 추가될 수 있습니다.
※ Reference Check의 경우 필요 시, 후보자 동의하에 진행될 수 있습니다.
👉 베스핀글로벌 홈페이지 바로가기 👈