makerskorean logo
makerskorean.net
15-NODE HYPER-CONVERGED HOMELAB & EDGE AI CLUSTER

인프라 아키텍처 & 기술 블로그

상용 클라우드 벤더 락인과 비용을 탈피하여, 15대 베어본 PC 분산 클러스터 및 온프레미스 GPU 환경에서 직접 구축하고 실측 검증한 로컬 LLM, RAG 최적화, Kubernetes, B2B TCO 절감 실전 엔지니어링 기록입니다.

검증 클러스터 15대 Barebone
운영 체제 / 가상화 Proxmox VE 8.4
온프레미스 엔진 Ollama + pgvector
기술 아티클 95편 실측 검증
[RAG 고도화] 로컬 RAG 시스템 구축 가이드
로컬 RAG & 벡터DB #286
실측 검증

[RAG 고도화] 로컬 RAG 시스템 구축 가이드

매달 청구되는 클라우드 구독료를 내고 나면 사실 우리 데이터가 어디로 흘러가는지 불안해질 때가 있죠. 저는 ‘클라우드 비용 0원’이라는 철학으로, 오직 내 서버 안에서 모든 데이터를 통제하는 온프레미스 AI 시스템을 구축하고 있습니다…

[오픈소스 LLM] LLM 파이프라인 서버 구축법
AI 에이전트 & 자동화 #277
실측 검증

[오픈소스 LLM] LLM 파이프라인 서버 구축법

매달 청구되는 클라우드 비용을 지불하는 대신, 내 컴퓨터의 GPU를 활용해 AI 엔진을 돌리는 방법이 궁금하지 않으신가요? 저는 ‘RHAIA200’이라는 온프레미스 AI 발행 팩토리를 직접 운영하며 클라우드 없이 스스로 시스템을 구축…

[콘텐츠 자동화] AI 자동화와 HIT1 철학
AI 에이전트 & 자동화 #268
실측 검증

[콘텐츠 자동화] AI 자동화와 HIT1 철학

매달 날아오는 클라우드 과금 고지서를 보며 한 번쯤 고민해 보셨나요? 저는 ‘클라우드 비용 0원’을 목표로 내 서버에서 모든 것을 해결하는 온프레미스 AI 시스템을 구축했습니다.…

[벡터 DB] AI 벡터 DB & 임베딩 최적화 가이드
로컬 RAG & 벡터DB #265
실측 검증

[벡터 DB] AI 벡터 DB & 임베딩 최적화 가이드

매달 청구되는 클라우드 비용이 부담스러운 분들이라면, ‘내 서버’를 활용한 온프레미스 AI 구축이 정답입니다. 저는 RHAIA200을 직접 운영하며 클라우드 없이 로컬 환경에서 조사부터 발행까지 자동화하는 시스템을 구축하고 있습니다.…

[지능형 에이전트] AI 에이전트 & DB 연동 가이드
AI 에이전트 & 자동화 #262
실측 검증

[지능형 에이전트] AI 에이전트 & DB 연동 가이드

매달 lcloud 비용을 지불하며 API 호출를 기다리는 대신, 내 방의 서버에서 돌아가는 AI 에이전트의 매력을 느껴보신 적 있나요? 이번 포스트에서는 클라우드 과금 부담 없이 온프레미스 AI 시스템을 구축하는 실전 가이드를 준비했…

[RAG 구축] RAG 성능 측정 및 병목 해결법
로컬 RAG & 벡터DB #253
실측 검증

[RAG 구축] RAG 성능 측정 및 병목 해결법

클라우드 구독료를 매달 지불하며 AI 성능을 테스트하는 것보다, 내 서버에서 직접 데이터를 돌리는 게 훨씬 짜릿하지 않나요? 저는 ‘RHAIA200’이라는 온프레미스 AI 발행 팩토리를 운영하면서 항상 “내 컴퓨터 안의 AI”라는 철…

[RAG 고도화] Llama-3 RAG 시스템 구축 가이드
로컬 RAG & 벡터DB #244
실측 검증

[RAG 고도화] Llama-3 RAG 시스템 구축 가이드

매달 지불하는 클라우드 구독료와 API 비용을 아끼기 위해 우리만의 ‘온프레미스’ 시스템을 구축해본 경험이 있으신가요? 저는 매번 과금 부담을 고민하며 내 서버에 Llama-3 모델을 올리고, 나만의 데이터로 RAG(검색 증강 생성)…

[GPU 클러스터] GPU 활용 로컬 LLM 자동화 구축 가이드
GPU & 하드웨어 가속 #238
실측 검증

[GPU 클러스터] GPU 활용 로컬 LLM 자동화 구축 가이드

매달 날아오는 클라우드 구독료를 확인하며 한숨 쉬던 시절을 지나, 이제는 내 서버실의 GPU가 스스로 돌아가는 시대입니다. ‘클라우드 비용 0원’이라는 목표를 위해 온프레미스 AI 환경을 구축하는 것은 단순한 취미를 넘어, 기술적 자…

[RAG 구축] Llama-3 & RAG 구축 가이드 도전
로컬 RAG & 벡터DB #232
실측 검증

[RAG 구축] Llama-3 & RAG 구축 가이드 도전

매번 클라우드 API 호출 비용을 계산하며 한숨 쉬는 대신, 이제는 내 컴퓨터의 자원을 100% 활용하는 시대를 만들어보세요. ‘클라우드 비용 0원’이라는 목표를 실현하기 위해 Llama-3 모델을 로컬에 구축하고 RAG 시스템을 연…

[LLM 서빙] LLM 자동화 파이프라인 구축법
AI 에이전트 & 자동화 #226
실측 검증

[LLM 서빙] LLM 자동화 파이프라인 구축법

매달 나가는 클라우드 구독료와 API 비용을 아끼기 위해 고민해본 경험이 있다면, 결국 답은 ‘내 서버’에 있습니다. 제가 구축한 RHAIA200 시스템의 핵심은 클라우드 의존성을 완전히 걷어내고, 온프레미스 환경에서 LLM 파이프라…

[GPU 가속] GPU 기반 AI 에이전트 파이프라인 구축
GPU & 하드웨어 가속 #214
실측 검증

[GPU 가속] GPU 기반 AI 에이전트 파이프라인 구축

매달 날아오는 클라우드 구독료 고지서를 보며 한숨 쉬어본 경험이 있다면, 이제는 ‘내 서버’로 눈을 돌릴 때입니다. 클라우드 비용 0원으로 목표를 달성하는 핵심은 바로 온프레미스 GPU 가속기를 활용한 로컬 LLM 환경 구축에 있습니…

[RAG 파이프라인] GPU로 구축하는 로컬 LLM 데이터베이스 연동 및 RAG 시스템 구축 가이드
로컬 RAG & 벡터DB #186
실측 검증

[RAG 파이프라인] GPU로 구축하는 로컬 LLM 데이터베이스 연동 및 RAG 시스템 구축 가이드

매달 눈덩이처럼 불어나는 클라우드 LLM API 호출 요금과 벡터 데이터베이스 구독료는 엔지니어와 개발팀 모두에게 큰 부담입니다. 특히 외부 클라우드로 사내 문서나 민감한 개인 지식베이스를 전송해야 하는 프라이버시 이슈는 해결하기 어…

[GPU 가속] GPU 기반 AI 자동화 파이프라인 구축
GPU & 하드웨어 가속 #175
실측 검증

[GPU 가속] GPU 기반 AI 자동화 파이프라인 구축

매달 청구되는 클라우드 과금성이나 API 호출 비용 때문에 AI 실험을 망설이고 계신가요? 저는 ‘클라우드 비용 0원’이라는 목표 아래, 내 컴퓨터의 GPU 가속기를 활용해 온프레미스 AI 자동화 파이프라인을 구축했습니다.…

[GPU 클러스터] GPU 기반 로컬 LLM 배포 전략
GPU & 하드웨어 가속 #172
실측 검증

[GPU 클러스터] GPU 기반 로컬 LLM 배포 전략

매달 불어나가는 클라우드 구독료를 내고 계신가요? 이제는 ‘클라우드 과금 0원’의 시대입니다. 저는 직접 운영하는 온프레미스 AI 발행 팩토리, RHAIA200을 통해 로컬 LLM 배포 전략을 구축하고 있습니다.…

[하드웨어 튜닝] GPU로 구축하는 LLM 자동화 가이드
GPU & 하드웨어 가속 #165
실측 검증

[하드웨어 튜닝] GPU로 구축하는 LLM 자동화 가이드

매달 청구되는 클라우드 비용을 지불하는 대신, 내 방 한구석에 위치한 서버로 AI의 성능을 끌어올리는 방법이 궁금하지 않으신가요? ‘클라우드 비용 0원’은 단순히 돈을 아끼는 문제가 아니라, 데이터 주권과 시스템 통제권을 온프레미스 …

[RAG 구축] GPU 활용 로컬 LLM & RAG 통합 가이드
로컬 RAG & 벡터DB #162
실측 검증

[RAG 구축] GPU 활용 로컬 LLM & RAG 통합 가이드

매번 매달 수십만 원씩 빠져나가는 클라우드 구독료를 보면서 “내 서버에 직접 AI를 올릴 순 없을까?” 고민해본 적 없으신가요? 클라우드 비용은 0원으로 줄이고, 내 하드웨어의 성능을 100% 활용하는 온프레미스 AI의 매력은 정말 …

[벡터 검색] GPU 기반 RAG 시스템 최적화 가이드
로컬 RAG & 벡터DB #153
실측 검증

[벡터 검색] GPU 기반 RAG 시스템 최적화 가이드

매달 l로 빠져나가는 클라우드 구독료 대신, 내 서버의 GPU를 100% 활용하는 방법에 대해 고민해본 적 있으신가요? ‘클라우드 비용 0원’이라는 목표는 단순히 절약이 아니라 데이터 프라이버시를 확보하고 우리만의 데이터를 온프레미스…

[지식 베이스 RAG] GPU 기반 RAG 고도화 전략
로컬 RAG & 벡터DB #123
실측 검증

[지식 베이스 RAG] GPU 기반 RAG 고도화 전략

클라우드 서비스 비용이 매달 고정적으로 빠져나가는 구조라면, 우리 데이터는 언제까지 안전할 수 있을까요? 저는 ‘클라우드 비용 0원’이라는 목표를 위해 내 서버에 직접 GPU를 박고 온프레미스 AI 시스템을 구축했습니다.…

[VRAM 최적화] GPU 활용 AI 자동화 파이프라인 구축
GPU & 하드웨어 가속 #114
실측 검증

[VRAM 최적화] GPU 활용 AI 자동화 파이프라인 구축

매달 청구되는 클라우드 과금 비용을 보면서 “내 서버에서 직접 돌릴 순 없을까?” 고민해본 분들이라면 주목해 주세요. 저는 이번에 RHAIA200이라는 온프레미스 AI 발행 팩토리를 구축하며, 클라우드 대신 내 컴퓨터의 GPU 가속기…

[로컬 LLM] LLM 기술 블로그 자동화 구축 가이드
AI 에이전트 & 자동화 #99
실측 검증

[로컬 LLM] LLM 기술 블로그 자동화 구축 가이드

매달 청구되는 클라우드 과금 비용을 내고 계신가요? 저는 ‘클라우드 비용 0원’이라는 철학으로 제 홈랩 시스템을 구축했습니다. 단순히 로컬 LLM을 돌리는 것에 그치지 않고, 조사부터 기획, 작성, 그리고 발행까지 전 과정을 온프레미…

[RAG 구축] RAG & LLM 기반 자동 포스팅 구축
로컬 RAG & 벡터DB #93
실측 검증

[RAG 구축] RAG & LLM 기반 자동 포스팅 구축

매달 청구되는 클라우드 구독료를 내고 계신가요? 저는 ‘내 컴퓨터 안의 AI’라는 철학으로 비용을 0원으로 줄이고 싶어 하는 홈랩 엔지니어입니다. 이번에 제가 구축한 시스템은 온프레미스 RAG와 LLM 로컬 실행을 기반으로 한 완전 …

[벡터 검색] RAG DB 최적화 & 벡터 DB 선택 가이드
로컬 RAG & 벡터DB #52
실측 검증

[벡터 검색] RAG DB 최적화 & 벡터 DB 선택 가이드

매달 lllm API 호출 비용을 지불하는 대신, 내 서버에 직접 구축하는 ‘온프레미스 AI’의 매력을 아시나요? 클라우드 구독료를 0원으로 줄이면서도 강력한 성능을 유지하려면 핵심은 효율적인 RAG 데이터베이스 설계와 벡터 DB 선…

[RAG 파이프라인] 클라우드 대신 내 서버로: 온프레미스 RAG 시스템 성능 및 비용 절감 전략
로컬 RAG & 벡터DB #49
실측 검증

[RAG 파이프라인] 클라우드 대신 내 서버로: 온프레미스 RAG 시스템 성능 및 비용 절감 전략

매달 청구되는 클라우드 비용을 보며 한숨 쉬던 시절이 있다면, 이제는 내 서버로 눈을 돌려야 할 때입니다. ‘클라우드 대신 내 서버’라는 철학은 단순히 비용 절약에 그치지 않고, 데이터 프라이버시를 완벽하게 통제하며 나만의 AI 실험…

[RAG 구축] LLM RAG 시스템 구축 가이드
로컬 RAG & 벡터DB #46
실측 검증

[RAG 구축] LLM RAG 시스템 구축 가이드

매달 lcloud 구독료를 내는 대신, 우리 집 서버의 GPU 성능을 100% 활용해 보세요! 많은 분이 AI 서비스 비용 때문에 망설이지만, ‘온프레미스 LLM’은 클라우드 과금 부담 없이 나만의 데이터로 고도화된 시스템을 구축할 …

[로컬 LLM] LLM 파이프라인 구축 가이드
AI 에이전트 & 자동화 #13
실측 검증

[로컬 LLM] LLM 파이프라인 구축 가이드

매달 ltm(LLM) API 비용을 지불하며 클라우드에 의존하는 대신, 내 서버에서 직접 AI를 돌리는 방법이 궁금하지 않으신가요? ‘클라우드 비용 0원’이라는 목표는 단순한 절약이 아니라, 데이터 주권과 운영의 자율성을 확보하는 홈…