{"componentChunkName":"component---src-templates-tags-js","path":"/tags/모델-서빙/","result":{"data":{"site":{"siteMetadata":{"title":"Bottlehs Tech Blog"}},"allMarkdownRemark":{"totalCount":2,"nodes":[{"excerpt":"LLM 추론 최적화 - KV Cache, Quantization, Speculative Decoding LLM 추론은 계산 집약적이고 메모리를 많이 사용한다. 프로덕션 환경에서 LLM…","fields":{"slug":"/ai/LLM-추론-최적화-KV-Cache-Quantization-Speculative-Decoding/"},"frontmatter":{"date":"2025년 11월 28일","title":"LLM 추론 최적화 - KV Cache, Quantization, Speculative Decoding","description":"LLM 추론 성능을 최적화하는 핵심 기술들을 실전 예제와 함께 정리합니다. KV Cache, Quantization, Speculative Decoding, 배치 처리, 모델 병렬화 등 모든 최적화 기법을 다룹니다."}},{"excerpt":"MLOps 실전 가이드 - AI 모델 서빙과 운영 자동화 완벽 정리 머신러닝 모델을 개발하는 것과 프로덕션 환경에서 안정적으로 운영하는 것은 완전히 다른 차원의 문제다. Jupyter Notebook에서 9…","fields":{"slug":"/ai/MLOps-실전-가이드-AI-모델-서빙과-운영-자동화/"},"frontmatter":{"date":"2025년 11월 15일","title":"MLOps 실전 가이드 - AI 모델 서빙과 운영 자동화 완벽 정리","description":"MLOps의 개념부터 실전 구현까지. 모델 버전 관리(MLflow), A/B 테스트, 모델 서빙(KServe, Seldon), 성능 모니터링, 데이터 드리프트 감지까지 프로덕션 환경에서 AI 모델을 운영하는 모든 것을 다룹니다."}}]}},"pageContext":{"tag":"모델 서빙","noindex":true}},"staticQueryHashes":["213619243","3262363727"]}