본문으로 건너뛰기
AIDevOps
  • Learn
  • Learning Paths
  • Practice
  • Open Source
  • Books
  • Engineering

    AI DevOpsAI 서비스 개발·운영 전체 지도LLMOpsLLM 배포·평가·관측실전 프로젝트AI Agent 프로젝트 실습

    Knowledge

    Docs기술 문서 모음Blog엔지니어링 아티클Plogger개발 기록 피드

    Validate

    Certification3단계 역량 인증 · 준비 중
AI Models
LlamaMistralGemmaDeepSeekQwen
🧠 AI Core
AI 입문 & 로드맵ML FundamentalsLLM Fundamentals|Python AIC++|PyTorchTensorFlowJAX
🤖 AI 실전 개발
AI 실전 입문 & 로드맵Hugging FaceLangChainLlamaIndexLLMOps|LangGraphMCPMulti-AgentAgent Evaluation
🧠 AI Agent 개발
금융 AI AgentLLM API 서버주식 투자 AgentAIOps AI Agent교육 AI Agent코딩 AI Agent
🌱 Spring Cloud
Spring 입문 & 로드맵Spring Cloud GatewaySpring BootJava|Spring AISpring SecuritySpring BatchSpring JPA
🐳 DevOps
DevOps 입문 & 로드맵LinuxDockerCI/CD|Kubernetes 기본K8s 심화/실무PrometheusGrafana
🧱 인프라
인프라 입문 & 로드맵NginxRedis
☁️ 클라우드
클라우드 입문 & 로드맵AWSGCPAzureNCPCloudflare
🎨 Frontend
Frontend 입문 & 로드맵JavaScriptTypeScript|ReactNext.js|VueNuxt
📱 Mobile
Mobile 입문 & 로드맵KotlinAndroidFlutter
⚙️ Backend
Backend 입문 & 로드맵Python 기본FastAPIDjangoFlask|CGoGinNode.js
💾 Database
DB 입문 & 로드맵공통 SQLOracleMySQLPostgreSQL|MongoDB벡터 DB
🧪 검증
k6JMeternGrinder
AIDevOps

Engineering AI. From Code to Production.
AI와 AI Agent를 개발하고 운영하기 위한 엔지니어링 학습 플랫폼

Learn

  • 전체 가이드
  • Learning Paths
  • Practice
  • Books

Resources

  • AI DevOps
  • LLMOps
  • 실전 프로젝트
  • Docs
  • Blog
  • Plogger
  • Open Source
  • Certification (준비 중)

Start Here

  • AI Core 로드맵
  • AI 실전 개발 로드맵
  • Spring Cloud 로드맵
  • DevOps 로드맵
  • 인프라 로드맵

 

  • 클라우드 로드맵
  • Frontend 로드맵
  • Mobile 로드맵
  • Backend 로드맵
  • Database 로드맵
© 2026 AI DevOps Korea. All rights reserved.
이용약관개인정보처리방침Sitemaptestforge.kr
Llama · 실전 예제

🦙 Llama 실전 예제

Visitors

Ollama 기반 채팅 API, RAG, 코드 리뷰, 스트리밍 웹앱 예제를 정리합니다.

← llama 가이드로 돌아가기
🦙

목차

0 / 4
  1. 환경 설정
  2. 채팅 API 서버
  3. RAG 문서 Q&A
  4. 스트리밍 웹앱
목차 4개 섹션
  1. 환경 설정
  2. 채팅 API 서버
  3. RAG 문서 Q&A
  4. 스트리밍 웹앱
💡

대표 실행 명령: ollama run llama3.1

환경 설정

Ollama로 로컬 모델을 내려받고 API 서버를 확인합니다.

BASH
ollama pull llama3.1
curl http://localhost:11434/api/tags

채팅 API 서버

OpenAI 호환 API 형태로 로컬 Llama를 연결합니다.

RAG 문서 Q&A

문서를 chunk로 나누고 벡터 검색을 통해 답변 정확도를 높입니다.

스트리밍 웹앱

토큰 단위 스트리밍으로 응답 체감 속도를 개선합니다.

다음 단계

예제를 실제 서비스에 맞게 바꿀 때는 URL, 인증 정보, 임계값, 리포트 저장 위치를 먼저 분리하세요.

가이드 본문으로 이동 →