rubrub 님의 블로그

  • 홈
  • 태그
  • 방명록

LoRa 1

[LLM] LLM도 입사하면 재교육이 필요하다! Fine-tuning의 수학부터 LoRA·DPO·GRPO, Post-training까지

LLM POST-TRAINING · LoRA · DPO · GRPO · FINANCIAL AI LLM도 입사하면 재교육이 필요하다 Fine-tuning의 수학부터 LoRA·DPO·GRPO, 금융권 Post-training까지 “우리 회사 문서를 학습시키면 모델이 똑똑해질까요?”라는 질문에서 출발해, Gradient Descent와 Cross Entropy부터 QLoRA, Preference Optimization, Reasoning RL, RLVR, Responsible AI, 개인정보보호까지 한 번에 내려가 본다. 어느 월요일 아침, Foundation Model 하나가 금융회사에 입사했다고 상상해보자. ..

LLM 2026.09.09
이전
1
다음
더보기
프로필사진

rubrub 님의 블로그

영-차. 현재 외국계 금융 회사에서 AI Engineer로 근무 중.

  • 분류 전체보기 (55)
    • Computer Vision (0)
    • LLM (13)
    • MLOps (3)
    • AI 논문 리뷰 (5)
    • Azure (1)
    • Responsible AI (RAI) (2)
    • AI (23)
    • AI 보안 (4)
    • 금융 (0)
    • 기타 (0)
    • 경제 (4)

Tag

langsmith, autogen, MLOps, Agentic RAG, LLM, agentic ai, AzureML, Azure, vllm, agenticai, aiagent, 생성형ai, 금융AI, AI, 금융권 AI, rag, Grpo, graphrag, ai agent, RLHF,

최근글과 인기글

  • 최근글
  • 인기글

최근댓글

공지사항

페이스북 트위터 플러그인

  • Facebook
  • Twitter

Archives

Calendar

«   2026/09   »
일 월 화 수 목 금 토
1 2 3 4 5
6 7 8 9 10 11 12
13 14 15 16 17 18 19
20 21 22 23 24 25 26
27 28 29 30

방문자수Total

  • Today :
  • Yesterday :

Copyright © Daum Corp. All rights reserved.

티스토리툴바