Skip to content
감자나라ai
챗GPT 사용법 및 프롬프트 엔지니어 정보 제공
감자나라ai
  • Class
  • Templates
  • Documents
  • NEWS
  • Tips
  • Glossary
  • QnA
  • 로그인
  • 회원가입
Search:
  • Class
  • Templates
  • Documents
  • NEWS
  • Tips
  • Glossary
  • QnA
  • 로그인
  • 회원가입

Tag Archives: LLM 추론

You are here:
  1. Home
  2. Entries tagged with "LLM 추론"

KV 캐시(Key-Value Cache)란? LLM이 앞선 토큰 계산을 다시 쓰는 방법

GlossaryBy 감자2026년 8월 12일

KV 캐시는 LLM이 앞서 처리한 토큰의 어텐션 Key와 Value를 저장해 다음 토큰 생성 때 다시 쓰는 추론용 메모리입니다. 생성 속도와 메모리의 관계, 프롬프트 캐싱·시맨틱 캐시와 차이를 쉽게 설명합니다.

NVIDIA AI 모델 공동설계, 장문맥 추론을 바꾸는 어텐션 4가지 원칙

NEWSBy 감자2026년 8월 1일

NVIDIA는 장문맥 추론에서 어텐션 병목을 줄이기 위한 그룹 크기, 헤드 차원, KV 상태, GPU 병렬화 4가지 공동설계 원칙을 공개했습니다. AI 에이전트 추론 속도와 처리량을 높이는 핵심을 정리합니다.

Contact
오씨아줌마 | 사업자등록번호 110-20-21523 | 대표 오종현 | 개인정보 보호책임자 오종현 | 전화 0507-1314-3708 | 고객문의 admin@ocworld.kr | 호스팅 제공자 : 퍼널모아
  • Email:
    admin@ocworld.kr

Find us on:

YouTube page opens in new window
 Dream-Theme — truly premium WordPress themes
Go to Top
🚀  감자친구 멤버십 월 12,000 🎉
☑️ 확인하기
close-image