안드레 카파시가 200줄 코드로 설명하는 GPT원리

이 자료는 복잡하게 느껴지는 대형 언어모델(LLM)의 원리를 최대한 쉽게 풀어 설명하기 위해, 약 200줄의 파이썬 코드로 만든 ‘MicroGPT’를 따라가며 토크나이저, 학습 과정, 어텐션 구조, 그리고 문장 생성까지의 흐름을 차근차근 보여줍니다.

안드레 카파시가 200줄 코드로 설명하는 GPT원리 1페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 2페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 3페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 4페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 5페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 6페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 7페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 8페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 9페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 10페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 11페이지
안드레 카파시가 200줄 코드로 설명하는 GPT원리 12페이지
1/12

AI/테크

안드레 카파시가 200줄 코드로 설명하는 GPT원리

이 자료는 복잡하게 느껴지는 대형 언어모델(LLM)의 원리를 최대한 쉽게 풀어 설명하기 위해, 약 200줄의 파이썬 코드로 만든 ‘MicroGPT’를 따라가며 토크나이저, 학습 과정, 어텐션 구조, 그리고 문장 생성까지의 흐름을 차근차근 보여줍니다. 어려운 수식이나 거대한 시스템 대신 “텍스트를 숫자로 바꾸고, 다음 단어를 예측하도록 배우는 과정”이라는 핵심 아이디어에 집중해 독자가 자연스럽게 전체 그림을 이해하도록 돕고, 실제 LLM과 무엇이 같고 다른지도 친절하게 짚어줍니다. 처음 접하는 분도 부담 없이 읽으면서 ‘LLM이 어떻게 작동하는지’를 직관적으로 grasp할 수 있도록 구성된 입문 친화적인 안내서입니다.

지금 보고 있는 자료는 모두 Snapdeck으로 만들었어요.

스냅덱으로 바로가기
86

다른 자료 보기

전체 보기

오픈웨이트와 오픈소스는 다르다

모델 파일을 내려받을 수 있다고 모두 오픈소스인 것은 아니에요. 가중치 공개와 데이터·학습 코드·재배포 권리는 서로 다른 층위거든요. 이런 분에게 추천해요 - 오픈웨이트와 오픈소스를 구분하고 싶은 분 - 자체 호스팅 모델의 권리를 확인하는 분 - API와 로컬 실행 사이에서 판단하는 분 내용 요약 Open Access, Open Weight, Open Source AI의 차이부터 gpt-oss 20B·120B, Apache 2.0, Llama 4, Gemma의 라이선스 조건, GPU·MLOps 운영비까지 14페이지로 정리했어요. 어떤 모델이 우리 조직에 맞을지 알고 싶다면 지금 읽어보세요.

83명이 봤어요

루프 엔지니어링 다음은 그래프 엔지니어링?

루프를 더 정교하게 돌리는 것만으로 복잡한 AI 시스템을 다룰 수 있을까요? 조건 분기, 병렬 에이전트, 공유 상태가 늘어날수록 필요한 건 반복보다 전체 흐름을 그리는 그래프예요. 이런 분에게 추천해요 - 에이전트 자동화 구조를 설계하는 분 - 복잡한 조건·예외 처리가 늘어난 팀 - LangGraph·n8n 도입을 검토하는 분 내용 요약 루프와 그래프의 차이부터 중앙 상태, 동적 라우팅, 병렬 처리, Human-in-the-Loop, LangGraph·n8n 구현법까지 21장에 정리했어요. 5개 독립 작업은 최대 5배 빠르게, 모델 혼합은 운영 비용을 80% 이상 줄일 수 있다는 구조적 이점과 과잉 설계·검증 병목도 함께 다뤄요. 내 업무에 적용할 3단계 실천법이 궁금하다면 지금 읽어보세요.

341명이 봤어요