기초 원리

AI의 식량: 훈련 데이터

AI에게 말하는 법을 가르치려면 먼저 수조 개의 단어를 먹여야 합니다. AI는 인류가 쓴 글의 대부분을 이미 읽었습니다.

데이터 규모 및 구성
~1B
Tokens · 초소형 모델 훈련 데이터 규모
얼마나 읽었는가가 얼마나 말할 수 있는가를 결정합니다.
훈련 데이터의 품질과 다양성이 모델의 세계관 상한을 결정합니다.
슬라이더를 드래그 · 모델 크기별 능력 차이를 직접 체감하세요
270M 환각
270M0.6B1.8B30B70B120B235B1T5T+
270M
Gemma-4-e2b
Google · 로컬 추론
환각
Q: 이지은(IU)은 누구입니까? 그녀의 생애와 대표 작품을 소개해 주세요.