DeepSeek-R1 (DeepSeek) 상세 정보
📌 모델 개요
DeepSeek-R1은 지도학습(SFT) 데이터셋에 과도하게 의존하지 않고, 순수 대규모 강화학습(RL)을 통해 자발적인 '생각의 사슬(Chain-of-Thought)' 추론 능력을 획득하여 글로벌 AI 업계에 거대한 충격을 준 오픈소스 플래그십 추론 모델입니다.
🔍 상세 심층 분석
OpenAI의 o1/o3 모델에 필적하는 고난도 수학, 코딩, 과학 추론 능력을 갖추면서도 가중치와 상세 기술 보고서를 완전 공개(MIT 라이선스)하여 오픈소스 추론 모델의 새 시대를 열었습니다.
심층 특징:
- 자율적 사고 및 자기 반성 (Self-Reflection): 답변 도중 실수를 스스로 감지하고 재검토하는 단계별 사고 프로세스(
<think>태그)를 투명하게 출력합니다. - 수학 및 알고리즘 올림피아드 수준 추론: AIME, MATH, Codeforces 등 최고난도 벤치마크에서 글로벌 상용 모델과 대등한 90% 이상의 정답률을 기록합니다.
- 다양한 체급의 증류(Distilled) 모델 제공: Qwen 및 Llama를 기반으로 증류된 1.5B, 7B, 14B, 32B, 70B 모델을 제공하여 모바일 및 일반 PC에서도 고속 추론을 실행할 수 있습니다.
🔗 관련 링크
- 공식 깃허브: DeepSeek-R1 GitHub Repository
- 웹 챗 플랫폼: DeepSeek AI 공식 웹사이트