Skip to content

DeepSeek-R1 (DeepSeek) 상세 정보

🔙 이전 화면으로 돌아가기


📌 모델 개요

DeepSeek-R1은 지도학습(SFT) 데이터셋에 과도하게 의존하지 않고, 순수 대규모 강화학습(RL)을 통해 자발적인 '생각의 사슬(Chain-of-Thought)' 추론 능력을 획득하여 글로벌 AI 업계에 거대한 충격을 준 오픈소스 플래그십 추론 모델입니다.

🔍 상세 심층 분석

OpenAI의 o1/o3 모델에 필적하는 고난도 수학, 코딩, 과학 추론 능력을 갖추면서도 가중치와 상세 기술 보고서를 완전 공개(MIT 라이선스)하여 오픈소스 추론 모델의 새 시대를 열었습니다.

심층 특징:

  • 자율적 사고 및 자기 반성 (Self-Reflection): 답변 도중 실수를 스스로 감지하고 재검토하는 단계별 사고 프로세스(<think> 태그)를 투명하게 출력합니다.
  • 수학 및 알고리즘 올림피아드 수준 추론: AIME, MATH, Codeforces 등 최고난도 벤치마크에서 글로벌 상용 모델과 대등한 90% 이상의 정답률을 기록합니다.
  • 다양한 체급의 증류(Distilled) 모델 제공: Qwen 및 Llama를 기반으로 증류된 1.5B, 7B, 14B, 32B, 70B 모델을 제공하여 모바일 및 일반 PC에서도 고속 추론을 실행할 수 있습니다.

🔗 관련 링크


🔙 이전 화면으로 돌아가기

개발자를 위한 지식DB — 더 나은 개발 경험을 위해