도형준 지식 볼트
Search
검색
다크 모드
라이트 모드
탐색기
태그: Reasoning
10건의 항목
2026년 7월 21일
Gemini 2.5 Pro: 내장 사고 기능의 최강 추론 모델
Chain-of-Thought
Gemini-2.5
Google-DeepMind
Long-Context
Mixture-of-Experts
MoE
Reasoning
RLVR
Thinking-Model
2026년 7월 21일
OpenAI o4-mini: 대규모 언어 모델
Cost-Efficiency
CoT
Multimodal-Reasoning
OpenAI
OpenAI-o4-mini
Reasoning
Test-Time-Compute
2026년 7월 21일
Gemini 3: Google DeepMind의 차세대 에이전틱 AI 모델
Agentic-AI
Deep-Think
Gemini-3
Google-DeepMind
Long-Context
Mixture-of-Experts
MoE
Multimodal
Reasoning
2026년 7월 21일
DeepSeek-R1-Zero: SFT 없이 순수 RL만으로 추론이 창발한 최초의 대규모 모델
Aha-Moment
Chain-of-Thought
DeepSeek
Emergent-Behavior
GRPO
MoE
Open-Source
Pure-RL
Pure-RL-Training
R1-Zero
Reasoning
2026년 7월 21일
DeepSeek-R1: 순수 강화학습으로 o1에 필적하는 추론 AI의 민주화
Chain-of-Thought
DeepSeek
Distillation
GRPO
MoE
Open-Source
Pure-RL
Pure-RL-Training
R1
Reasoning
Self-Verification
2026년 7월 21일
OpenAI o3-pro: 추론 컴퓨트를 극대화한 최강 추론 모델
AIME
Chain-of-Thought
Compute-Scaling
CoT
Expert-Level-AI
GPQA
o3-pro
OpenAI
Process-Reward-Model
Reasoning
Test-Time-Compute
2026년 7월 21일
OpenAI o3: ARC-AGI 87.5%로 인간 평균을 넘어선 추론 AI의 이정표
Adaptive-Compute
AIME
ARC-AGI
Chain-of-Thought
CoT
GPQA
o3
OpenAI
Reasoning
Test-Time-Compute
2026년 7월 21일
Phi-4 Reasoning: 오픈소스 대규모 언어 모델
Chain-of-Thought
GRPO
Microsoft
Phi-4-Reasoning
Reasoning
Small-Language-Model
Synthetic-Data
2026년 7월 21일
OpenAI o1: 테스트 시간 컴퓨트 스케일링으로 추론 AI 시대를 연 모델
AIME
Chain-of-Thought
CoT
GPQA
Internal-Monologue
o1
OpenAI
Reasoning
RL
Test-Time-Compute
2026년 7월 21일
Grok 3: 대규모 언어 모델
Chain-of-Thought
Grok-3
Large-Scale-Training
Real-time-Data
Reasoning
xAI