도형준 지식 볼트
Search
검색
다크 모드
라이트 모드
탐색기
태그: Chain-of-Thought
13건의 항목
2026년 7월 21일
Gemini 2.5 Pro: 내장 사고 기능의 최강 추론 모델
Chain-of-Thought
Gemini-2.5
Google-DeepMind
Long-Context
Mixture-of-Experts
MoE
Reasoning
RLVR
Thinking-Model
2026년 7월 21일
DeepSeek-R1-Zero: SFT 없이 순수 RL만으로 추론이 창발한 최초의 대규모 모델
Aha-Moment
Chain-of-Thought
DeepSeek
Emergent-Behavior
GRPO
MoE
Open-Source
Pure-RL
Pure-RL-Training
R1-Zero
Reasoning
2026년 7월 21일
DeepSeek-R1: 순수 강화학습으로 o1에 필적하는 추론 AI의 민주화
Chain-of-Thought
DeepSeek
Distillation
GRPO
MoE
Open-Source
Pure-RL
Pure-RL-Training
R1
Reasoning
Self-Verification
2026년 7월 21일
Flan-T5: 명령어 튜닝으로 소형 모델이 거대 모델을 넘다
Chain-of-Thought
Flan-Collection
Flan-T5
Google-Research
Instruction-Tuning
MMLU
Multitask-Fine-tuning
T5
Zero-Shot
Zero-Shot-Generalization
2026년 7월 21일
OpenAI o3-pro: 추론 컴퓨트를 극대화한 최강 추론 모델
AIME
Chain-of-Thought
Compute-Scaling
CoT
Expert-Level-AI
GPQA
o3-pro
OpenAI
Process-Reward-Model
Reasoning
Test-Time-Compute
2026년 7월 21일
OpenAI o3: ARC-AGI 87.5%로 인간 평균을 넘어선 추론 AI의 이정표
Adaptive-Compute
AIME
ARC-AGI
Chain-of-Thought
CoT
GPQA
o3
OpenAI
Reasoning
Test-Time-Compute
2026년 7월 21일
Phi-4 Reasoning: 오픈소스 대규모 언어 모델
Chain-of-Thought
GRPO
Microsoft
Phi-4-Reasoning
Reasoning
Small-Language-Model
Synthetic-Data
2026년 7월 21일
PaLM: 5400억 파라미터와 Chain-of-Thought의 힘
BIG-Bench
Chain-of-Thought
Chain-of-Thought-Prompting
Google
MQA
PaLM
Pathways
Pathways-System
RoPE
Scaling
Scaling-Laws
SwiGLU
2026년 7월 21일
OpenAI o1: 테스트 시간 컴퓨트 스케일링으로 추론 AI 시대를 연 모델
AIME
Chain-of-Thought
CoT
GPQA
Internal-Monologue
o1
OpenAI
Reasoning
RL
Test-Time-Compute
2026년 7월 21일
Qwen3: MoE 기반 대규모 언어 모델
Alibaba
Chain-of-Thought
Hybrid-Reasoning
MoE
Multilingual
Qwen3
Thinking-Mode
2026년 7월 21일
Qwen3.5: MoE 기반 대규모 언어 모델
Agentic-AI
Alibaba
Chain-of-Thought
Early-Fusion-Multimodal
FP8-Training
Gated-DeltaNet
Hybrid-Attention
Hybrid-Reasoning
MoE
Multilingual
Qwen3.5
Thinking-Mode
2026년 7월 21일
Grok 3: 대규모 언어 모델
Chain-of-Thought
Grok-3
Large-Scale-Training
Real-time-Data
Reasoning
xAI
2026년 7월 21일
Chain-of-Thought Prompting: AI 에이전트 프레임워크
Chain-of-Thought
Chain-of-Thought-Prompting
Emergent-Ability
Few-Shot-Reasoning
Google