도형준 지식 볼트

태그: Process-Reward-Model

1건의 항목

  • 2026년 7월 21일

    OpenAI o3-pro: 추론 컴퓨트를 극대화한 최강 추론 모델

    • AIME
    • Chain-of-Thought
    • Compute-Scaling
    • CoT
    • Expert-Level-AI
    • GPQA
    • o3-pro
    • OpenAI
    • Process-Reward-Model
    • Reasoning
    • Test-Time-Compute

Created with Quartz v4.5.2 © 2026

  • GitHub
  • Discord Community