Reasoning

  1. X-R1: Open-Source Reasoning Model Exploration

    The revelation that language models could develop sophisticated reasoning capabilities through reinforcement learning -- without human demonstrations...

    AI
  2. Understand R1-Zero: Deep Dive Into DeepSeek R1's Reinforcement Learning

    DeepSeek R1-Zero represented a breakthrough in AI reasoning by demonstrating that pure reinforcement learning, without supervised fine-tuning, could...

    Open Source
  3. TinyZero: Reproducing DeepSeek R1-Zero's Reasoning with RL for Under $30

    DeepSeek R1-Zero was widely regarded as a breakthrough when it was released in January 2025. The model demonstrated that pure reinforcement learning...

    Open Source
  4. Thinking Claude: Enhanced Reasoning for Claude AI

    Prompt engineering has emerged as a critical skill for getting the best results from large language models. Thinking Claude, created by...

    Open Source