Reasoning-Medical-27B is a fine-tuned Qwen3.6-27B model optimized for advanced medical reasoning, trained on 370,000 high-quality Q&A examples with Chain-of-Thought reasoning. It supports universal medical knowledge, including clinical practice, genetics, and college-level biology/medicine. The model uses GRPO training with the Unsloth optimization method for efficient fine-tuning. Read original
reddit/r/LocalLLaMA