SOC HUM AI SCI JA Jakub Strawa Cascade Reinforcement Learning, MPO, GSPO — Multimodal Reasoning Shanghai AI Laboratory has just unveiled InternVL3.5, a major leap forward in multimodal reasoning models. In this post, I’ll walk through…