VAPO: End-to-end Slide-Enhanced Speech Recognition with Omni-modal Large Language Models 2026-07-07 Unisound 7