Valen is a multimodal decision model that processes text, images, and video to output decision probabilities over candidate options. Built on a Qwen3.5 backbone, it achieves low-latency structured decision-making, demonstrated through puzzle-solving tasks where it completes decisions in ~120ms per step while maintaining high accuracy even as visual clarity decreases.