Language models can function as decision models by using next-token probabilities to select actions from candidate options without requiring decision-specific training. Qwen3.5-9B, tested against Jev 1.13.0, achieved competitive accuracy on multiple benchmarks including WebPRM and DeepSWE tasks, with the approach using rotated letter scores and log probability aggregation across candidate positions.