A modular preference reward modeling pipeline for interior furniture layout evaluation using Qwen3-VL and user feedback.
pytorch lora interior-design preference-learning multimodal-learning vision-language-model reward-model qwen3-vl furniture-layout image-ranking
-
Updated
Jul 20, 2026 - Python