7 ms·Visual Generation Unlocks Human-Like Reasoning Through Multimodal World Models2 points by felineflock 4mo ago