Abstract

Text prompting is an indirect interface for poster generation, requiring users to encode inherently two-dimensional composition intent into a one-dimensional sequence of words. We introduce a Spatial Canvas Interface that enables users to directly compose generation intent in space through four complementary binding types: semantic, identity, text, and pixel, together with Text Specifications for individual elements and global appearance. Based on this interface, we develop Compo, a poster generation model adapted from a pretrained image editing model to understand Spatial Canvas inputs and Text Specifications. Compo supports both direct inference, where users explicitly construct the canvas, and agentic mode, where a high-level request is automatically translated into a planned Spatial Canvas. To train Compo, we develop a scalable pipeline that automatically constructs supervision data for different binding types and their combinations, enabling efficient adaptation without training a specialized poster generator from scratch. We further introduce a benchmark that evaluates adherence to individual binding types and their joint composition. Experiments show that Compo achieves stronger compositional controllability than both general-purpose image generation models and dedicated poster generation systems while maintaining high visual quality. By decoupling intent specification from visual generation, our work shifts poster generation from prompting toward composing.

Keywords

Publication details

Journal
Not available
Open access
Green open access

Cite this article

APA 7

Wang, Y., Wei, F., Zhao, J., Zhang, S., Zhang, H., Chen, D., Dai, B., & Lu, Y. (2026). From Prompting to Composing: A Spatial Canvas Interface for Poster Generation. https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation

MLA 9

Wang, Yitong, et al. "From Prompting to Composing: A Spatial Canvas Interface for Poster Generation." https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation.

Chicago (author–date)

Wang, Yitong, Fangyun Wei, Jinjing Zhao, Sirui Zhang, Hongyang Zhang, Dong Chen, Bo Dai, and Yan Lu. 2026. "From Prompting to Composing: A Spatial Canvas Interface for Poster Generation." https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation.

Harvard

Wang, Y., Wei, F., Zhao, J., Zhang, S., Zhang, H., Chen, D., Dai, B. and Lu, Y. (2026) 'From Prompting to Composing: A Spatial Canvas Interface for Poster Generation', Available at: https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation.

Vancouver

Wang Y, Wei F, Zhao J, Zhang S, Zhang H, Chen D, et al. From Prompting to Composing: A Spatial Canvas Interface for Poster Generation. https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation

IEEE

Y. Wang, F. Wei, J. Zhao, S. Zhang, H. Zhang, D. Chen, B. Dai, and Y. Lu, "From Prompting to Composing: A Spatial Canvas Interface for Poster Generation," https://omanscience.com/en/articles/from-prompting-to-composing-a-spatial-canvas-interface-for-poster-generation.