@inproceedings{ijcai2026p198, title = {SpatialV2A: Visual-Guided High-fidelity Spatial Audio Generation}, author = {Wang, Yanan and Ren, Linjie and Li, Zihao and Wang, Junyi and Gan, Tian}, booktitle = {Proceedings of the Thirty-Fifth International Joint Conference on Artificial Intelligence, {IJCAI-26}}, publisher = {International Joint Conferences on Artificial Intelligence Organization}, editor = {Diego Calvanese}, pages = {1776--1784}, year = {2026}, month = {8}, note = {Main Track}, doi = {10.24963/ijcai.2026/198}, url = {https://doi.org/10.24963/ijcai.2026/198}, }