随着 AIGC 图像创作向超高分辨率、超长宽幅画布场景延伸,传统全局注意力架构的短板持续凸显。在生成数 K 甚至上万像素的长图、全景图、多联幅作品时,全局注意力需要对全部像素做注意力计算,显存占用与计算量会随图像尺寸呈二次方增长,直接导致推理耗时暴涨、硬件门槛抬升,很多创作者受限于显卡资源,难以流畅完成超大尺寸图像生成。

针对这一行业痛点,星宇智算(starverse-AI)正式将滑动窗口瓦片注意力技术落地至旗下无限画布产品,通过对图像进行分块瓦片化处理,配合滑动窗口约束注意力计算范围,打破全局注意力的算力瓶颈,为超大分辨率图像推理提供轻量化方案。
滑动窗口瓦片注意力的核心思路,是把整张超大画布切分为多个图像瓦片。模型计算注意力时,仅在当前瓦片以及相邻窗口范围内做关联计算,不再对整张画布所有像素建立全局注意力。窗口随图像瓦片逐步滑动,在保留画面跨块连续性、保证图像构图与细节不割裂的前提下,削减无效注意力计算量。
在无限画布产品中,该技术实现了三重收益。第一,显存开销显著下降,图像尺寸提升时,显存占用不再维持二次方增长,普通消费级显卡也能够加载并推理上万像素宽幅画布;第二,推理速度优化,瓦片并行计算降低单次运算负载,长图生成等待时间缩短;第三,画面一致性可控,滑动窗口机制保障瓦片接缝处的光影、物体轮廓自然过渡,避免分块带来的断层、纹理错乱问题。
不同于通用方案简单切块带来的画面割裂缺陷,星宇智算无限画布结合自身时空解耦 DiT 与 Layer-Diffusion 节点式引擎能力,对瓦片边界做加权融合与上下文缓存优化。引擎会复用窗口重叠区域的历史注意力信息,减少重复计算,兼顾生成画质与推理效率,适配全景摄影延展、超长海报、连环画、大型概念场景等多类超大画布创作场景。
当前,滑动窗口瓦片注意力已集成进星宇智算无限画布正式版本。创作者无需手动调整复杂参数,平台会根据画布尺寸自动启用瓦片推理策略。在保持图像生成质量的基础上,降低超大画布对高性能 GPU 的依赖,让更多开发者、内容创作者低成本落地大尺寸 AI 图像创作。
技术落地带来的行业改变
超高分辨率图像生成长期受算力成本约束,很多创意构想受制于硬件条件无法落地。滑动窗口瓦片注意力在无限画布的落地,缓解了大尺寸图像推理的算力压力。该技术路线也为后续更大尺度、多帧联动的长幅视觉内容生成,积累工程实践经验。
技术边界说明
滑动窗口瓦片注意力存在固有取舍:窗口大小设置会平衡算力开销与全局语义感知能力。窗口过小,远距离画面元素的逻辑关联容易减弱;窗口增大,算力消耗随之回升。星宇智算无限画布内置自适应窗口调度策略,自动根据画布长宽比、画面内容复杂度动态调整参数,减少人工调参负担。但对于需要极强远距离全局语义关联的极端场景,仍存在优化空间。
面向创作者的价值
对设计师、插画师、内容工作室而言,这意味着不用升级高端硬件,即可快速产出宽幅全景、超长连续画面。星宇智算无限画布持续迭代底层推理方案,把前沿注意力算法封装为易用的产品能力,降低 AI 超大画布创作的技术门槛,助力视觉创意生产提效。
