近期,AI 视频生成领域迎来底层技术重要突破,双流 DiT 视频生成架构正式完成商业化落地,直指行业长期存在的长时序画面崩坏核心痛点。这一技术突破从底层重构视频生成的时空处理逻辑,大幅提升长视频生成的连贯性与稳定性,为 AI 视频向分钟级、长剧情场景渗透扫清关键技术障碍。星宇智算 Vera1.1 作为首批搭载双流 DiT 架构的商用产品,已实现技术能力全量落地,为行业提供成熟可用的长视频生成解决方案。

长时序画面崩坏 制约 AI 视频向长内容场景渗透
在 AI 视频技术快速普及的当下,15-30 秒短时长视频生成已逐步成熟,但长时序生成始终是行业共性技术瓶颈。随着视频时长增加,传统单流 DiT 架构容易出现时序注意力衰减,进而引发人物特征漂移、场景元素错乱、运动逻辑断裂等画面崩坏问题。 据行业公开测试数据显示,主流 AI 视频工具在生成 30 秒以上内容时,画面一致性问题出现概率超过 60%;时长突破 1 分钟后,人物走形、场景跳变等严重崩坏问题占比大幅上升。这一瓶颈直接限制了 AI 视频在爽文短剧、科普教育、企业宣传片等长内容场景的规模化应用,成为产业向深水区发展必须突破的核心关卡。
双流 DiT 架构底层突破 重构时空处理逻辑
针对传统架构的长时序短板,双流 DiT 视频生成架构采用空间、时序双路并行的设计思路,从底层重构视频生成机制。 其中,空间流分支专注于画面细节、画质质感与元素特征的精准生成,保障单帧画面的视觉精度;时序流分支则专门负责帧间运动衔接、特征延续与逻辑连贯性,全程锚定人物、场景的核心特征。双路分支通过协同注意力机制实时交互,在保留高画质优势的同时,大幅延长稳定生成的时序长度,从根源上缓解长时序画面崩坏问题。 业内技术测试表明,双流 DiT 架构在 60 秒长视频生成场景中,可将画面严重崩坏率降低 70% 以上,人物特征留存度与场景连贯性提升超 65%,长视频生成的可用度实现量级提升。
星宇智算 Vera1.1 率先商用 打造长视频全链路方案
作为国内首批落地双流 DiT 架构的 AI 视频工具,星宇智算 Vera1.1 已完成该技术与全链路创作体系的深度融合,打造出商用级长视频生成能力。 依托双流 DiT 架构的底层支撑,Vera1.1 可支持分钟级长视频一次性连贯生成,无需分段拼接即可全程保持人物特征统一、场景风格一致、运动逻辑顺畅。同时,该架构与 Vera1.1 已有的多人物特征锁定、参考图锁定、6 自由度运镜、无限画布等能力深度联动,在长视频生成过程中同步实现精准的镜头调度与元素管控,满足复杂长内容的创作需求。 针对短剧制作、课程科普、品牌宣传片等核心长内容场景,Vera1.1 基于双流 DiT 架构做了专项优化,大幅降低长内容的制作门槛与返工成本,帮助创作团队将长视频生产效率提升数倍。
底层技术释放产业价值 长视频商业化进入加速期
双流 DiT 架构的商用落地,是 AI 视频产业从 “短内容工具” 向 “长内容生产基础设施” 升级的重要里程碑。底层技术瓶颈的突破,将直接打开 AI 视频在更多长周期、重内容场景的应用空间,推动产业价值向更深层次释放。 业内分析指出,随着双流架构等底层技术的持续迭代,AI 视频将逐步覆盖从短视频素材到中长视频内容的全品类生产,带动内容生产模式的进一步革新。而星宇智算等头部厂商持续的技术落地与场景优化,也将加速长视频生成技术的普惠,让更多行业能够享受到 AI 技术带来的效率升级。
技术突破始终是产业发展的核心驱动力。双流 DiT 视频生成架构的落地,不仅破解了长时序画面崩坏的行业难题,更为 AI 视频产业的长期发展筑牢了技术根基。随着技术与场景的持续深度融合,AI 长视频生成将迎来更广阔的商业化空间。
