潘滢炜,现任智象未来(HiDream.ai)算法科学家,曾获微软学者奖学金、ACM SIGMM China 最佳博士论文奖、ACM Multimedia 最佳开源项目奖、北京市科技新星计划创新新星等荣誉,并六次获得国际学术竞赛冠军。

潘滢炜,现任智象未来(HiDream.ai)算法科学家,曾获微软学者奖学金、ACM SIGMM China 最佳博士论文奖、ACM Multimedia 最佳开源项目奖、北京市科技新星计划创新新星等荣誉,并六次获得国际学术竞赛冠军。
当前,多模态内容生成技术虽然在快速产出内容上展现了惊人潜力,却让创作者陷入了一种新的困境:模型更像一个不受控的“灵感喷泉”,而非精准的“创作伙伴”。创作者需要反复“抽卡”式地生成和筛选,耗费大量精力与模型博弈,只为获得一张勉强符合预期的结果。如何让AI真正理解创作意图,实现精准、可控的生成,已成为行业的核心痛点。
面对这一挑战,智象未来正致力于打造一个真正“懂用户”的创作伙伴。我们认为,破局的关键在于让模型从被动的“内容生成者”转变为主动的“场景构建者”。本次报告将分享我们如何将大语言模型的深层语义理解与规划能力作为“大脑”,来指导和控制视觉生成模型这一“巧手”。通过我们在设计、营销、影视等领域的创新应用案例,我们将展示这一技术路径如何实现对生成内容在语义、空间与时序上的精准控制,从而贯穿从“灵感”激发到创作到最终“分发”的全链路。
这不仅仅是技术的迭代,更是一次创作范式的根本性变革。当AI能够基于对用户意图的深度理解,自主、可靠地“构建”出复杂场景时,创作者的角色将从繁琐的“操作工”回归真正的“决策者”与“导演”。我们坚信,创作者是价值的核心,而卓越技术的使命,正是通过释放这种全新的“构建”能力,极大化创作者的潜能,让每一份优质内容都能被高效、精准且原汁原味地呈现给世界。



微信咨询

电话咨询
领取往期热门演讲视频

