8月18日消息,美图影像研究院(MT Lab)近日公布2026年AI影像领域最新科研进展。2026年以来,共有11篇论文被ICLR、CVPR、ICML、ECCV、ACM MM等国际顶会接收,覆盖视频编辑、人像编辑、智能交互、视觉理解等方向。
在模型编辑方面,美图影像研究院提出参考帧引导视频编辑统一框架MiVE,可实现发型、服装、妆容、打光、背景、天气等通用视频编辑;一致特征传输重打光方案CFT可在保持人物一致性的基础上实现不同打光效果,目前已研发上线超过50种复杂光效;BridgeRemoval则用于提升AI视频消除的精准度及时序一致性。
此外,基于Self-Prompting的图像文本编辑方法,可处理繁体中文、泰语、日语及特殊符号等复杂文字;面向原生2K多服饰试衣的新框架,可实现端到端多服饰生成,并保持不同服饰材质的真实质感。
在用户意图理解方面,美图影像研究院提出FlowSeg,通过对齐画面对象与语言指令,更准确判断编辑目标。其基于DiT的3D位置编码框架PE-Field、动态毛发渲染框架ControlHair、协同式图像编辑框架SI-Edit,则分别被ICLR 2026、ECCV 2026和ACM MM 2026收录。(定西)
