废片也能变大片,北大开源首个「美学照片重构」模型 文章

36kr 资讯2026-06-08NEWSzh作者: 新智元

详细信息

来源站点
36kr 资讯
作者
新智元
文章类型
NEWS
语言
zh
发布日期
2026-06-08

摘要

【导读】北大彭宇新团队提出「美学照片重构」新任务,从摄影教学视频中自动构建数据集AesRecon,并开发两阶段模型AesFormer,通过优化构图、视角与人物姿态,提升照片的美感与艺术表现力。 你拍下一张照片,AI也许能帮你调亮、美颜、换个滤镜,却很难真正把它变成你心中想要的样子。 一张照片不好看,往往是因为一开始就没拍对:构图偏了、视角歪了、姿态僵了。现有图像美化工具可以调亮度、加美颜、套滤镜,却无法重新组织构图、修正拍摄角度、调整人物姿态,因此难以修正拍摄阶段留下的结构性缺陷。 针对这一挑战,北京大学彭宇新教授团队在美学理解领域开展了最新研究,定义了美学照片重构这一任务,通过从互联网拍照教学视频中自动挖掘美学语料,构建了首个美学照片重构数据集与评测基准AesRecon。该数据集包含9071对人像照片样本,记录了同一人物、同一场景下从普通原片到出彩成片的真实优化过程。 在此基础上,团队进一步提出美学照片重构模型AesFormer,通过「美学规划+美学编辑」的两阶段方法,让AI不再只停留于调色、美颜等表层修饰,而是能够进一步调整构图、视角与人物姿态,从画面结构层面提升照片美感。相关论文已被ICML 2026接收,并已开源。 论文链接:https://arxiv.org/abs/2605.22126 开源代码:https://github.com/PKU-ICST-MIPL/AesFormer_ICML2026 实验室网址:https://www.wict.pku.edu.cn/mipl 从「表层修饰」到「画面重构」 拍照,是记录日常场景、情感与回忆的重要方式。但真正动人的瞬间往往稍纵即逝。要定格这样的画面,拍摄者需要在按下快门的瞬间,快速判断构图、视角、人物姿态等关键因素。 对专业摄影师而言,这种判断来自系统训练与长期实践;而对普通用户来说,由于缺乏摄影经验,拍出的照片常常存在构图偏移、视角失衡、姿态僵硬等问题,导致实际成片与心中期待的理想画面产生明显落差。 为了弥补这种落差,用户通常会使用图像美化工具来提升照片美感。现有工具可大致分为两类: (1)照片调色工具,如自动修图方法、Photoshop、Lightroom等,主要通过调整曝光、亮度、对比度等基础视觉参数来优化色彩风格;