清华大学团队研发的AutoMIA系统,能够将任意两张图片转化为具有镜像错觉效果的3D艺术品。该系统不仅支持正面与镜中呈现截然不同的图案,还具备3D打印功能。请看下面两组照片:每一组中,左侧是镜子前物体的正面图案,右侧则是其在镜中的倒影。令人惊讶的是,正面与镜中呈现出的几乎完全是两个毫不相干的东西——第一组正面是「CVPR」,镜中却变成了「2026」;第二组正面是「山」,镜中却成了「水」。它们的轮廓、颜色乃至含义都对不上,仿佛产生了一种「错觉」。这背后的原因是,物体本身经过了特殊设计,利用了人类视觉系统的「对称补全效应」,这种现象被称为镜像错觉艺术。研究者通过精心设计三维几何和表面颜色,使得一个真实物体在直接观察和镜中观察时呈现出截然不同的视觉效果。以下提供了两组对应的「解密」视频。

传统上,这类艺术品的设计需要专业艺术家巧妙的构思,以及大量复杂的人工设计经验和数学计算,门槛极高。那么,能否有一种方法自动化地帮助人们完成这样的艺术设计,让普通人也能将自己的灵感转化为艺术品呢?近日,来自清华大学等单位的研究团队提出了AutoMIA,这是一种自动生成镜像错觉艺术的AI设计方法。用户仅需任意指定两张图片,分别对应镜子前和镜子中的图案,AutoMIA就能自动完成三维艺术品的设计,并支持直接3D打印。该论文已被CVPR 2026接收,并被评为了大会亮点论文(Highlight Paper);同时,因其较高的计算效率,该工作还获得了CVPR高效计算奖。

研究背景
光学错觉艺术长期以来都是艺术、心理学和计算机视觉交叉领域中的重要课题。常见的2D错觉包括混合图像、视觉变形图像等;3D错觉则包括Shadow Art、Multi-View Wire Art等。这些方法通常依赖特定视角、投影或阴影关系,让同一个物体在不同观察条件下呈现不同外观。Mirror Illusion Art是一种更特殊的3D错觉:一个真实物体被放在镜子前时,观察者在正面看到一种图案,而在镜中看到另一种图案。此前,相关设计往往需要大量人工推导和手工调整,并且多集中在形状设计上,难以同时处理彩色图案。若直接借鉴Shadow Art一类方法,也容易产生表面噪声、背景浮块或内部断裂,影响视觉质量和实体制作。因此,作者提出了一个直接的问题:能否让AI自动设计这种镜像幻觉物体?给定两张目标图片,系统是否可以同时优化3D形状和颜色,使同一物体在两个视角下呈现两种指定外观?

研究方法
AutoMIA将这一问题建模为一个双视角逆设计任务。系统使用体素来表示3D物体,每个体素包含密度和颜色信息;随后通过可微体渲染,从两个指定视角渲染该物体,并将渲染结果与两张目标图像进行比较。优化目标同时包含形状相似度和颜色相似度,从而让生成物体既满足轮廓要求,也能生成目标图像的颜色。在实际优化中,作者发现了四类关键问题:表面噪声、背景噪声、内部断裂以及形状和颜色优化不平衡。为此,论文提出了四个核心机制。首先是PAC,即基于投影对齐的连通域剪枝。系统会将当前体素中的连通分量逐个投影到两个视角,并根据它们与目标mask的重合程度和背景溢出情况进行评分,保留真正有助于目标图案的结构,去除漂浮或无效的噪声部分。其次是PWA,即基于位置的加权自适应抑噪。它会根据像素到目标区域的距离调整背景惩罚权重,使远离目标图案的错误投影受到更强惩罚,从而减少远处的背景噪声。第三是IVP,即内部体素保护。由于监督图像主要约束物体表面,内部体素容易在优化中被错误削弱,导致结构断裂。IVP会识别内部体素并施加密度下限,帮助保持物体完整性,这对后续3D打印尤其重要。最后是SCD,即形状—颜色解耦优化。AutoMIA将训练过程划分为形状优化、形状颜色联合优化和颜色细化阶段,避免颜色过早干扰几何结构,也减少不同视角颜色之间的冲突。

实验结果
论文在多类2D图像作为输入时验证了AutoMIA,包括英文字母、数字、汉字、几何图案、emoji、卡通图案和logo等。实验中,作者将AutoMIA与Shadow Art(SA)和 Shadow Art Revisited(SAR)等方法进行了比较。由于基线方法主要支持形状优化,比较重点包括平滑程度、噪声水平和形状一致性等指标。结果显示,AutoMIA在重建质量上取得了明显优势。论文报告中,AutoMIA的平滑程度(SL)达到0.989,噪声水平(NL)降至0.049,形状一致性(SS)达到0.931;相比之下,SA和SAR在形状一致性和噪声控制上均存在明显差距。同时,AutoMIA在单张RTX 3090上平均设计时间仅为76秒,平均显存占用约2.6GB,体现出高效的计算效率。从可视化结果来看,SA和SAR容易产生悬浮噪声、表面不平整或内部断裂等问题,导致物体难以形成稳定、完整的实体结构。而AutoMIA生成的结果不仅能更好匹配两张目标图像的轮廓,还能重建出输入图像的彩色表面,使正面视角和镜中视角都具有清晰的视觉语义。对于镜像幻觉艺术而言,这一点尤为关键:如果形状正确但颜色混乱,或者颜色接近但结构破碎,最终都难以形成令人信服的错觉效果。消融实验进一步表明,PAC、PWA、IVP和SCD都对最终结果有贡献。去掉任一模块都会导致重建质量下降。例如,去掉PAC会显著增加噪声并降低形状一致性;去掉SCD则会影响形状、颜色和平滑效果。这说明AutoMIA并不是单纯依赖体素优化,而是针对镜像幻觉设计中的出现的问题进行了系统性的设计。

除了数字结果,论文还展示了多个实体制作案例。作者将优化后的体素模型转换为可3D打印的格式,并通过3D打印制作真实物体。在实物照片中,物体正面和镜中呈现出不同图案,表明该方法可以成功从数字设计走向物理世界。用户可以基于此方法来制作各类艺术品。

结论与展望
研究人员提出了AutoMIA,一个用于自动生成Mirror Illusion Art的AI设计系统。它能够从两张2D图像出发,联合优化3D物体的形状和颜色,并通过PAC、PWA、IVP和SCD等机制提升结果质量,使生成物体更平滑、更完整,也更适合实际制作。这项工作展示了AI在计算设计和艺术创作中的新可能:它不仅能生成图像,也能设计具有物理可实现性的3D错觉物体。一个物体在现实中只有一种形态,却能在镜子里呈现另一种视觉身份,这种「正面与镜中不一致」的效果,也为视觉感知、逆向图形学和数字制造提供了新的研究方向。

作者简介
论文作者依次为朱小佩,清华大学水木学者,合作导师为朱军教授;李泽远(共同一作),华中科技大学本科生,以及清华大学朱军教授和胡晓林副教授(通讯作者)。

最新快讯

2026年07月24日

17:54
鼓狮财经7月24日电,日本总务省24日公布的数据显示,6月日本去除生鲜食品后的核心消费价格指数(CPI)同比上升1.6%至113.1,连续58个月同比上涨。食品价格上涨仍是日本核心CPI上涨的主要推动力。
17:54
A股缩量调整,截至收盘,上证指数跌1.61%报3814.20点,深证成指跌2.47%报13774.68点,创业板指跌2.65%报3480.87点,市场成交额不足2万亿元,三市成交额19444亿元,较上日缩量2650亿元。贵金属深度回调,基本金属、互联网、软件、制药、电力板块跌幅居前,半导体产业链有所回暖,长鑫存储、半导体设备、先进封装方向涨幅居前。一、ETF...
17:30
7月17日,努比亚的AI宠物机器人iMoochi将正式上线,AI宠物赛道又添一员大将。从年初CES上以“最无用却最想掏钱”走红的日本mirumi,到华为“智能憨憨”开售10秒即售罄,再到Ropet、Fuzozo芙崽等品牌的持续热销,一个以情感陪伴为名的赛博宠物赛道,正以前所未有的速度挤满玩家。对于想养宠物但没条件的打工人,不用铲屎、不用喂食...
17:22
据鼓狮财经7月24日消息,法国总统马克龙宣布,法国已向欧盟提出援助请求,以协助应对西南部持续蔓延的森林大火。马克龙在社交媒体上发文指出,当前的火势依然极其严峻,法国正面临山火肆虐,其中吉伦特省的情况最为危急。他表示,法国已正式申请启动欧盟民防机制。据悉,法国将获得包括克罗地亚提供的两架Canadair灭火飞机、葡萄牙提供的两架“空中拖拉机”灭火飞机,以及捷克...
17:22
近日,特斯拉发布了一份喜忧参半的财务报告。7 月 23 日,特斯拉公布了 2026 年第二季度的财报。从营收数据来看,这份成绩单相当亮眼:第二季度交付量达到 48 万辆,同比增长 25%,创下历史新高;营收为 286.2 亿美元,同比增长 26%,过去十二个月的营收首次突破 1000 亿美元大关。其中,服务及其他业务的毛利率攀升至 14%,较上一季度的 9....
17:21
《科创板日报》7月24日讯 下周,SK海力士、三星及铠侠三家存储龙头即将公布最新业绩。在市场对AI投资可持续性及存储长约可靠性的疑虑下,这几份财报也将成为检验巨头在这一轮周期中盈利能力的“试金石”。 ▌SK海力士 SK海力士将于7月29日周三披露二季度财报。公司首席执行官Kwak Noh-Jung预计,为满足AI快速增长的需求,存储芯片供应紧张局面将持续至2...
16:47
2026年的WAIC,算力、大模型、AI硬件、具身智能无疑是绝对焦点,行业比拼仍围绕技术参数、基建投入与工程落地能力展开,延续着过去几年AI行业的核心叙事。 但在这条主线之外,还有一条容易被忽略的脉络暗线——内容平台正集体下场,成为WAIC不容忽视的玩家。从黑客松作品展示,到开发者专属论坛,再到AI创作公开赛成果亮相,小红书、B站、知乎不约...
16:47
7月16日晚9点,距离WAIC(世界人工智能大会)开幕不到24小时,月之暗面(Kimi)突然“空降”发布Kimi K3,抢走了最大的焦点。 Kimi K3最具颠覆性的标签,是其2.8万亿的参数规模。作为全球首款万亿级开源大模型,K3支持100万Token上下文窗口,在多项主流测评中得分超过了GPT-5.6、Fable 5。不少AI一线从业者...
16:47
据《华尔街日报》7月24日报道,美国金融科技巨头Stripe正在洽谈收购AI模型中转平台OpenRouter。目前交易金额尚未公布,但知情人士透露,这笔交易的估值可能高达约100亿美元,约合人民币677.55亿元。此外,还有多家科技巨头也在密切关注并考虑收购OpenRouter。虽然Stripe与OpenRouter的交易可能很快宣布,但谈判仍存在破裂或出现...
16:47
模型的架构正在以超出工具链进化速度的方式膨胀,与此同时,国产算力的崛起让异构管理从可选项变成了必答题。那么,推理工程核心挑战如何破局?AI Infra 下一阶段技术演进方向在哪里? 近日,InfoQ《极客有约》X AICon 直播栏目特别邀请华为 AI 开源生态总监黄之鹏担任主持人,和Inferact vLLM committer 莫梓峰、...
16:47
Mobileye财报发布当日,其创始人兼CEO Amnon Shashua突然辞职,直接走人。这一消息在自动驾驶行业激起了千层浪。因为 Amnon Shashua 绝非普通 CEO。他是 Mobileye 的缔造者,自动驾驶视觉路线的奠基人,甚至曾是马斯克特斯拉自动驾驶路线的引路人。他不仅将摄像头 AI 技术带入数千万汽车,更曾促成英特尔以 153 亿美元收...
16:47
近一个月,智能硬件领域最引人注目的赛道无疑是AI智能体手机。继7月15日网信部门首次公布7款手机端侧生成式人工智能服务备案名单后,在世界人工智能大会(WAIC)期间,阶跃星辰与中兴努比亚的AI手机展台前人头攒动,人们急切地想一窥未来手机的模样。 AI智能体手机的兴起,核心在于“端侧AI”这一关键技术。它让大模型直接在手机本地运行,而非将数据上传至云端。聊天记...