Source: 量子位View original ↗
Copyright remains with the original source. This site only collects, translates, or reformats the material.
Source summary
兔展智能发布RabbitVis,让AI真正走完设计全流程
Source: 量子位View original ↗
Copyright remains with the original source. This site only collects, translates, or reformats the material.
Sign in with a social account
传统 AI 生图模型通常直接输出一张完整的扁平图像,这导致后续的微调工作极为繁琐。例如,当需要将 Logo 左移、放大字号或适配不同尺寸时,设计师往往需要借助专业软件重新排版。RabbitVis 背后的核心技术——UniWorld-Design 模型,正是为了解决这一痛点而生。它不再将图像视为一个整体,而是以图层作为视觉内容的组织方式,让模型能够理解图像中的结构关系,并支持图层级的生成与编辑 [量子位]。
这种图层化能力主要体现在两个方面。其一是透明素材生成,即模型可根据文本描述直接生成无背景的设计元素,方便复用;其二是图像分层能力,能够将一张完整的图像拆解为背景、主体、文字等多个可独立编辑的层级。在相关评测中,UniWorld-Design 在衡量分层质量的逐层视觉质量、Alpha Soft IoU 及可编辑性等指标上均展现了不错的数据表现,为后续的组合与调整提供了基础 [搜狐]。
值得注意的是,AI 对内容结构的深层理解正成为行业突破的方向。就在 RabbitVis 强调图层编辑的同时,火山引擎上线的 Seedance 2.5 视频模型也在强调其“更精准、稳定的编辑能力”,并原生支持 30 秒长视频直出与多模态素材参考 [IT之家]。这反映出无论是静态设计还是动态视频,AI 工具都在从“一次性生成”向“可精细化控制”演进,以满足专业生产环境对反复修改和叙事结构的刚性需求。