核心看点
兔展智能基于UniWorld-Design视觉AI大模型推出RabbitVis,试图解决一个行业痛点:AI能生成漂亮图片,但无法进入真实创作流程。RabbitVis的核心突破在于图层级生成与编辑,让AI生成的内容成为可继续创作的起点,而非终点。
AI生图的「最后一公里」问题
从ChatGPT到文生图,再到视频生成,大模型不断刷新认知。「AI会不会生成」这个问题,已经不再需要讨论。
但真正的创作,不会在图片生成的那一刻结束:
- 尺寸是否准确?
- 图层是否可编辑?
- 素材能否复用?
- 多人如何协作?
这些真正影响创作效率的工作,仍然需要用户回到Photoshop、Illustrator等传统软件中继续完成。AI完成了「生成」,但并没有真正进入创作流程的后半程。
RabbitVis的解题思路:图层级AI设计
1. 透明素材生成
支持生成可直接用于设计的PNG透明底素材,AI输出能够直接进入后续编辑、排版和组合环节,省去抠图、裁切、边缘处理等耗时工作。
2. 图像分层能力
将完整图像拆解为多个可编辑层级(背景、主体、文字、装饰元素等),为后续调整、组合和复用提供基础。这是传统AI生图工具完全不具备的能力。
3. 自然语言编辑
用户输入一句自然语言,即可完成初始设计;随后继续调整版式、更换素材、修改文字,并根据不同场景导出对应规格文件。不需要重新输入Prompt等待重新生成。
4. 流式生成设计
实时显示生成结果,生成、编辑、排版、协作在同一工具中完成,不再需要在多个软件之间反复切换。
技术底座:UniWorld-Design
RabbitVis的能力来自兔展智能研发的UniWorld-Design视觉AI大模型,其技术特点包括:
- 以图层作为视觉内容的组织方式 —— 模型不仅生成图像,还能理解图像中的结构关系
- 支持图层级生成与编辑 —— 突破传统AI生图「一次性输出」的限制
- 透明素材生成能力 —— 根据文本描述生成可直接使用的透明设计元素
在I2L图像分层评估中,UniWorld-Design的Alpha Soft IoU达到0.7325,可编辑性评分1.32(越小越好),VLM主观评分综合达到20.43/25。
应用场景
RabbitVis已经能够支持多种设计场景:
- 商品详情页生成
- 杂志跨页设计
- 品牌物料多尺寸适配
- 财务分析报表
- 学术海报
- 信息长图
总结
AI竞争的下一阶段,或许不再只是比拼「谁更会生成」,而是比拼「谁更能完成」。RabbitVis的探索表明,视觉AI的真正价值不在于生成一张漂亮的图片,而在于能否进入真实业务流程、持续创造价值。
当大模型逐渐成为基础设施,真正拉开差距的,是把模型能力转化为可落地、可交付、可持续使用的AI产品。从生成图片,到完成设计;从单次输出,到持续编辑 —— 这可能是后AI生图时代,视觉AI真正值得关注的新方向。
官网:https://rabbitvis.rabbitpre.com/
本文地址:https://www.163264.com/14667


微信扫一扫,鼓励一下~