首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
智能AI morning

视觉AI从「会生成」走向「能创作」,RabbitVis探索AI应用新范式

摘要

机器之心发布 随着 AI 生图能力不断提升,如何让 AI 真正进入创作流程成为新的行业问题。兔展智能基于 UniWorld-Design 视觉 AI 大模型推出 RabbitVis,尝试推动视觉 AI 从图片生成走向可编辑、可交付的创作流程。 AI 产业的代际跨越时间越来越短! 从 ChatGPT 到文生图,再到视频生成,大模型不断刷新人们对 AI 能力的认知。「AI 会不会生成」这个问题,已经不...

RabbitVis UniWorld 如何让 Design 机器之心发布 生图能力不断提升 真正进入创作流程成为新的行业问题 兔展智能基于 大模型推出 尝试推动视觉
2026-08-06 1 阅读 约10分钟阅读 机器之心
分享:
字号:
机器之心发布 随着 AI 生图能力不断提升,如何让 AI 真正进入创作流程成为新的行业问题。兔展智能基于 UniWorld-Design 视觉 AI 大模型推出 RabbitVis,尝试推动视觉 AI 从图片生成走向可编辑、可交付的创作流程。 AI 产业的代际跨越时间越来越短! 从 ChatGPT 到文生图,再到视频生成,大模型不断刷新人们对 AI 能力的认知。「AI 会不会生成」这个问题,已经不再需要讨论。 但与此同时,一个新的变化也开始出现。 大家关注的,不再只是大模型参数或者生成效果,而是一个更加现实的问题: AI 能不能真正完成一项工作? 今天,大多数 AI 已经能够生成一张足够漂亮的图片;但真正的创作,并不会在图片生成的那一刻结束。 尺寸是否准确、图层是否可编辑、素材能否复用、多人如何继续协作…… 这些真正影响创作效率的工作,仍然需要用户回到传统软件中继续完成。 现实世界的痛点,让视觉 AI 的竞争,也进入了新的阶段。 如果说过去比拼的是「谁生成得更像」,时至今日,比拼的则是 谁能够真正进入创作设计生产流程。 RabbitVis 正式上线,立即体验 AI 设计生产工具:https://rabbitvis.rabbitpre.com/ 点击官方链接,加入官方社区,与更多用户一起探索 AI 设计生产的新方式。 在这样的背景下,兔展智能给出了自己的答案。 此前,兔展智能联合北京大学、鹏城实验室研发的 UniWorld-View 登顶 WorldScore 世界模型榜单,展现了团队在视觉 AI 领域的技术积累。 基于多年视觉 AI 技术积累,兔展智能将 AI 大模型能力转化为实际应用。面向设计生产场景,兔展智能研发了 UniWorld-Design,进一步强化了视觉生成与编辑能力的结合,并基于此打造了产模一体战略的重要产品 —— RabbitVis。 AI 开始回答一个新问题:如何真正完成一项工作? 如果把过去几年的 AI 演进画成一条时间线,不难发现,每一个阶段关注的问题都在发生变化。 最初,人们讨论的是「AI 能不能理解?」 随后,大模型开始进入快速发展阶段,行业关注点逐渐转向「AI 能不能生成?」 最近一段时间,无论是文本、图片还是视频,大模型都在不断突破能力边界。越来越真实的人物、越来越自然的光影、越来越丰富的视觉效果,让 AI 生成逐渐从技术演示走向实际应用。 但随着 AI 与日常生活的嵌合越来越紧密,大家开始对 AI 提出更高的要求。 生成之后呢?能否继续编辑?素材能不能导出?…… 对于创作而言,真正需要的,从来不只是一张图片,而是一项能够交付的最终成果。 设计如此、营销如此、各行各业亦是如此…… 而越来越多的 AI 产品也开始从「展示能力」,转向「完成任务」;从回答问题,转向围绕具体行业重新组织能力:有的进入医疗,有的进入金融,有的进入制造,也有的开始进入设计生产。 换句话说,AI 正在从通用能力竞争,逐渐走向工作能力竞争。 而视觉 AI,也开始进入属于自己的下一阶段。 RabbitVis:灵感落地,一站完成,体验前所未有的图层级一站式 AI 设计工具 RabbitVis 正是在这样的背景下诞生的。 它并没有把目标停留在「生成更多图片」上,而是把关注点放在另一个问题: 如何让 AI 真正参与创作设计生产,而不仅仅只是完成一次生成。 从一张图片,到一次完整创作 随着大模型的不断发展,AI 生图最大的变化,是越来越会「画」。 人物更加真实,构图更加合理,光影更加自然,甚至连复杂的字体、细节和材质表现,也在不断提升。 对很多用户而言,一张高质量图片已经能够满足部分创作需求。 但当内容进入真实创作场景,用户往往还需要继续完成修改、调整、适配等工作。 一张商品详情页,不只是完成视觉呈现,还需要继续调整文案、版式、尺寸和素材;一套品牌物料,也不只是生成一张海报,而是围绕同一主题完成多尺寸、多规格、多场景的持续设计。 真正消耗时间的,并不是第一次 AI 生成,而是生成之后大量的修改、调整、排版和交付。 例如:AI 生成了一张满意的图片,但后续仍需要重新导入 Photoshop、Illustrator 等专业设计软件继续处理;图层需要重新拆分,文字需要重新排版;甚至还要针对不同平台导出不同规格文件。 RabbitVis 丝滑的图层分解能力 也就是说,AI 完成了「生成」,但并没有真正进入创作流程的后半程。 同时,生成、编辑、排版、协作往往分散在不同工具中,用户仍需要在多个软件之间反复切换,将 AI 输出逐步加工成最终成果。 RabbitVis 流式生成设计,实时显示生成结果 但 RabbitVis 的出现,解决了这一段长期存在于创作流程中的「断点」。 相比于继续提升单次生成效果,RabbitVis 实现了 AI 能力从图片生成,到进一步进入创作设计生产流程的跨越。 以上依次为去背景、图像编辑、文字编辑、橡皮擦功能,这些,都可以用一句话实现 下面是 RabbitVis 生成的精美海报: RabbitVis 杂志内页生成效果 RabbitVis 财务分析报表生成效果 RabbitVis 学术海报生成效果 RabbitVis 信息长图生成效果 在 RabbitVis 中,用户不仅可以生成透明底素材、商品详情页、杂志跨页等等不同类型的设计内容,还可以围绕同一项目继续修改、持续编辑,并逐步完成后续设计工作。 这种从生成到创作的变化,背后依靠的是兔展智能在视觉 AI 领域持续积累的技术能力。 传统 AI 生图通常输出一张完整图片,但真实设计流程并不是简单展示一张图片,而是需要对其中不同元素进行持续调整。背景、主体、文字、装饰元素等,都需要作为独立对象参与后续编辑。 基于这一需求,UniWorld-Design 以图层作为视觉内容的重要组织方式,让模型不仅能够生成图像,还能够理解图像中的结构关系,并支持图层级生成与编辑。 在设计任务中,UniWorld-Design 的透明素材生成能力可以根据文本描述生成可直接使用的透明设计元素;图像分层能力则能够将完整图像拆解为多个可编辑层级,为后续调整、组合和复用提供基础。 Uniworld-Design 技术报告链接:https://rabbitvis.rabbitpre.com/blog/uniworld-design-report 相关评测显示,在 I2L 图像分层评估中,UniWorld-Design 围绕逐层视觉质量、Alpha Soft IoU、可编辑性等指标进行了验证,其中,在逐层视觉质量指标 RGB L1 中取得 0.1264(越小越好),Alpha Soft IoU 取得 0.7325(越大越好),可编辑性取得 1.32(越小越好);在 VLM 主观评分中,UniWorld-Design 综合评分达到 20.43(满分 25,越大越好),归一化总分达到 0.817(分值区间 0-1,越大越好)。 在 T2RGBA 透明素材生成评估中,UniWorld-Design 生成素材与文本描述的语义匹配能力进一步提升,CLIP Score 达到 33.03。 这些能力进一步被封装进 RabbitVis 中,为 AI 进入更复杂的设计任务提供技术基础。 为什
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱