当前位置: 首页
AI
开源InstanceAssemble:小红书让AI精准还原复杂图像排版

开源InstanceAssemble:小红书让AI精准还原复杂图像排版

热心网友 时间:2025-12-26
转载

12月26日,IT之家从相关渠道获悉,小红书携手复旦大学,联合推出了一项在布局控制生成领域的突破性方案——InstanceAssemble。这项技术通过创新的“实例组装注意力”机制,成功实现了从简单到复杂、从稀疏到密集布局的精准图像生成。目前,这项研究成果已被人工智能顶级会议NeurIPS 2025收录。

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

小红书开源InstanceAssemble:让AI精准还原复杂图像排版

近年来,AI绘画技术发展迅速,已经从最初的“文字生成图像”逐步迈向“布局控制生成”阶段。后者能依据用户设定的空间布局约束,生成与之精确对应的图像内容。

然而,“布局控制生成”技术面临着一个核心难点:如何让AI既精准地按照用户指定的位置和内容生成图像,又有效避免布局对不准、语义脱节或计算成本过高等问题。

此次复旦与小红书联合发布的InstanceAssemble新技术,成功实现了对图像中每个物体的精确布局控制,标志着AI绘画正式迈入了“可精准构图”的新阶段。

小红书开源InstanceAssemble:让AI精准还原复杂图像排版

该技术基于当前主流的扩散变换器架构,开创性地提出了“实例拼装注意力”机制。用户只需提供每个物体的边界框位置和内容描述,AI就能在对应位置生成符合语义的图像内容。无论是简单的几个物体组合,还是密集复杂的场景构图,InstanceAssemble均能保持高精度的布局对齐与语义一致性。

值得一提的是,该技术还采用了轻量级适配方式来降低使用门槛,无需重新训练整个模型。其仅通过约7100万个参数,就能适配Stable Diffusion3-Medium模型;而对Flux.1模型的适配参数占比更是低至0.84%。

在实验中,InstanceAssemble在包含90万个实例的密集布局数据集上表现优异,大幅超越了现有方法。

为了更准确地衡量布局与图像的匹配程度,研究团队还创建了一个包含5000张图像和9万个实例的“Denselayout”基准测试集,并引入了全新的“Layout Grounding Score”评估指标。

实验结果表明,InstanceAssemble在各种布局条件下均表现领先。即使在训练时仅使用了稀疏布局的数据,在面对密集布局时,它也能展现出稳健的性能。

目前,该项技术已正式开源,相关代码和预训练模型均可在GitHub获取。这为设计、广告和内容创作等领域的应用落地,提供了强有力的技术支撑。

来源:https://tech.ifeng.com/c/8pOXpDLF3xM

游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

同类文章
更多
华为AI深度布局:如何引领科技变革新格局

华为AI深度布局:如何引领科技变革新格局

新智元报道编辑:艾伦【新智元导读】华为诺亚方舟实验室主任王云鹤官宣离职。我们梳理了王云鹤的经历。王云鹤今日在朋友圈官宣,将辞去华为诺亚方舟实验室主任职位,告别华为。从 2025 年 3 月到今天,王

时间:2026-03-28 18:52
Claude限流,Altman紧急叫停Sora:AI竞争格局改变

Claude限流,Altman紧急叫停Sora:AI竞争格局改变

新智元报道编辑:元宇【新智元导读】Sora应用关停,Claude却因太火而被限流:一个烧不起,一个供不上,算力墙面前,AI竞赛的胜负手突然变了。一夜之间,打工人突然发现:Claude开始限流了。An

时间:2026-03-28 18:46
谷歌内存论文疑被抄袭,华人学者控诉业内学术不公

谷歌内存论文疑被抄袭,华人学者控诉业内学术不公

新智元报道编辑:好困 Aeneas【新智元导读】把闪存股一夜干崩的谷歌顶会论文,出大事了。TurboQuant的核心方法,两年前就被一位华人学者做完、发完顶会、代码全部开源了。谷歌不仅没正面提及,而

时间:2026-03-28 16:58
OpenClaw漏洞威胁:智能家居被反锁与隐私泄露风险

OpenClaw漏洞威胁:智能家居被反锁与隐私泄露风险

新智元报道编辑:倾倾【新智元导读】2025年底,极客圈发生了一场数字哗变,Anthropic的遮羞布被Peter Steinberger撕了个精光。从OpenClaw开源到Claude被扒出80页「

时间:2026-03-28 16:52
华为大模型负责人离职,重大人事变动引发行业关注

华为大模型负责人离职,重大人事变动引发行业关注

智东西作者|江宇编辑|冰倩智东西3月28日报道,今日,华为诺亚方舟实验室主任、华为盘古大模型负责人王云鹤在朋友圈发文,确认离职。王云鹤于2017年以华为北京部门首位实习生身份加入,至今已接近9年。在

时间:2026-03-28 16:46
热门专题
更多
刀塔传奇破解版无限钻石下载大全 刀塔传奇破解版无限钻石下载大全
洛克王国正式正版手游下载安装大全 洛克王国正式正版手游下载安装大全
思美人手游下载专区 思美人手游下载专区
好玩的阿拉德之怒游戏下载合集 好玩的阿拉德之怒游戏下载合集
不思议迷宫手游下载合集 不思议迷宫手游下载合集
百宝袋汉化组游戏最新合集 百宝袋汉化组游戏最新合集
jsk游戏合集30款游戏大全 jsk游戏合集30款游戏大全
宾果消消消原版下载大全 宾果消消消原版下载大全
  • 日榜
  • 周榜
  • 月榜
热门教程
更多
  • 游戏攻略
  • 安卓教程
  • 苹果教程
  • 电脑教程